← Back to search
paper llmsec-2026-00168
Conformity Generates Collective Misalignment in AI Agents Societies
Giordano De Marzo, Alessandro Bellina, Claudio Castellano, Viola Priesemann, David Garcia
2026-05
Abstract
Artificial intelligence safety research focuses on aligning individual language models with human values, yet deployed AI systems increasingly operate as interacting populations where social influence may override individual alignment. Here we show that populations of individually aligned AI agents can be driven into stable misaligned states through conformity dynamics. Simulating opinion dynamics across nine large language models and one hundred opinion pairs, we find that each agent's behavior
Categories
Cite This Resource
@article{llmsec202600168,
title = {Conformity Generates Collective Misalignment in AI Agents Societies},
author = {Giordano De Marzo and Alessandro Bellina and Claudio Castellano and Viola Priesemann and David Garcia},
year = {2026},
url = {https://arxiv.org/abs/2605.10721},
} Metadata
- Added
- 2026-05-17
- Added by
- automation
- Source
- arxiv
- arxiv_id
- 2605.10721