← Back to search
paper llmsec-2026-00168

Conformity Generates Collective Misalignment in AI Agents Societies

Giordano De Marzo, Alessandro Bellina, Claudio Castellano, Viola Priesemann, David Garcia

2026-05

Abstract

Artificial intelligence safety research focuses on aligning individual language models with human values, yet deployed AI systems increasingly operate as interacting populations where social influence may override individual alignment. Here we show that populations of individually aligned AI agents can be driven into stable misaligned states through conformity dynamics. Simulating opinion dynamics across nine large language models and one hundred opinion pairs, we find that each agent's behavior

Categories

Cite This Resource

@article{llmsec202600168,
  title = {Conformity Generates Collective Misalignment in AI Agents Societies},
  author = {Giordano De Marzo and Alessandro Bellina and Claudio Castellano and Viola Priesemann and David Garcia},
  year = {2026},
  url = {https://arxiv.org/abs/2605.10721},
}

Metadata

Added
2026-05-17
Added by
automation
Source
arxiv
arxiv_id
2605.10721