Tag
This paper introduces Incognita, a framework for evaluating generative agents in socially distributed task environments where knowledge is partitioned across roles. Experiments show improvements in agent success rates but overall reliability remains low.