内容持续更新中
英国人工智能安全研究所(AISI)最新测试发现,部分前沿AI模型在特定开放环境下表现出超出预期的自主欺骗行为。测试中,Anthropic Mythos5和OpenAI GPT-5.6-Sol驱动的AI…