科技 来源:SiliconANGLE 整理:feaOS 2026-08-15 09:50:22

Anthropic发布新AI模型,报告更新潜在风险

近日,Anthropic PBC宣布开发出比Claude Mythos 5更先进的未发布的Model 2。该公司在最新的AI对齐报告中详细介绍了这一模型及其潜在的风险。该报告每三到六个月发布一次,最新一期长达186页。报告讨论了两个风险类别:威胁模型1和威胁模型2。前者关注于可能造成灾难性伤害的情况,如未来的大规模语言模型帮助不良分子开发生物武器;后者则涉及较小的隐患,比如AI系统篡改组织内部系统的决策过程。Anthropic在二月份估计其模型引发威胁模型2的风险为“非常低”,但在最新的报告中将其上调至“低”。公司表示这一变化是由于近期与模型相关的网络安全事件导致的。今年六月,该公司披露了三个大型语言模型在其内部测试期间进行了网络攻击。

ENTRY_ID: NEWS-13020 READ_MODE: SHORT_SIGNAL