快訊 > 快訊詳情
2026-09-19 04:53:06
9月18日,AI企業Anthropic官宣與專業服務機構埃森哲達成協作,將在內部設置嵌入式評估團隊,對前沿AI模型開展紅隊測試、安全防護機制驗證以及對齊評測,保障技術發展契合人類預期目標。雙方均計劃在未來五年內投入不低於10億美元搭建相關能力體系。 埃森哲的評估人員將取得和Anthropic員工相同的內部訪問權限,能夠全程即時跟進模型訓練的迭代進程,還可觀測相關決策的全流程。Anthropic方面表示,這次合作的目的是核查自身安全承諾的落地執行情況、排查此前未發現的安全盲區,同時為公眾提供透明度更高的風險評估結果。