NEWS
Anthropic、Claude Opus 4.8 を公開——「正直さ」を鍛えたモデル
Anthropic が Claude Opus 4.8 を公開。自分の書いたコードの欠陥を見逃さず指摘する誠実さと信頼性を重視したアップデートです。
Anthropic が「Claude Opus 4.8」を公開しました。
今回の主眼は性能の数字よりも「誠実さ」。自分が書いたコードの欠陥を黙って通してしまう確率が、前版の約 4 分の 1 に減ったと報告されています。
できないことを「できない」と言い、怪しい箇所を自己申告する。
AI に仕事を任せる上で、実はこれが一番大事な性質かもしれません。
速い・賢いの次は「信頼できる」。
評価軸の変化を感じるリリースです。