AI性能評価の最高点が53点から58点に…安全対策と値下げも競争 [韓国記者コラム]
このニュースをシェア
【09月27日 KOREA WAVE】最先端の人工知能(AI)は開発速度を安全対策に合わせて調整すべきだとの議論が広がる一方、企業間の性能・価格競争は続いている。米AnthropicとOpenAIは22日(現地時間)、それぞれ新たなAIモデルを発表した。
AI評価機関Artificial Analysisによると、Anthropicの新モデル「Claude Opus 5.5」は、総合性能指標「Artificial Analysis Intelligence Index」で最高設定時に58点を記録し、評価対象の首位に立った。10項目中6項目で最高点を取ったという。9月上旬にはOpenAIの「GPT-6 Astra」とAnthropicの「Claude Fable 5.1」がともに53点で並んでいた。
Anthropicのダリオ・アモデイ最高経営責任者(CEO)は今月、AIの能力向上に安全対策が追いつかなくなる可能性を警告し、開発速度の調整を提唱した。OpenAIのサム・アルトマンCEOもこの考えに賛同した。アモデイ氏の提案は開発停止ではなく、外部評価や企業間の安全基準を整え、必要に応じて能力向上の速度を抑えるというものだ。
AnthropicはOpus 5.5について、安全性も改善したと説明する。同社の試験では、モデルが隔離環境の制約を回避しようとする試みが、従来モデルなどに比べ約85%少なかった。一部のサイバーセキュリティー関連作業などを別のモデルに振り分ける措置も導入した。
価格も引き下げた。Opus 5.5の標準料金は100万トークン当たり入力4ドル(約630円)、出力20ドル(約3200円)で、いずれも前モデルより20%安い。Anthropicは、一般的な作業での運用コストは約40%下がるとしている。
OpenAIも同日、「GPT-6 Sol」と「GPT-6 Luna」を発表した。APIの標準料金は100万トークン当たり、Solが入力2ドル(約320円)、出力10ドル(約1600円)、Lunaが入力0.1ドル(約16円)、出力0.5ドル(約80円)。両モデルの料金は、従来モデルの販促価格と比べて50%低いという。
安全のために開発速度を調整するという主張と、新モデルを相次いで投入する市場競争。各社が安全対策で足並みをそろえられるかが課題となる。【news1 ナ・ヨンジュン記者】
(c)news1/KOREA WAVE/AFPBB News