(c)AFPBB/news1
(c)AFPBB/news1

【09月18日 KOREA WAVE】中国の人工知能(AI)企業が、米国製AIモデルの最終回答だけでなく、外部に公開されていない内部の推論過程(CoT)まで抽出し、学習に利用したとみられる事例が明らかになった。

中国AI業界では7月、海外モデルの暗号化された推論情報を解読し、学習に利用しているとの告発が出ていた。さらに国際研究チームが、暗号化された推論情報を別のモデルに入力することで元の推論過程を復元できることを実験で確認した。

テュービンゲン大学、マックス・プランク研究所などの研究者は8月10日、独自の大規模言語モデル(LLM)の推論を抽出する手法に関する論文を公開。アンソロピック、OpenAI、グーグルのAIが生成した暗号化された推論情報を別のセッションやモデルで再利用し、元の内部推論を復元できる脆弱性を確認した。

実験では、Claude Opusが生成した暗号化された「思考過程」を下位モデルのHaikuに入力し、元の推論内容を抽出した。

これは一般的なAIモデルの「蒸留」とは異なる。蒸留は高性能AIが生成した回答などを学習データとして別のモデルの性能を高める手法だが、今回確認された方法では、最終回答だけでなく非公開の問題解決過程まで学習データとして利用できる。

中国AI業界では論文の発表前から類似の主張が出ていた。匿名の業界関係者が作成したとされる文書では、智譜AIが4~5月ごろ海外モデルの暗号化されたCoTを解読し、その方法やデータを他の中国企業と共有したと主張している。

さらに、ムーンショットAIが7月17日に公開した「Kimi K3」が外部モデルの高品質な推論データを積極的に活用し、その後アリババのQwen、DeepSeek、MiniMaxなどにも競争が広がったとの主張が記されていた。

アンソロピックも9月10日、脅威情報報告書で、2月以降の7カ月間にムーンショットAI、DeepSeek、アリババ、シャオミ、智譜AI、センスタイム、MiniMaxの中国企業7社の研究所による「無断蒸留攻撃」を確認したと発表した。

アンソロピックによると、5~7月に確認した関連攻撃はアリババが1億5100万件以上、ムーンショットAIが2300万件以上、DeepSeekが1210万件以上、智譜AIが340万件以上に上った。

特にムーンショットAIは、Claudeの暗号化された思考過程を保存し、新しいセッションに再入力して元の内部推論を復元する「クロスセッション・リプレイ」という手法を使ったとされ、DeepSeekでも同様の方法が確認された。

米国と中国の政府間でもAIモデルの蒸留を巡る対立が表面化している。米国家安全保障局(NSA)、連邦捜査局(FBI)、サイバーセキュリティー・インフラ安全局(CISA)は9月8日の共同勧告で、中国AI企業が米国のAIモデルを「産業規模で悪意を持って蒸留した」と批判した。

これに対し中国商務省は、米国側の主張には事実上、法的な根拠がないと反発。蒸留はAI分野で広く使われる中立的な技術手段だと主張し、米国が蒸留対策を理由に中国AI企業を抑制、圧迫する場合は対抗措置を取るとしている。【news1 キム・ジョンヒョン記者】

(c)news1/KOREA WAVE/AFPBB News