中国AI企業の「無断蒸留」手法に注目…非公開の推論過程まで抽出か [韓国記者コラム]
このニュースをシェア
【09月19日 KOREA WAVE】中国の人工知能(AI)企業が、米国のAIモデルの最終回答だけでなく、外部に公開されていない内部の推論過程まで抽出し、学習に利用したとする事例が明らかになった。
中国AI業界では7月、海外モデルの暗号化された推論情報を解読して学習に利用しているとの告発が浮上。その後、国際研究チームが暗号化された推論情報を別のモデルに入力し、元の推論過程を復元できることを実験で確認した。
チュービンゲン大学やマックス・プランク研究所などの研究チームは8月10日、「独自の大規模言語モデル(LLM)APIから推論履歴を盗む」と題した論文を公開した。
研究チームは、アンソロピック、OpenAI、GoogleのAIが生成した暗号化された推論情報を別のセッションやモデルで再利用し、元の内部推論を復元できる脆弱性を確認した。例えば、Claude Opusが生成した暗号化された「思考過程」を下位モデルのHaikuに入力し、元の推論内容を抽出したという。
これは一般的なAIモデルの「蒸留」とは異なる。通常の蒸留は、高性能なAIが生成した回答などを学習データとして別のモデルの性能向上に利用する技術だが、今回確認された手法では、最終回答だけでなく外部に公開されない問題解決の過程まで抽出して学習に利用できるとしている。
中国AI業界では論文発表前の7月にも、同様の内容を記した文書が出回った。匿名の業界関係者が作成したとされる文書には、4~5月ごろにZhipu AIが海外モデルの暗号化された推論過程を解読し、その方法やデータをほかの中国企業と共有したとの主張が記されていた。ただし、記事に登場するAI業界関係者は、企業間でデータ抽出方法を共有したとの主張については確認できないとしている。
アンソロピックも10日、脅威情報報告書を公表し、2月以降の7カ月間にMoonshot AI、DeepSeek、Alibaba、Xiaomi、Zhipu AI、SenseTime、MiniMaxの中国に拠点を置く7社の研究組織による「無断蒸留攻撃」を確認したと発表した。
アンソロピックによると、5~7月に観測した関連アクセスはAlibabaが1億5100万件以上、Moonshot AIが2300万件以上、DeepSeekが1210万件以上、Zhipu AIが340万件以上だった。
特にMoonshot AIは、Claudeの暗号化された思考過程を保存し、新たなセッションに再入力して元の内部推論を復元する「クロスセッション・リプレイ」と呼ばれる手法を使ったという。DeepSeekでも同様の手法が確認されたとしている。
アンソロピックは、通常の蒸留は広く使われているAI学習手法だとする一方、競合他社の非公開モデルの能力を許可なく大規模に抽出し、自社モデルの学習に利用する行為を「無断蒸留」と位置付けている。
米国と中国の政府間でもAIモデルの蒸留を巡る対立が表面化している。米国家安全保障局(NSA)や連邦捜査局(FBI)などは8日、中国AI企業が米国のAIモデルを「産業規模で悪意を持って蒸留した」と批判。中国商務省は「事実上の根拠も法的根拠もない」と反発し、蒸留はAI分野で一般的に使われる中立的な技術だと主張している。 【news1 キム・ジョンヒョン記者】
(c)news1/KOREA WAVE/AFPBB News