Y Combinatorの最高経営責任者(CEO)であるGarry Tanは、米国は、より強力なオープンウェイトモデル群を構築し、中国の研究所に依存しないことを目的に、より小規模な米国のAI研究所が米国の先進モデルから知識を蒸留することを認める必要があるかもしれないと考えている。Anthropicが中国の研究所による先進モデルへの違法な蒸留攻撃を非難している時期に、この見解が示された。
CNBCとのインタビューでTanは、中国の研究所による蒸留技術の利用に対して規制上の介入を行うつもりはないと述べ、「米国の蒸留システム」を構築する可能性を提起した。TanはTechCrunchに対し、これはオープンウェイトモデルを開発する米国の研究所がこうした技術を利用できるようにすることを意味し、なりすましや詐欺、認証情報の窃盗ではなく、明確なアクセス条件の下で、対象モデルに「正面玄関から」アクセスすることだと説明した。
モデル蒸留とは何か?
モデル蒸留とは、別のモデルの出力を活用して新しいモデルを訓練することであり、多くの場合、対象モデルに大量のリクエストを送り、その回答や推論方法を分析する。AI研究所は、訓練やモデル改善の一部のシナリオでこの技術を合法的に利用しているが、許可なく対象モデルにアクセスしたり、利用主体の身元を隠したりすると、その利用範囲は争点となる。
記事によると、Anthropicは今週、中国の研究所が「違法な蒸留攻撃」を実施したと非難する2本目の報告書を発表した。同社によれば、これらの活動には身元の隠蔽、詐欺、そしてモデルへのアクセスにおける盗まれた認証情報の利用が含まれていた。AnthropicのCEOであるDario Amodeiは、この種の蒸留に対して米国の規制当局がより厳格な措置を講じるよう公に求めていた。
なぜTanは異なる立場を示すのか?
Tanの主張は、米国と中国の競争だけにとどまらない。彼は、AI研究所が、APIを通じて顧客が得た情報について顧客が何をするかを広範に管理する権限を持つべきではないと考えている。彼の見方では、クローズドモデルの出力利用に厳しい制限を課すことは、研究者や開発者がオープンな代替モデルを構築する能力を制限しかねない。
Tanはこの立場を、商用モデル自体の訓練の歴史とも結び付けている。彼は、クローズドモデルの研究所が、自らのシステムを訓練するために、著作権で保護された素材を含む、広く利用可能な膨大な量の人類の知識を収集してきたと指摘するが、知的財産権者の許可を常に得ていたわけではない。そこから彼は、広範な公開データで訓練された知能へのアクセスは、民間企業が課す利用規約によって完全に管理されるのではなく、公共の利益に近いものであるべきだと論じている。
実際には何が変わるのか?
この考えが政策に転じれば、争点は、あらゆる種類のモデル複製を許可することではなく、アクセス条件、利用範囲、対象モデルの同意を証明する方法に置かれることになる。Tanが、認可された蒸留と認証情報の窃盗に基づく蒸留を区別している点は重要だ。彼は、Anthropicが中国の研究所に帰している活動を擁護しているのではなく、より小規模な米国の研究所に、先進モデルの出力を合法的に利用する機会を与えることを擁護している。
オープンウェイトモデルの開発者にとって、このアプローチは、ゼロからFrontierモデルを開発するために必要な資本、研究者、インフラを持つ研究所との間にある資源格差を縮める可能性がある。一方、先進的な商用研究所は、自社のクローズドモデルの価値や、インターフェースと出力の利用を管理する能力への脅威と見る可能性がある。
意見と事実
Tanは、自身の立場をAI市場の多元性を維持する手段として提示している。彼は、資本と優秀な研究者への最良のアクセスを持つ一社が最も強力なモデルを所有し、先進的な能力への唯一の入り口となるシナリオに警鐘を鳴らしている。オープンウェイトモデルはユーザーにより大きな自由とアクセスを与える一方、先進的な研究所は新たな能力の開発への投資を継続できると考えている。
しかし記事は、このような「蒸留システム」について米国で規制上の合意が存在する証拠を示しておらず、知的財産権、契約条件、認可された利用を検証する方法に関する問題も決着していない。したがって、Tanの提案は、経済安全保障と企業の権利、研究者の利益、モデルの悪用リスクが交差する議論における政治的・思想的な立場にとどまり、施行中の政策の発表ではない。