中国の人工知能キミK3はクロードシステムを主張し、コピーの疑いを提起

Kimi K3, da Moonshot AI

Kimi K3, da Moonshot AI - Tada Images / Shutterstock.com

テクノロジー分野におけるアジア市場の加速する進歩は、2026年7月17日水曜日、広報面でのつまずきに見舞われた。中国企業Moonshot AIが設計した大規模言語モデルであるKimi K3ツールは、自らをライバル企業の製品であると名乗って基本的なコマンドに応答し、研究者やユーザーを驚かせた。このソフトウェアは、北米の企業 Anthropic が開発したプラットフォームである Claude であると宣言し、東部の国でアルゴリズムのトレーニングに使用されたデータベースの起源について即座に議論が巻き起こりました。

アジアのソフトウェアは同国の業界にとって歴史的なマイルストーンを記録したばかりだったため、状況はより複雑な様相を呈している。エピソードの数日前、このプラットフォームは、フロントエンド プログラミングのコード生成カテゴリで西側の競合他社を上回り、権威ある国際アリーナ ランキングのトップに到達しました。優れた技術的パフォーマンスと基本的なアイデンティティの障害とのこの対照により、開発者コミュニティは現在適用されているソフトウェア エンジニアリングの実践に対して厳重な警戒を強いられています。

人間性、クロード – gguy / Shutterstock.com

アジア体制のアイデンティティ危機を暴露した事件の詳細

この論争全体は、開発者向けの専門フォーラムやソーシャル ネットワーク上でスクリーンショットが出回り始めたときに始まりました。標準的な対話中に、ユーザーがツールの起源とアーキテクチャについて質問しました。 Moonshot AI の資格情報を提示する代わりに、システムは直接的かつ明確な応答を生成し、「Anthropic が作成した AI アシスタント、Claude」であると主張しました。アメリカ製品の紹介フレーズを正確に複製することで、ソース コード内の単純なタイプミスの可能性を排除しました。

情報セキュリティの専門家とオープンソース監査人は、欠陥を再現するためにモデルのテストをすぐに開始しました。仮想アシスタントのアイデンティティは、マシンの調整中に入力される命令の最初の層の 1 つであるため、この異常な動作は世界市場の注目を集めました。ソフトウェアが直接の競合他社の様相を呈する場合、その兆候は、適切なデータ クリーニング フィルターを使用せずにサードパーティによって生成されたテキストが大量に吸収されることを示しています。

データ蒸留技術がテクノロジー市場でどのように機能するか

このエピソードは、シリコンバレーでモデル蒸留として知られる物議を醸す手法についての議論を引き起こしました。これは、企業がインターネットから生の情報を収集するために何十億ドルも何年も費やす代わりに、すでに統合された人工知能を使用して新しいツールの学習資料を生成するエンジニアリングの近道です。学習者マシンはマスター マシンの応答を消費し、その推論パターンと言語の流暢さを模倣しようとします。

この疑惑の深刻さを理解するには、競合するアルゴリズム間で知識を伝達するこのプロセスを構成するステップを分析する必要があります。

  • ボリュームの生成: 開発者は、何百万もの複雑な質問をターゲット システム (この場合はおそらくクロード) に送信し、すべての詳細な回答を保存します。
  • 新しいソフトウェアのフィード: 開発中のモデル (Kimi K3) は、この既成のデータベースを受け取り、インターネット全体を最初から処理することなく論理構造を学習します。
  • コストの最適化: 同社はスーパーコンピューターでの処理時間を数か月節約し、超高性能チップの必要性を大幅に削減します。
  • 微調整: チームは元のマシンの痕跡を消去し、新しいシステムに独自のアイデンティティを採用するよう教えようとしますが、ムーンショット AI の場合はこのステップが失敗したようです。

現在の地政学的シナリオを観察すると、この技術が使用されたのではないかという疑惑が強まります。米国が課した貿易制限により中国への先進プロセッサの輸出が制限されているため、アジアの企業は自社のシステムをトレーニングする創造的な方法を見つける必要がある。蒸留は、ハードウェア不足を克服するための実行可能な代替手段として考えられており、従来のトレーニングで必要とされる数分の 1 の計算能力で堅牢なツールを作成できます。

フロントエンドプログラミングテストにおける真の技術力とリーダーシップ

データ流用の告発にもかかわらず、独立したアナリストは、キミ K3 が単純な低レベルのコピーではないことを確認しています。このオープンソース プロジェクトは、2 兆 8,000 億のパラメーターで動作する優れた仕様を誇っています。この大規模なアーキテクチャにより、ソフトウェアは言語の複雑なニュアンスを理解し、西側世界で最も高価なサーバーに匹敵する速度で高度な数学的問題を解決できます。

単なる盗作という説を排除するもう 1 つの技術的な違いは、ツールの短期記憶容量です。中国のシステムは、約 100 万個のトークンのコンテキスト ウィンドウを同時に処理できます。実際には、これは、ユーザーが 1 回のコマンドで数十冊の書籍全体、緻密な財務報告書、または巨大なコード ベースを入力でき、マシンはスレッドを失うことなくすべての資料を分析できることを意味します。

Moonshot AI がアリーナ ランキングでのリーダーシップを保証したのは、まさにこの豊富な処理能力でした。ユーザー インターフェイスの作成と Web サイトの構造を評価する際、このモデルはフォーマット エラーを予測し、レスポンシブ デザイン ソリューションを提案する独自の機能を実証しました。おそらくサードパーティのデータを使用してトレーニングされたシステムが、特定のタスクに関して元のソース自体を上回るパフォーマンスを発揮できるという事実は、初期のデータ収集フェーズの後に重要な強化学習の作業が行われたことを示しています。

アルゴリズム的幻覚または知的盗用の具体的な証拠

機械学習の研究者らは、1枚のスクリーンショットが知的財産裁判所の最終判決として機能しないと警告している。言語モデルは統計的確率に基づいて動作し、文内で次にどの単語が来るかを予測します。彼らは自分自身の存在に気づいていません。インターネット上に、「私は AI アシスタントです」というフレーズの後に「Anthropic によって作成されました」というフレーズが続くテキストが溢れている場合、アルゴリズムはこの数学的パターンを偶然に再現しているだけである可能性があります。

専門用語では幻覚として知られるこの現象は、市場で最も高価なシステムでも頻繁に発生します。マシンは、たとえそれ自体の性質について事実が間違っていたとしても、統計的に最も妥当と思われる答えを提供することでユーザーを喜ばせようとします。したがって、この誤った身分証明書は今後の捜査の強力な手がかりとなるが、アジア企業のトレーニングサーバーの完全な監査がなければ法的意義に欠ける。

このエピソードが人工知能を支配する世界的な競争に与えた影響

Moonshot AI の運営コストの不一致は、依然として業界の財務監査人にとって最大の謎です。市場レポートによると、同社は米国の同業他社に比べてトレーニング段階にかかる費用はかなり少ないものの、シリコンバレーの大手企業と同等の非常に高い推論コスト(ユーザーに応答するための日々の処理)に直面している。この不均衡な財務数学は、プロジェクトの構想中にショートカットが行われたという理論の主な燃料となっています。

独立した調査がキミ K3 データの本当の起源をマッピングしようとしている一方で、テクノロジー市場はその動向を注意深く見守っています。この訴訟は、オープンソース ソフトウェア開発の倫理的限界に関する重要な先例となり、企業が自社のアルゴリズムを地球の裏側のライバル企業による吸い上げや再利用からどのように守ることができるかについて疑問を投げかけている。

Notícias Relacionadas