情報共有、色々話そうぜ。 コードを貼るのはやめてね。
【Fable5越え?】 Kimi K3について語ろう
23レス / 最終更新 2026/07/23 14:51
>>7 クローズド市場ではOpenAIとAnthropicに勝てないからじゃない?慈悲じゃなくて、世界展開の戦略かな。 GPUへのアクセスを制限されても、中国は最先端モデルを作れるっていうメッセージになるし、計算資源の制約が結果的にアルゴリズムの革新を促したところはあると思う。 モデルだけじゃなく中国製GPUとか、中国製のAIスタックが世界的に採用されれば中国市場に長期的な影響力が生まれるし、米国政府との手続きが標準になりそうなOpenAIとAnthropicの状況と対比できるから。(米国は最高性能を囲い込んでて、中国は世界に無料で配布してくれている) そもそも中国だけでもDeepSeek,Alibaba,Zhipu,MiniMaxとあるから、国内で主導権を失わないためでもあると思う。
https://x.com/Kimi_Moonshot/status/2078855608565207130 普通に神すぎる 金稼ぎじゃなくてユーザー第一なのが好印象。 https://files.catbox.moe/h6gj54.png
Kimi って何が由来かと思ったら、Moonshot AIの創設者・楊植麟氏の使っているニックネームから取られた名称らしい。 https://kimiyoung.github.io/
(https://platform.kimi.ai/docs/guide/use-thinking-effort) 原文:"K3 always reasons and may return reasoning_content; more reasoning-effort levels are coming soon." 日本語訳:"K3は常に推論を行い、reasoning_content を返すことがあります。より多くの reasoning-effort レベルが近日登場予定です。" 現状はmaxのみだけど、後々追加されていくみたいね。 https://files.catbox.moe/217btb.png
(https://arena.ai/leaderboard/code/webdev) LMArenaのWebDevではKimi K3が現状1位です。 投票者は2つの成果物を短時間で比較するから、ソフトウェアよりもデザインコンテストに近い気が。 人間投票が中心である限り機能を網羅的にテストする保証はないし、Web開発能力じゃなくてフロントエンド生成能力が、このアリーナでは高かった、というだけです。したがってリーダーボード上位でも本番運用できるシステムを作れるとは限らない。 プロンプトが具体的で"良質"なものもあれば、「かっこいいサイトを作れ」のように曖昧なものもあるので、要求を勝手に補完する能力が有利になる。 絶対採点ではなくモデルA/Bの比較なので、相手のモデルが弱かったら勝つし、デザインは強いが機能が弱い相手なら評価軸に左右されてしまう。 LMArenaの順位はモデルの評判、マーケティングに影響するから、複数アカウントによる投票、そもそもこのアリーナで好まれるUIを学習している可能性もあるので、企業や支持者がモデルの特徴を利用して投票する可能性も高い。 公平な比較にはトークンバジェット、思考時間、コンテキスト長、色々な要素を揃える必要があるが、アリーナではされていないので、勝率が高いが10倍高価なモデルと、ほぼ同等で低価格なモデルは全く違う選択肢となること=費用対効果をWebDevの順位で判断できないことに注意してほしい。 https://files.catbox.moe/vnqjzn.png
(https://x.com/cline/status/2079052347255525757) ClinePassが$1.99のプロモーションをしてるそうで。K3使えます。 https://files.catbox.moe/592egx.png
連邦機関、国防・情報機関、政府請負企業ではK3を含む中国製モデルの利用が制限される予感がする。 すでに議会では、DeepSeekを契機に、敵対国で開発されたAIを政府機関から排除する No Adversarial AI Act が超党派で提出されているし、下院の対中共特別委員会と国土安全保障委員会は、4月の時点でMoonshot AI名指しで、米企業が中国製オープンウェイトモデルを組み込むことの安全保障リスクを調査してるから、K3はこの動きを加速させる材料になりそう。 K3は米中AI交渉の主要議題になるだろうね。 このままK3が世界で広く採用されれば米国からしたら問題だから、米国は米国で、「米国の価値観に基づく」オープンウェイトモデルを出せばいいんだけど。
2月にMoonshot AIが数百の不正アカウントを使い、Claudeと340万回以上やりとりしたとの発表があった。米科学技術政策局のマイケル・クラツィオス局長は、MoonshotがK3開発のためにFableを蒸留したとの情報を持っており、複数の米国モデルを対象に大規模蒸留を行う内部システムも構築したと述べている。(ただし、その情報の中身は公開されていない) Fable5は6月9日に公開され、6月12日に一時停止、7月1日に再公開された。Kimi K3の公開は7月17日。利用可能期間は合計で約3週間しかないが、K3の基礎学習が既に終了していれば、出力を収集し、教師あり微調整、強化学習を行うことも技術的に不可能ではない。 ただ、Moonshot AIの340万回以上のアクセスを発表したのは2月23日で、Fable5の公開は6月9日。したがって、2月の資料が証明しているのは、Moonshot AIが以前のClaudeモデルから能力を抽出しようとした可能性であり、Fable5がK3に使われたことを示すものではない。 米政府は情報を持っていると述べているが、証拠はまだ示していないし、Moonshot AIはReutersの取材に直ちには回答せず、中国大使館は主張を否定している。コーディング試験でK3がFable5と近い成績を出したこと自体は蒸留の証明にはならないし、Moonshot AI自身も、総合能力ではFable5には及ばないと説明している。