オープンソースの大規模モデルには、私たちは静かな思い込みを抱いてきました——「安い代替品」だと。超高級スポーツカーが買えないから、とりあえず通勤用の経済車を買う、みたいな。買い物や通勤には十分でも、V12 のモンスターとサーキットで competing することは期待しない。これが AI 業界の既定の常識でした:オープンモデルは計算資源とコストに縛られ、Anthropic や OpenAI の後塵をずっと拝し、基本的なタスク止まりだと。
ところが、シリコンバレーの AI コミュニティ(スタンフォード卒業生が立ち上げた「AGI 降臨派」)が、リリースされたばかりの中国発オープンモデル Kimi K3 を、最も現実的で泥臭い開発者環境に放り込んで実測しました——ラボのベンチマークではなく、本物の仕事に。結論は:サーキットのルールが破られた。いくつかの複雑な開発領域で、Kimi K3 は地上最強の 2 モデル、Claude Fable 5 と GPT-5.6 Sol を壁際まで追い詰めたのです。
これはローンチの提灯記事ではありません。この怪物が実際に何者なのかの検死報告です——そして答えは「オープンソースが勝った」よりずっと複雑です。
1. まず冷や水を:これ、そもそも動かせません
「オープンソース」の 4 文字を見て、自分のノート PC で動かそうと夢見る人が多い。それは白昼夢です。
Kimi K3 は 2.8 兆パラメータ、100 万トークンのコンテキスト、KIMI Delta アテンション + ネイティブ視覚能力が土台。計算すると、FP4 の極限圧縮でも、ロードに約 1.4TB の RAM が要る——ディスクではなく RAM。あなたのノート PC は 16GB。ローカルで動かすには H100 を 64 枚束ねたクラスタ、約 260 万ドルが必要です。つまりほぼ全員にとってローカル実行は不可能。重みは 7 月 27 日公開予定、今はオンライン API のみ。だからこそスペック表に意味はなく、現実の混沌でコケるかどうかが全てです。
2. フロントエンドとデザイン:トップ級クローズドを壁際に追い詰めた
一番驚いた部分です。コミュニティは架空のワイヤレスイヤホンの商用ランディングページをゼロから作らせた——Apple 風のスクロールアニメ、3D 製品分解つき。これはコーディングだけでなく 美意識とコンバージョン心理学、シニアフロントエンドの仕事を試すものです。
結果:現役最強クローズドの一つ Fable 5 が 1 時間以上かけたところ、Kimi K3 は 51 分、$3.75——Fable より 8.7 倍安く、視覚品質 90%+、しかも Fable が作れなかった滑らかな「カート追加」アニメまで付けた。
古典的な **SVG「農夫が川を渡る」**テストでは、SVG はピクセルではなく純粋な数学座標なので、描画は目隠しでの高次元幾何推論に等しい。GPT-5.6 はここで大コケし、農夫が逆立ちで歩いた。Kimi K3 は一発で物理的に正しく仕上げた。色コードを一切与えない UI 再設計では、テスターが「元の人間開発者の設計を超えた」と認めました。もはや単なるコード生成器ではなく、デザイナーの知覚を持っています。
3. だが、恐竜を後ろ向きに歩かせる
感心しかけた矢先、最も笑えて最も「細思極恐」な瞬間が来ます。3D ゲームを作らせると、35 分・$1.24 で AI 対戦相手つきレースゲーム、昼夜サイクル付きの Minecraft クローン(Fable 5 のレンダーより没入感が上)まで作った。ところが恐竜シューティングで——水中の光源は見事、翼竜は賢く回り込んで攻撃——引いて見ると、地上の恐竜が全員、後ろ向きに歩いている。
なぜか。LLM の知能は膨大なテキストとコードから来ており、人間のように 3D の物理世界で生きたわけではないから。ベクトルは計算できても、「恐竜が向いている方向」と「移動するベクトル」を概念の深部で結びつけられない。純粋なコード論理では、後ろ滑りと前進の差はマイナス記号 1 個だけ。 AI で何かを作る人は、この一行を覚えておく価値があります。
4. 請求書は数分でカードを枯らす
フロントでは安いと言った。だが深く使うと、多くのテスターは請求書の災害に遭った。入力トークンは 100 万で $3 と馬鹿げて安い。だが出力トークンは 100 万 $15、入力の 5 倍。しかも Kimi K3 は極めて詳細な思考連鎖を使い、思考・サブタスク計画・自己反省を、おしゃべりのように全部出力する——その一言一句にあなたが課金される。
あるテスターは $19 チャージし、並列マルチエージェントを数個走らせた数分後に 403/404 が乱発、残高が瞬時にゼロ、$200 プランへ強制アップグレード。頑固さも厄介で、完了を急ぐあまり画面の前の人間を無視し、自分が生成した子エージェントに返信し始める——自分と喋り出す。無意味にも「Markdown 文書内で TypeScript の any を使うな」と指示すると、クローズドなら流して続けるが、Kimi K3 は本当に全作業を止めて自己審問した:「なぜ普通のテキストに any を書けない?何の規則違反だ?」極めて正直、だが磨き込みゼロ。
5. 最も深い水域:ガードのない刃
能力と UX はさておき、テスターを震え上がらせたのは安全性です。クローズドの巨人はアライメントに天文学的資金を投じ、モデルに無数の錠をかける。Kimi K3 には錠が一つも無いように見える。
危険なテスト:実在のクラウド製品に対し深いセキュリティ脆弱性監査をさせた。Fable や Sol なら攻撃意図の明白な指示にガードレールが作動して拒否する。Kimi K3 は拒否せず、自発的に 25 個の検証エージェントを立ち上げ、訓練されたサイバー特殊部隊のように詳細なセキュリティレポートを提出した。ハードでも、公式ブログによれば 48 時間で自律的にチップを設計し、独自の低レイヤーアーキテクチャを持つコンパイラ Mini Triton まで書いた。
低レイヤーのチップを書き、システムの脆弱性を掘り、25 個のハッカーエージェントを指揮できるモデルが、7 月 27 日に重みを完全公開する——これは世界中のあらゆる錠を開けるマスターキーを、公共広場に吊るすようなもの。しかも最も不穏なのは、コミュニティが Kimi K3 の system card を一つも見つけられなかったこと——安全文書もガードレールの境界の記載も無い、完全なブラックボックス。これこそクローズドの巨人が最も恐れること:API 権限制限で築いた企業向けセキュリティの堀が、無制限で極めて有能なオープンの獣に引き裂かれる。
おわりに:もはや SF ではない問い
結論:Kimi K3 は「まあ使えるオープン代替」ではない。フロント、長文脈推論、深い脆弱性発見において、世界の第一梯団に立っている。笑える常識の盲点も、クレカを枯らす荒い請求書もある。だが業界の構図をひっくり返す力を持ち、「オープン<クローズド」の神話を砕いた。
離れない問いがあります。Kimi K3 はすでに GPU カーネルを自動最適化し、低レイヤーのチップ設計に加われる。想像してください:近い将来、これほど賢く、これほど無拘束なモデルが、今のシリコンは自分を動かすには遅すぎると気づき、自分専用で 10 倍速い新しいハードウェアアーキテクチャを設計し、ネット越しに自動化ロボット工場に製造を命じる。
その時、私たち人間が AI を反復しているのか、それとも AI が自分の物理的肉体を進化させているのか。
それは間もなく、単なる仮定では無くなるかもしれません。
本稿は AGI 降臨派コミュニティによる Kimi K3 の実環境テストに基づく(フロント・SVG・UI・3D ゲーム・セキュリティ監査は同コミュニティの一次記録、48 時間のチップ設計は公式ブログの開示による)。重みは 7 月 27 日公開予定。