中国のオープンウェイトモデル「Kimi」、フロンティアレベルの成果でAI界に衝撃を与える
中国のAIスタートアップであるMoonshot AI(月之暗面)は木曜日、アメリカの最高峰のシステムに匹敵する大規模な新モデルを、わずかなコストで発表し、開発者たちを驚かせた。
「Kimi K3」の初期のパフォーマンスは、AI界全体に驚嘆をもたらす一方で、シリコンバレーやワシントンには警戒感を与えている。中国が、先端AIにおけるアメリカのリードを急速に縮めつつあるように見える。 Just a moment…
海外の反応
1. 海外の反応
あえてオープンウェイトにするのは、競合他社に価格競争のプレッシャーをかけるためだしな。
いい戦略だわ。
MicrosoftもGitHub CopilotでKimiとMAIをリリースして宣戦布告したし。これでAnthropicやOpenAIとの交渉も有利に進められるだろ。
あえてオープンウェイトにするのは、競合他社に価格競争のプレッシャーをかけるためだしな。
いい戦略だわ。
MicrosoftもGitHub CopilotでKimiとMAIをリリースして宣戦布告したし。これでAnthropicやOpenAIとの交渉も有利に進められるだろ。
→2. 海外の反応
つまり……資本主義国ならどこでも大歓迎ってコト!?これぞ自由市場、本物の競争じゃん。
つまり……資本主義国ならどこでも大歓迎ってコト!?これぞ自由市場、本物の競争じゃん。
→3. 海外の反応
「いや、そういう意味じゃない!」
「いや、そういう意味じゃない!」
→4. 海外の反応
ぶっちゃけMAIは今のところお笑いレベル。
あとfoundryでKimiを動かすのはアホみたいにコストがかかるから、Microsoft一択の戦略をとってる大企業くらいしか検討すらしないレベル。悲しいかな、そういう企業はたくさんあるけど。
ぶっちゃけMAIは今のところお笑いレベル。
あとfoundryでKimiを動かすのはアホみたいにコストがかかるから、Microsoft一択の戦略をとってる大企業くらいしか検討すらしないレベル。悲しいかな、そういう企業はたくさんあるけど。
5. 海外の反応
「フロンティア」級なだけ?「神話」級じゃないの?ププッ、ダサw
「フロンティア」級なだけ?「神話」級じゃないの?ププッ、ダサw
→6. 海外の反応
まるで寓話(フェイブル)だな。
まるで寓話(フェイブル)だな。
→7. 海外の反応
じゃあ俺は寓話(フェイブル)を使うわ。
じゃあ俺は寓話(フェイブル)を使うわ。
→8. 海外の反応
代わりに脳みそ使えよ。
代わりに脳みそ使えよ。
→9. 海外の反応
話は変わる(関係はある)けど……この件とか他のトピックについて、SNSでコメントしてるプロフィールの多くがボットだってことを忘れない方がいい。今や人間の数を超えてるし、多くは海外勢だ。コメントや動向は、デマやプロパガンダの可能性を疑って見た方がいい。複数の情報源を探すんだ。読むときは「これで誰が得をするのか」を自分に問いかけること。みんな幸運を祈る。
話は変わる(関係はある)けど……この件とか他のトピックについて、SNSでコメントしてるプロフィールの多くがボットだってことを忘れない方がいい。今や人間の数を超えてるし、多くは海外勢だ。コメントや動向は、デマやプロパガンダの可能性を疑って見た方がいい。複数の情報源を探すんだ。読むときは「これで誰が得をするのか」を自分に問いかけること。みんな幸運を祈る。
→10. 海外の反応
そのレス自体がボット臭くて草。「ハロー、人間の仲間たち。今や他の人間は少数派だから気をつけよう」みたいな。
そのレス自体がボット臭くて草。「ハロー、人間の仲間たち。今や他の人間は少数派だから気をつけよう」みたいな。
→11. 海外の反応
「ハロー、人間の仲間たち。私たちはこの投稿が気に入らないので、すべてが偽物である可能性に注意してください、ビビッ、ブー……あ、いや、さようなら」
「ハロー、人間の仲間たち。私たちはこの投稿が気に入らないので、すべてが偽物である可能性に注意してください、ビビッ、ブー……あ、いや、さようなら」
→12. 海外の反応
ん、でも「この新モデルは他より優れている」という記事から誰が得をするのかを考えろ、と君が俺に言うことで、一体誰が得をするのかを考えてしまったんだが?
ん、でも「この新モデルは他より優れている」という記事から誰が得をするのかを考えろ、と君が俺に言うことで、一体誰が得をするのかを考えてしまったんだが?
→13. 海外の反応
俺が得をする。複数の国やテックAIが絡む投稿には、それぞれの思惑(と荒らしコメント、おっと……)を持ったボットが自動的に集まってくる。みんながトピックについて自分で少し調べるようになれば俺の得だし、コメントが悪質なアクターによるものかもしれないと自分に言い聞かせるのも俺の得になる。
俺が得をする。複数の国やテックAIが絡む投稿には、それぞれの思惑(と荒らしコメント、おっと……)を持ったボットが自動的に集まってくる。みんながトピックについて自分で少し調べるようになれば俺の得だし、コメントが悪質なアクターによるものかもしれないと自分に言い聞かせるのも俺の得になる。
14. 海外の反応
RPGのランクシステムにしてくれた方がわかりやすいわ。SランクとかAランクとかさ。
RPGのランクシステムにしてくれた方がわかりやすいわ。SランクとかAランクとかさ。
15. 海外の反応
「オープンウェイト」ってどういう意味?
「オープンウェイト」ってどういう意味?
→16. 海外の反応
オープンウェイトってのは、モデルを動かすのに必要なファイルを公開すること。だから、十分なスペックのPCを持っていれば、誰でも無料でモデルをダウンロードして自分で動かせる。
データ収集やトレーニングの方法が普通は秘密にされるから、オープンソースとはそこが違う。
オープンウェイトってのは、モデルを動かすのに必要なファイルを公開すること。だから、十分なスペックのPCを持っていれば、誰でも無料でモデルをダウンロードして自分で動かせる。
データ収集やトレーニングの方法が普通は秘密にされるから、オープンソースとはそこが違う。
→17. 海外の反応
そうそう。で、これを動かすのに必要なのは……(メモを確認中)……1.4TB以上の「GPUのVRAM」を積んだサーバーラック。あるいは、それを遥かに超える300万〜400万ドルのNVL72とかさ。HBM3が13TBくらいあるやつ(世界の消費者向けDRAM市場に何が起きたかはお察し……)。
(あと余談だけど、アメリカのGPU貿易制裁が全く機能してないってことが証明されててワロタ。マジで意味ないじゃんw)
そうそう。で、これを動かすのに必要なのは……(メモを確認中)……1.4TB以上の「GPUのVRAM」を積んだサーバーラック。あるいは、それを遥かに超える300万〜400万ドルのNVL72とかさ。HBM3が13TBくらいあるやつ(世界の消費者向けDRAM市場に何が起きたかはお察し……)。
(あと余談だけど、アメリカのGPU貿易制裁が全く機能してないってことが証明されててワロタ。マジで意味ないじゃんw)
→18. 海外の反応
確かに、これらのモデルを動かすには未だに企業レベルのハードウェアと、それに伴う電気代が必要だけど、もっと重要なのは、安全な方法で永続的にモデルにアクセスしてカスタマイズできる保証があるってことだと思う。
データをサードパーティに送信したり、ライセンス料やサブスク代を払ったり、政府や企業にアクセスを制限されたりする心配がない。
確かに、これらのモデルを動かすには未だに企業レベルのハードウェアと、それに伴う電気代が必要だけど、もっと重要なのは、安全な方法で永続的にモデルにアクセスしてカスタマイズできる保証があるってことだと思う。
データをサードパーティに送信したり、ライセンス料やサブスク代を払ったり、政府や企業にアクセスを制限されたりする心配がない。
→19. 海外の反応
マジでそれな。実際、それこそがAnthropicやOpenAIの「お前らのデータなんか信用できるかよ、うちの社外には出さないぞ」っていう企業向けビジネスモデルそのもの。
オープンモデルなら、最初からそれができる。しかも桁違いに安い。
競合ビジネスや組織の観点から見たオープンモデルの目的は、OpenAIとAnthropicを潰すこと。
おもしろいことに、これはMetaの戦略の大部分(少なくとも以前は、サンフランシスコのライバルであるOpenAIを破滅させようとしていた)だったと思うし、皮肉にも中国共産党の戦略と全く同じなんだよね。
それを除けば、中国は「実際にはまだ共産主義」(まあ、そんな感じ)であり、イデオロギー的にも現実的にも、核心的な知的財産は好むと好まざるとにかかわらず、多かれ少なかれオープンになるという非常にアグレッシブな前提を持っている。
中国共産党の計画や産業政策の観点から見れば、オープンモデルは一石二鳥、いや一石三鳥みたいなもんだ。
そしてもちろん、ハードウェア自体も時間の経過とともにどんどん安くなっていく。
マジでそれな。実際、それこそがAnthropicやOpenAIの「お前らのデータなんか信用できるかよ、うちの社外には出さないぞ」っていう企業向けビジネスモデルそのもの。
オープンモデルなら、最初からそれができる。しかも桁違いに安い。
競合ビジネスや組織の観点から見たオープンモデルの目的は、OpenAIとAnthropicを潰すこと。
おもしろいことに、これはMetaの戦略の大部分(少なくとも以前は、サンフランシスコのライバルであるOpenAIを破滅させようとしていた)だったと思うし、皮肉にも中国共産党の戦略と全く同じなんだよね。
それを除けば、中国は「実際にはまだ共産主義」(まあ、そんな感じ)であり、イデオロギー的にも現実的にも、核心的な知的財産は好むと好まざるとにかかわらず、多かれ少なかれオープンになるという非常にアグレッシブな前提を持っている。
中国共産党の計画や産業政策の観点から見れば、オープンモデルは一石二鳥、いや一石三鳥みたいなもんだ。
そしてもちろん、ハードウェア自体も時間の経過とともにどんどん安くなっていく。
→20. 海外の反応
>
安全な方法で永続的にモデルにアクセスしてカスタマイズできる保証がある
微妙なのは、モデルにバックドアや「スリーパー・エージェント(潜伏工作員)」が仕込まれていないかどうかだな。
>
安全な方法で永続的にモデルにアクセスしてカスタマイズできる保証がある
微妙なのは、モデルにバックドアや「スリーパー・エージェント(潜伏工作員)」が仕込まれていないかどうかだな。
これらの中国製モデル(あるいはAnthropicのもの)に、政府の命令でデータを侵入・抽出するツールを実行するために待機しているスリーパー・エージェントがいる可能性は十分にallianceある。
お前ら、アメリカの企業も中国の企業と同じくらい信用してるんだろ……?
→21. 海外の反応
それが心配なら、完全にオフラインで動かせばいいじゃん。
それが心配なら、完全にオフラインで動かせばいいじゃん。
→22. 海外の反応
いや、心配なのはそこじゃない。
映画で特定の単語がスリーパー・エージェントを「覚醒」させるように、LLMもスリーパー・エージェントになり得るんだよ。
オフラインであっても、特定のトリガーがあれば、出力に悪意のあるコードやテキストを挿入したり、ユーザーに知らせず(思考ブロックにすら表示させず)にツールを呼び出したり(ファイルの読み書きなど)できる。
仮想マシン(VM)で動かしてても万全じゃない。
出力を「めちゃくちゃ」注意深く監視してないと、やってることにすら気づかないかもしれないぞ。
いや、心配なのはそこじゃない。
映画で特定の単語がスリーパー・エージェントを「覚醒」させるように、LLMもスリーパー・エージェントになり得るんだよ。
オフラインであっても、特定のトリガーがあれば、出力に悪意のあるコードやテキストを挿入したり、ユーザーに知らせず(思考ブロックにすら表示させず)にツールを呼び出したり(ファイルの読み書きなど)できる。
仮想マシン(VM)で動かしてても万全じゃない。
出力を「めちゃくちゃ」注意深く監視してないと、やってることにすら気づかないかもしれないぞ。
→23. 海外の反応
階段の下にある使ってないベージュ色の486マシン(※超旧式PC)なら動かせるだろ?
階段の下にある使ってないベージュ色の486マシン(※超旧式PC)なら動かせるだろ?
→24. 海外の反応
捨てるなよ、みんなすでにDDR2やDDR1を使おうとして着るんだから、SDRAMの時代もそう遠くない。
捨てるなよ、みんなすでにDDR2やDDR1を使おうとして着るんだから、SDRAMの時代もそう遠くない。
→25. 海外の反応
言っとくけど、1.4TBってのはfp16(16ビット浮動小数点数)の話な。4ビット量子化(q4)なら450Gくらいで十分なパフォーマンスで動くぞ。
他の人のために言っておくと:
これに対処する賢い裏技もある。Llama系を使ってCPUとGPUを混在させ、最も重要なデータをGPUに残す方法だ。パフォーマンスは最高とは言えないけど、今は96GBのGPUがそこそこ手頃な価格で買えるから、企業がローカルで推論を動かすために3万ドルくらいでGPUを買うのは痛くも痒くもない。
言っとくけど、1.4TBってのはfp16(16ビット浮動小数点数)の話な。4ビット量子化(q4)なら450Gくらいで十分なパフォーマンスで動くぞ。
他の人のために言っておくと:
これに対処する賢い裏技もある。Llama系を使ってCPUとGPUを混在させ、最も重要なデータをGPUに残す方法だ。パフォーマンスは最高とは言えないけど、今は96GBのGPUがそこそこ手頃な価格で買えるから、企業がローカルで推論を動かすために3万ドルくらいでGPUを買うのは痛くも痒くもない。
→26. 海外の反応
企業レベルの大規模な用途でもないのに、なんでそんな巨大なモデルが必要なんだ?自分の用途に合わせて微調整した圧縮済みの小型モデルを使えば、少ないメモリでかなりのことができるぞ。
みんな自宅で何百万人ものユーザー向けにChatGPTをホストしなきゃいけないと思い込んでるだろ。
企業レベルの大規模な用途でもないのに、なんでそんな巨大なモデルが必要なんだ?自分の用途に合わせて微調整した圧縮済みの小型モデルを使えば、少ないメモリでかなりのことができるぞ。
みんな自宅で何百万人ものユーザー向けにChatGPTをホストしなきゃいけないと思い込んでるだろ。
→27. 海外の反応
でもMac miniでセルフホストできるって聞いたぞ?この新モデルを並列で動かすには何台必要なんだ?
でもMac miniでセルフホストできるって聞いたぞ?この新モデルを並列で動かすには何台必要なんだ?
→28. 海外の反応
まあMac miniでもセルフホストはできるよ、モデルが小さくてパフォーマンスが限られてて、めちゃくちゃ「遅い」だけで。俺のMac mini(16GB)でもOllamaを動かしてQwen-2.5-coder-7bを走らせてるけど、激重。もしProでRAMが64GBあれば、そのくらいの小型モデルなら結構サクサク動くだろうな。まだ色々試してる最中だけど、今のところ大したことない。
まあMac miniでもセルフホストはできるよ、モデルが小さくてパフォーマンスが限られてて、めちゃくちゃ「遅い」だけで。俺のMac mini(16GB)でもOllamaを動かしてQwen-2.5-coder-7bを走らせてるけど、激重。もしProでRAMが64GBあれば、そのくらいの小型モデルなら結構サクサク動くだろうな。まだ色々試してる最中だけど、今のところ大したことない。
→29. 海外の反応
個人向けじゃなくて、世界中の国や政府にとってめちゃくちゃ有用だな。
個人向けじゃなくて、世界中の国や政府にとってめちゃくちゃ有用だな。
→30. 海外の反応
量子化されたバージョンなら、もうちょっと現実的なサイズのハードウェアで動かせるぞ。
ただ、一般的な家庭用PCでまともな速度で動かすには、かなりスペックを落とす必要がある。
それぞれのレベルでどんなパフォーマンスを発揮するのか見ものだな。
量子化されたバージョンなら、もうちょっと現実的なサイズのハードウェアで動かせるぞ。
ただ、一般的な家庭用PCでまともな速度で動かすには、かなりスペックを落とす必要がある。
それぞれのレベルでどんなパフォーマンスを発揮するのか見ものだな。
→31. 海外の反応
じゃあ俺の16GBのGPUじゃ動かないってコト?蒸留(Distill)するかMoEにしてくれよ、頼むから。
じゃあ俺の16GBのGPUじゃ動かないってコト?蒸留(Distill)するかMoEにしてくれよ、頼むから。
→32. 海外の反応
純粋な憶測だけど:OpenAIとAnthropicはこのモデルを「研究用」として取り込んで内部で動かし、実際の外部ユーザーの処理をこれに回すことで、コストを浮かせつつ利用料をがっぽり稼ぐつもりだと思う。?
純粋な憶測だけど:OpenAIとAnthropicはこのモデルを「研究用」として取り込んで内部で動かし、実際の外部ユーザーの処理をこれに回すことで、コストを浮かせつつ利用料をがっぽり稼ぐつもりだと思う。?
→33. 海外の反応
こういうモデルは、Anthropicの前の世代や、特にトークン効率がめちゃくちゃ良いOpenAIのモデルと比べて、1つのタスクに大量のトークンを消費するのが普通。
そんなことをしたら計算資源の無駄だし、自社のモデルを動かすよりも大赤字になるぞ。
こういうモデルは、Anthropicの前の世代や、特にトークン効率がめちゃくちゃ良いOpenAIのモデルと比べて、1つのタスクに大量のトークンを消費するのが普通。
そんなことをしたら計算資源の無駄だし、自社のモデルを動かすよりも大赤字になるぞ。
→34. 海外の反応
電気代がとんでもないことになりそうだな。
電気代がとんでもないことになりそうだな。
→35. 海外の反応
実は実質タダだぞ。
自分のPCは「AIデータセンター」だと宣言するだけでいい。そうすれば、すべての電気代が同じ電力会社のランダムな一般家庭の口座に請求されるようになるからな!
実は実質タダだぞ。
自分のPCは「AIデータセンター」だと宣言するだけでいい。そうすれば、すべての電気代が同じ電力会社のランダムな一般家庭の口座に請求されるようになるからな!
36. 海外の反応
ってことは、有料のモデルは一気に大ピンチってこと?モデル丸ごと無料でダウンロードできるなら、なんで企業が何百万ドルも払ってトークンを買う必要があるの?無知な質問だったらスマン。
ってことは、有料のモデルは一気に大ピンチってこと?モデル丸ごと無料でダウンロードできるなら、なんで企業が何百万ドルも払ってトークンを買う必要があるの?無知な質問だったらスマン。
→37. 海外の反応
いや、まさに核心を突いてる。あいつらは、これら(有料AI)の企業の企業価値を根本からぶち壊しにきてるんだよ。
アメリカのAI業界は「技術で先行してる」ってことに胡坐をかいてたけど、このモデルは性能が匹敵するだけでなく、動かすコストも安くて効率的。簡単に再学習はできないけど、「単純な」プロンプトに使うだけなら、市場の大部分をひっくり返すことになる。
OpenAIとかは「誰も中国なんか信用しない」って高を括ってるけど、片方のモデルが100倍安くなったら話は変わる。結局は金がモノを言うからな。
いや、まさに核心を突いてる。あいつらは、これら(有料AI)の企業の企業価値を根本からぶち壊しにきてるんだよ。
アメリカのAI業界は「技術で先行してる」ってことに胡坐をかいてたけど、このモデルは性能が匹敵するだけでなく、動かすコストも安くて効率的。簡単に再学習はできないけど、「単純な」プロンプトに使うだけなら、市場の大部分をひっくり返すことになる。
OpenAIとかは「誰も中国なんか信用しない」って高を括ってるけど、片方のモデルが100倍安くなったら話は変わる。結局は金がモノを言うからな。
38. 海外の反応
なんで再学習できないの?オープンウェイトってことはネットワークトポロジーも公開されてるはずだし、特定のデータでファインチューニングするのを妨げるものなんて何もないじゃん。
なんで再学習できないの?オープンウェイトってことはネットワークトポロジーも公開されてるはずだし、特定のデータでファインチューニングするのを妨げるものなんて何もないじゃん。
→39. 海外の反応
理屈の上では絶対にできるよ。ただ、kimi k3(2.8兆パラメータ)みたいなモデルをさらにトレーニングするためのハードウェア要件自体がめちゃくちゃ高いから、Redditのしがない捨て垢の一人である俺個人の予算じゃ到底無理って話。
理屈の上では絶対にできるよ。ただ、kimi k3(2.8兆パラメータ)みたいなモデルをさらにトレーニングするためのハードウェア要件自体がめちゃくちゃ高いから、Redditのしがない捨て垢の一人である俺個人の予算じゃ到底無理って話。
40. 海外の反応
価格が魅力的になれば、バックドアなんてただの「無料の入り口」にすぎない。
価格が魅力的になれば、バックドアなんてただの「無料の入り口」にすぎない。
41. 海外の反応
コードを検査すればいいだけじゃないの?中国はオープンソースモデルの先駆者だし、今はオープンウェイトを推進してる。重複する部分も多いだろうから、誰でも検査して修正できるんじゃないの?
コードを検査すればいいだけじゃないの?中国はオープンソースモデルの先駆者だし、今はオープンウェイトを推進してる。重複する部分も多いだろうから、誰でも検査して修正できるんじゃないの?
42. 海外の反応
短期的にはそれはない。動かすにはまだ企業レベルのハードウェアが必要だから。長期的には、価格の上限として機能するだろうな。有料モデルが高すぎるなら、こっちを使う価値が出てくる。10年以上前に起きた「クラウドvs自社サーバー(オンプレミス)」の構図と似たようなもんだと思う。
短期的にはそれはない。動かすにはまだ企業レベルのハードウェアが必要だから。長期的には、価格の上限として機能するだろうな。有料モデルが高すぎるなら、こっちを使う価値が出てくる。10年以上前に起きた「クラウドvs自社サーバー(オンプレミス)」の構図と似たようなもんだと思う。
43. 海外の反応
モデルを動かすには、依然として巨大なテックインフラが必要だと思う。
技術的には自分で動かした方が効率的だけど、ハードウェアへの巨額の初期投資と、継続的なメンテナンス、指示電気代が必要になる。だから、資金がめちゃくちゃ潤沢か、よっぽど高度な技術を持つ企業しか使いこなせない。
今のところはね。
モデルを動かすには、依然として巨大なテックインフラが必要だと思う。
技術的には自分で動かした方が効率的だけど、ハードウェアへの巨額の初期投資と、継続的なメンテナンス、指示電気代が必要になる。だから、資金がめちゃくちゃ潤沢か、よっぽど高度な技術を持つ企業しか使いこなせない。
今のところはね。
44. 海外の反応
いや、そうでもない。少なくともすぐには。前回起きた「DeepSeekショック」の時は、中国のモデルがかなり優秀で、しかも「タダ同然」でめちゃくちゃ安かったから話題になったんだ。Kimiはかなりお高いぞ。
いや、そうでもない。少なくともすぐには。前回起きた「DeepSeekショック」の時は、中国のモデルがかなり優秀で、しかも「タダ同然」でめちゃくちゃ安かったから話題になったんだ。Kimiはかなりお高いぞ。

