1 ポイント 投稿者 GN⁺ 19 시간 전 | 1件のコメント | WhatsAppで共有
  • Kimi K3の需要が予想を大きく上回り、直近48時間でGPU使用量が現在の容量上限に近づいている
  • 既存契約者の利用体験を守るため、新規サブスクリプションを一時停止し、現在の会員に計算資源を優先配分する
  • 既存の有料契約者には影響はなく、Moonshot AIはインフラ容量の増強を急いでいる
  • 追加容量を確保し次第、新規サブスクリプションをバッチ単位で再開する予定
  • また、利用目的に応じてメンバーシップを2つの専用料金プランに分ける予定
    • Kimi Membership: Kimi Web、App、Work向け
    • Kimi Code Membership: コーディング作業フロー向け
  • サービスごとの需要に合わせて計算資源をより正確に配分し、安定した利用体験を維持するための措置

1件のコメント

 
Hacker Newsのコメント
  • 過去48時間で需要が現在の容量の限界に迫ったため、既存契約者の利用環境を守るために新規契約を一時停止し、計算資源を既存会員に優先配分した、という文言は本当に好感が持てる。
    急成長よりも既存顧客の満足を優先する会社だ。

    • GitHubが以前まったく同じことをしたときは多くの人が怒ったが、あのときも今も正しい判断だった。
    • どのWebサイトでも「Login」ボタンが「Sign Up」より小さいのが昔から嫌いだった。
    • だとするとHetznerも、価格を上げて需給を調整する代わりに新規登録を停止すべきだったのだろうか?
    • あまり興奮しすぎる必要はない。ベンチャーキャピタルがAIに巨額の資金を注ぎ込んでいるので、OpenAIやAnthropicがデータセット蒸留のためにトークン消費装置へ資金を投じているだけかもしれない。
  • 昨日Claudeの利用量を使い切ったので、Kimiを試そうと20ドルプランを契約した。Kimi CodeでK3を選び、リポジトリ内のハードウェア、入出力、スレッド制御、ネットワーク関連の入力設定をすべて調べてレポートを書けと依頼したところ、12分考えた末に1日の割り当てをすべて使い切ったと返してきた。
    翌日Fableは同じ作業を3分で終えたので、K3を使うなら20ドルプランは買わないほうがいい。

    • Codexは上限に達しても推論を続け、その後でリクエストに答えてくれる。
    • 完全セルフホストのモデルしか使っていないので環境が違うかもしれないが、12分間まったくフィードバックなしで待つことが実際の作業フローでよくあるのか気になる。私はモデルの進む経路をずっと見ていて、行き止まりに向かっていたら中断したり方向修正したりする。
    • 私もまったく同じことを経験した。Kimi.comの月額20ドルプランを年払いし、OpenCodeからAPI経由でKimi K2.7に簡単なリクエストを送っただけで、5時間の割り当てをすべて消費した。Cursorなら同じリクエストを数分で終わらせる。
      Web画面上の週間利用量も23%使っていて、月額20ドルのCursorではもっと多くの作業をしても警告すら受けたことがない。最初はOpenCodeの問題だと思ったが、Kimi Codeでも同じならそうではないようだ。
    • 数日前、Claudeでも比較的簡単な作業ひとつで答えを出せないまま5時間の割り当て全体を使い切り、時間を完全に無駄にした気分だった。
    • 対象アプリケーションの規模が気になる。テキストファイルをデータベース代わりに使うNode.jsのToDoアプリなのか、それとも1971年製の100万行のCOBOLスパゲティコードなのかで違ってくる。
  • Kimiは、完全なアテンション層よりもRNN・線形アテンション層のほうが3倍多い点が特に興味深い。まだ使ってはいないが、長いコンテキストの作業には非常に理にかなった構造に見える。
    パラメータ数が多い理由は、計算最適化xLSTMのパラメータが多い理由と同じに見える。このモデルの成功を見ると、欧州で巨大なxLSTM系モデルを開発できなかったのが惜しい。内部評価でうまく動くものを採用する実務的なチームなので通常のアテンション層も残しており、実装まで理想的だと断言はできないが、大規模LLM訓練用スーパーコンピュータを適切な研究者に提供していたら何が可能だったかをKimiは示している。結局、その大半はHochreiterの分野であるRNNだ。

    • Transformerアーキテクチャの本来の目的のひとつは、並列化できないRNNを排除することではなかったか? 専門家ではなく、数年前に論文を数本読んだ程度だが。
    • 約1年半前にHochreiterへ、数十億パラメータ規模の実験にとどまらずxLSTMをLLM規模へ拡張すべきだと言ったが、投資や関心を集めるには遅すぎると考えているようだった。欧州の野心がこの程度なのは残念だ。
    • RNNなのか、QwenやMambaのような状態空間モデルなのか、あるいはRWKVに近いのか気になって確認したら、Qwenが使っているLinear DeltaNetに似ている。
  • 半年ほどコーディング作業にKimiを使ってきたが、満足していて他のモデルには戻っていない。何か見落としていないか確認するため、ときどきClaudeで同じ作業を試す程度だ。
    OpenRouterを使っており、LLMの利用範囲が狭いのでコスト差はどちらにせよ無視できる。

    • どのプランか気になる。私の経験では、Kimiの月額20ドルプランもQwenの月額30ドルプランも主力ツールとして使うにはまったく足りないが、K3のために月額49ドルか99ドルのプランを試してみたい。
  • Googleのように、ユーザーがサブスク価値の低下に気づかないことを期待して上限をひそかに下げる代わりに、新規契約を停止したのは新鮮だ。
    Gemini Appsは、容量制約やアクティビティ急増時に品質維持のため予告なく上限を変更する場合があると明記している: https://support.google.com/gemini/answer/16275805

  • マルチエージェントのゲームコーディング評価では、中国モデルは一般に単発推論には弱いが、ツール利用と反復改善でそれを補っている。Kimi K3も単発コーディングでは19位だが、実行環境とツールを与えて複数回呼び出すエージェントコーディングでは3位で、平均提出物ベースではSolとFableにしか負けていない。
    ソフトウェアエンジニアにとってはエージェントコーディングが最も関連性が高いが、速度も重要であり、現在のKimiでは実用上の問題になっている。Fireworksのような外部推論プロバイダは以前のモデルでこの差を縮めたことがある。公開重みの最前線モデルが標準として定着していく流れは興味深く、最前線モデルを持っていること自体で競争するのは今後ますます難しくなるだろう。
    データ: https://gertlabs.com/rankings?mode=agentic_coding

  • このモデルの品質は期待以上で、特にコードレビューとPRレビューがうまい。ただ、過剰な需要と大きなモデルサイズのせいで今は遅すぎて、比較的簡単なコードレビューにも非常に長くかかる。

    • Kimi K3がopencode-goの料金表に載ったので使えるという意味に見えるが、まだ確認はしていない。Zenにはない。
    • OpenRouter経由を試す価値がある: https://openrouter.ai/moonshotai/kimi-k3
  • 今回のKimiブームが、豊富な供給がより多くの消費を呼ぶジェボンズのパラドックスによる純増なのか、それとも単により安いモデルへの移行なのか気になる。
    複数の研究所とOpenRouterをまたいだ全体のトークン消費量を確認できる良い資料があるのかも気になる。

    • 安いモデルへの移行の流れならDeepSeek v4 Flashへ行っていたはずだ。最新のKimiは他の中国モデルの大半より高いので、「新モデルが本当に良いから使ってみろ」という流行追随効果に近く見える。どこまで綿密な検証に耐えられるかが鍵で、米国の研究所はかなり緊張しているだろう。
  • AnthropicとOpenAIが、しばらくはこの規模の需要をさばける唯一の企業だという理由だけで競争力を維持できるのか気になる。すでにコストが高い状況で障害によって従業員の時間を浪費するなら、企業顧客は歓迎しないはずだ。

    • 職場でも同じ傾向が見られる。ソフトウェア自体は安くても、ホスティングの専門性と稼働時間の責任のため、実際の展開は依然として少数の事業者に集中している。ただし、個人のノートPCで動くバイブコーディングの生産性ツールも多数出てきている。
    • Anthropicもほんの数か月前までは需要問題で混雑時間帯と非混雑時間帯の利用量を分けてユーザーを悩ませ、障害も頻発していた。その後xAIと契約してからは概ね安定し、Moonshotも現在計算資源の契約を進めている。
    • OpenAIとAnthropicの計算資源のかなりの部分は、実際にはハイパースケーラーが保有している。長期契約で確保した資源へのアクセス権にマージンを載せることはできても、ハイパースケーラーがより低価格を提示できるので長くは続かないだろう。
    • Kimiは公開重みモデルなので、Moonshot以外のホスティング事業者がすぐに現れるだろうし、今回の問題が公開重み採用の大きな障害になることはないはずだ。
    • Syntheticを使っているが、Kimi3をホストする計画だと理解している。公開モデルは推論を分散できる。
  • 最低限のサービス品質を顧客に保証できない可能性があると判断して、契約を止めたように見える。

    • 正確には、新規契約のみを一時停止し、既存会員に計算資源を優先配分したということだ。