1 ポイント 投稿者 GN⁺ 2024-10-30 | 1件のコメント | WhatsAppで共有
  • OpenAIはAI推論チップを開発し、ファウンドリネットワーク計画を断念
  • BroadcomはOpenAIのチップ設計を支援し、TSMCで製造できるよう後押し
  • OpenAIはAMDのAIチップも追加し、チップ供給を多様化

OpenAIの内製チップ設計の取り組みと業界パートナーシップの活用

  • OpenAIはチップ供給の多様化とコスト削減のため、さまざまな選択肢を検討
  • 同社は当面、野心的なファウンドリ計画を停止し、内製チップ設計の取り組みに集中する方針
  • OpenAIの戦略は、Amazon、Meta、Google、Microsoftのような大規模な競合各社と同様に、業界パートナーシップと内製・外部調達の両面アプローチを活用してチップ供給を確保し、コストを管理する方法を示している
  • OpenAIはチップ購入企業の中でも最大級の1社であり、カスタムチップを開発しつつ複数のチップメーカーから調達するという決定は、テクノロジー分野に広範な影響を及ぼす可能性がある
  • BroadcomはGoogleのような企業が製造向けにチップ設計を微調整するのを支援し、チップ内で情報を高速に移動させるのに役立つ設計部品を供給している
  • OpenAIはBroadcomを通じて、2026年に初のカスタム設計チップを製造できるTSMCの生産能力を確保
  • 現在、NvidiaのGPUは80%を超える市場シェアを占めている
  • しかし、供給不足とコスト上昇により、Microsoft、Meta、そして今回のOpenAIのような主要顧客が内製または外部の代替策を模索している
  • OpenAIがMicrosoftのAzure経由でAMDチップを使用することは、AMDの新しいMI300XチップがNvidia支配の市場の一部を奪おうとしていることを示している
  • AIモデルの学習とChatGPTのようなサービス運用には多額のコストがかかる
  • OpenAIは今年、37億ドルの売上に対して50億ドルの損失を見込んでいる
  • 計算資源コストは同社最大の費用であり、稼働率の最適化とサプライヤー多様化への取り組みを促している

GN⁺の見解

  • OpenAIの内製チップ設計の取り組みと多様なチップメーカーとの協業は、AI業界における重要な変化を示している。これはNvidiaの支配に挑戦し得る新たな代替策を生み出し、AI技術の発展を加速させる可能性がある
  • ただし、OpenAIのコスト構造に関する懸念は残る。AIモデル開発とサービス運用に莫大な費用がかかる状況では、長期的な収益性と持続可能性に疑問がある
  • 一方で、AMDのMI300Xチップのような新しいAIチップの登場は市場競争を促進し、顧客により多くの選択肢を提供するだろう。これはAI技術の普及と商用化に寄与する可能性がある
  • AIチップ市場での競争激化により技術革新は加速し、高性能・低消費電力チップへの需要が増加すると予想される。これに伴い、チップ設計・製造分野への投資と人材確保競争もさらに激しくなる見通しだ
  • 企業がAIチップを導入する際には、性能、コスト、互換性、拡張性など多様な要素を総合的に考慮する必要がある。長期的な技術ロードマップと事業戦略に合致する最適なチップを選ぶことが重要だ

1件のコメント

 
GN⁺ 2024-10-30
Hacker News の意見
  • 元 Google 社員の立場からすると、まったく驚きではない。まだ Google にいる友人たちとは連絡を取り続けているが、ここ数か月で OpenAI が Google 出身のハードウェアエンジニアを引き抜く数が大きく増えている
    LinkedIn で OpenAI のハードウェアエンジニアのプロフィールを見るだけでも、Google 出身者がどれほど多いかは簡単に確認できる。Google の TPU チームはかつての面影を残すだけの状態なので、今後の Google TPU が OpenAI の新チップに劣るようになっても驚かない
    以前の Google TPU の取り組みも Broadcom の支援に依存していた: https://www.theregister.com/AMP/2023/09/22/google_broadcom_t...
    Broadcom が Google TPU をうまく支援していた以上、Google 出身者たちが新しい会社にそのサプライヤー関係を持ち込むのはごく自然なことだ

    • BRCM は、カスタム ASIC を欲しがる企業のために ASIC を設計するサービス会社に近づいている。こういう会社は多いし、なぜこれがニュースなのか分からない
      BRCM は Marvell などと並ぶ SerDes の先導企業で、Synopsys や Cadence の IP もこうしたチップ企業に広く使われている。すべての IP を完全に垂直統合する企業などないので、大騒ぎすることには見えない
    • Google も TPU に多くの時間、資金、人的資本を投じ、ゆっくり成果を出してきた点は見るべきだ。大規模なスケールに実績のある会社でも、試みて失敗したことがある。たとえば Tesla だ
      博士号持ちを一部屋に集めて LLM を作らせるような簡単な話ではない。ハードウェア開発は厄介で、遅く、検証にも時間がかかり、費用も極めて高い
  • Jensen は需要が「狂っている」と言ってきたし、歩留まりが低いという噂も聞こえる。これは今後数か月、あるいは数年にわたる供給問題につながり得る
    Fortune 500 企業の中で、AI ハードウェアとソフトウェア全体を単一の供給元に賭ける会社はない。単一供給元から離れて多様化するのは賢い選択だ

    • うちの会社の経営陣も、なぜ Nvidia を使わないのかと聞かれると、まさに供給元の多様化だと答える。面白いのは、われわれは学習に Nvidia をまったく使っていない点だ
      Nvidia が手に入らないので Trainium を使っている
    • 「AI ハードウェアとソフトウェア全体を単一供給元に置かないのが賢明だ」という話が、Microsoft との独占契約とどう噛み合うのか気になる
      OpenAI/Oracle 契約でさえ、Oracle が自社データセンターで Azure スタックを動かさなければならず、MSFT が関係を仲介できるようになっている。記事に出てくる AMD チップも MSFT が購入している
      これが、OpenAI がリスクと資本支出を引き受けながら Microsoft に多様なハードウェアを提供するという意味なのか、それとも別の条件があるのか気になる
  • OpenAI が自前ですべてを作り、チップ製造用のファウンドリーネットワークを構築するために資本調達する案を検討した、というような表現は、Sam の野心がどれほど馬鹿げていたかを大きく控えめにしている
    彼は AI シリコン専用のファブ 36 棟を建てるため、何とかして7兆ドルを調達するというアイデアを持ち出し、TSMC 幹部たちはそれを聞いてほとんど面と向かって笑ったと伝えられている

    • Sam はこの主張について自ら釈明している。需要を満たすには結局、私たち全員が collectively コンピューティングに 7兆ドルを使う必要があるという意味であって、OpenAI が単独で 7兆ドルを調達してすべての生産能力を建てるという意味ではなかったという
    • Satya Nadella がこの人物とその計画を見て、「OpenAI を任せる安定した天才とはまさにこういう人だ」と判断したことに驚く
    • 少しでも常識があれば笑うべきだった。7兆ドルは簡単に調達できる金額ではない
      米国全体の国内純投資でさえ 1兆ドルに満たない: https://fred.stlouisfed.org/series/W790RC1Q027SBEA
      総固定資本形成、つまり純投資と減価償却を合わせた金額も、そこまで大きく上回るわけではない: https://fred.stlouisfed.org/series/NFIRSAXDCUSQ
      Google、Apple、Microsoft を全部合わせても、年間設備投資は 1,000億ドルに満たない。3社の時価総額を合わせるとほぼ 10兆ドルなのにそうなのだ
      1,000億ドル規模の会社が 7兆ドルを求めるのは、信じがたいほど途方もない
    • それでも、ある意味では感心する。最初に 7兆ドルを求めておけば、あとで1兆ドルだけ求めるのはかなり合理的に見えるから ;-)
    • あまりに冷笑的なのかもしれないが、ファブ 1棟の話だけでも笑えてくる。設計はまだしも、製造だなんて
  • 「The Subprime AI Crisis」の説得力ある財務分析を見ると、映画「Dodgeball」のセリフ以外に付け加えることはない
    「大胆な戦略だな、Cotton。うまくいくか見てみよう。」
    0 - https://www.wheresyoured.at/subprimeai/
    1 - https://www.imdb.com/title/tt0364725/quotes/

    • wheresyouredat の記事に答えるなら、OpenAI が無料の一般モデルを弱体化させ、私のベンチマークで不完全な答えを出し続けるようにしたように見える。一方で o1 モデルは同じベンチマークに引き続き正解する
      以前は無料モデルも、日によっては私のベンチマークにより正確な答えを出すことがあった。だから両者の差を広げて、o1 がより有用に見えるようにした感じがする
      OpenAI が自社製品をどうしようと構わないが、私には無料製品をナーフして o1 を相対的によく見せるようにしたように見える
  • 新しいチップを量産に乗せ、学習や推論に使えるようになるまでどれくらいかかるのか?

    • 優秀なチームならおよそ2年くらい。その後、きちんと動かすためのソフトウェアが必要になる。すぐにできることではない
      さらに資金をつぎ込めば早まる可能性もあるが、逆に台無しにしてもっと時間がかかる可能性もある
    • ここでは、時間はそこまで重要だとは見ていない。Apple siliconが性能を変え、Intel依存をなくしたことを見ればいい
      うまく合わせ込めれば、ほかのLLMプロバイダーとの差をさらに広げられる
    • 第1世代チップは実運用に使うには十分でない可能性が高く、そうなると第2世代に移る必要がある。およそ3〜4年ほどかかるかもしれない
  • おそらくこのチップを使うために自社データセンターを建てるつもりなのだろうが、記事にその話が実際には出てこないのは不思議だ
    西側のAI/行列積チップで、TSMCで製造されていないチップはあるのだろうか? AmazonやMetaはもしかすると違うのか? NVIDIA、AMD、Google TPUもBroadcomの設計協力でTSMCを使っており、今度はOpenAIもそうなる
    Samsungに競争力がないのか気になる。チップ全体またはチップセット供給量の制約がTSMCの生産能力によるものなのか、それともメモリやパッケージングによるものなのかも気になる

    • Samsungは競争力がないので、今の優れたチップはすべてTSMCで作らなければならない。AIチップのボトルネックはパッケージングとHBMだと報じられてきたが、TSMCも稼働率が高い状態にある
    • Samsungはおよそ2〜3年遅れており、HNで言われているほどひどいレベルではない。ただ、チップを80%の利益率で売れるなら、当然ながら最高のものを使いたいはずだ
  • OpenAIはブランド認知度以外には実質的な堀がないことに気づき、ファブとチップ設計で堀を作ろうとしたように見える
    独占ファブとチップが魔法のように優秀で、グリーンチーム税を払わずに安く作れたなら、推論コストで途方もない優位性が生まれたはずだ
    もしかすると、独占チップから始めるだけでも十分だと判断したのかもしれない

  • AIではトランジスタが無駄遣いされているという考えがずっとある。私たちはシステムからエントロピーを取り除くために二値状態を使っているが、AIでははるかに多くのエントロピーが許容される
    この用途なら、NANDゲートよりはるかに優れた方式を使えるはずだと思う

    • 二値方式が使われたもう一つの理由は、手描きの回路ではなく合成の自動化が可能だったからだ。大規模ではこれは本当に重要だ
      NREコストを下げ、開発速度を高めてくれる。これを捨てると、現在の効率を可能にしているツール体系まで捨てることになるかもしれない
  • GH Copilotのようなものはすごいが、それ以外ではまだLLMの社会的・文化的影響を見ていない。インフルエンサーが格好いい例やモデルのリリースを見せる、過熱したソーシャルメディア投稿は除いての話だ
    この技術が社会全体に浸透していく現象が見えないのだが、自分が免疫を持っているのか、それともSaaS/企業向け製品の深い層に隠れているのか気になる
    3D TVやVRのように「おお、すごいね」で終わるのではなく、広く普及し、粘着性があり、定着率の高い生産的な文化的影響があるべきだと思うのだが
    GPUのヒートシンクにそれほど多くの金が燃えて消えたことを考えるとなおさらだ

    • 今、学校や大学にいる世代はLLMを日常ルーチンの一部にしている
      教育分野以外でも、LLMを中心にSEO業界が大きくなっており、彼らは大規模なスパムを量産する新しい能力を非常に気に入っている
      企業や政府の領域では、多少の幻覚やロボットのような企業文体が許容されるコミュニケーション業務に、生産性向上のため慎重に導入されつつある。最終的な文章は今も人間が作るからだ
      カスタマーサポートや営業の方面では、昔ながらの電話メニュー階層の「AI」版に金を使っており、結局は人間につながる前に「オペレーターと話したい」と叫ばされることになる
      ほかの場所では導入が遅い。私たちは決定論的な結果を期待するが、こうしたモデルではそれを期待しにくいからだ。LLM APIとやり取りするソフトウェアを作るとき、出力がランダムに要求した構造から外れることがあり、10年以上使っていなかった防御的コーディング手法を再実装しなければならない。そのため、構造化出力や関数呼び出しの利用も難しくなる
    • 確認はかなり簡単だ。友人たち、できれば開発者ではない友人に使っているか聞けばいい
      会計方面の友人とマーケティング方面の友人が、基本的な分析や宣伝文の作成に使っているのを見て、すでに非開発者も定期的に使っていることが分かった
      非技術職での利用がこの分野では重要だ。過熱の反例として暗号資産があるが、私の知る非技術者は取引所経由で「保有」しているだけで、主張されていたユースケースを実現してはいなかった
    • 周囲の人たちや私自身は、ウェブ検索の一部を置き換える用途で使っている
      特にo1-previewは、関心のある問いについて大まかな輪郭のミニレビュー記事を書くのにかなり良い
      すでにそのテーマを扱ったテキストが多くあり、それを自分の質問に合わせて再構成する必要がある場合にうまく機能する
      チャット形式は、ウェブ検索や関連するWikipedia記事をいくつか読むよりはるかに効率的だ。本当に、コップに水が半分入っているのか半分空なのかという問題だ。有用性には大いに感心し期待しているが、同時にAGIでは明らかにない
    • 不思議なことに、メディアは利用量をうまく捉えられていないようだ。ほとんどの記者やYouTuberは些細なユースケースしか見せていない
      意外な人たちがあらゆる目的でLLMを使っているのを見てきた。多くの場合、上司にツールを使っている事実すら知らせたがらない。自分に超能力を与えてくれるからだ
      銀行員、店舗マネージャー、地方政治家、小規模事業者のような人たちのことだ。以前なら私も信じがたかったが、ますます予想外の人たちがLLMを使い、プロンプトもきちんと組み立てているのを目にしている
    • 直接の消費者だけを思い浮かべているようだが、MicrosoftがWindowsにCopilotを統合し、改善を続けている点を見るべきだ
      すべてのOutlookユーザーが要約、抽出、メール改善ボタンを持つようになれば、数億人が毎日LLMを使うことになる
  • 自社ファブに7兆ドルを使うというのは、野心的であると同時に狂った話だった。結局、現実が割り込んできたようだ。大きな夢から覚めたのなら、品質は維持し続けてほしい

    • 価格の基準点を定める作業が終わり、今は実際の取引をする準備が整った状態に近いように見える