OpenAIがカスタム推論チップ「Jalapeño」のベンチマーク結果を公開、高スループットと低レイテンシを単一アーキテクチャで両立
親愛なる読者の皆さまへ。ご存じの通り価格高騰などの悪影響でサーバー運営がとても苦しい状態です。回線や台数を整理し見直せる部分は全て見直しましたが、やはりまだ危険水域です。このままだと1ページを10分割ぐらいして無理矢理PVを増やさざるを得なくなってしまいます。そこで、GIGAZINEの物理的なサーバーたちを、たった1円でも良いので親愛なる読者の皆さまに支援してもらえればとっても助かります!今すぐ寄付は上のボタンから! ・ これまでGIGAZINEを支援してくれたメンバーのリスト
OpenAIがBroadcomと共同開発した推論システム向けカスタムチップ「 Jalapeño (ハラペーニョ)」についてのブリーフィングを行い、ベンチマークスコアを公表しました。Jalapeñoは通常であればトレードオフの関係にある高スループットと低レイテンシを単一アーキテクチャで実現しているとのことです。 Jalapeño’s first results show industry-leading speed and efficiency in AI inference | OpenAI https://openai.com/index/jalapeno-first-results/
Since announcing Jalapeño, our first custom inference chip, we’ve been testing it and the system around it. The results show a major advance: more intelligence from every watt and faster responses, delivering both higher throughput and lower latency in one architecture without… pic.twitter.com/vj7VOrA8pP
Excited about our Jalapeno results today. An incredible achievement from the team, taking a new chip from concept all the way to very impressive performance on real workloads in the lab. Tomorrow’s fast will feel like today’s ultrafast. As I’ve mentioned before, we’re pushing to… https://t.co/Qd4mbYLxB8
「Jalapeño」は2026年6月、OpenAIがBroadcomと共同開発した大規模言語モデルに最適なカスタム推論チップとして発表されました。 OpenAIがBroadcomと共同開発したLLM最適推論チップ「Jalapeño」を発表 - GIGAZINE
OpenAIは発表後、JalapeñoおよびJalapeñoを基盤としたシステムのテストを繰り返し実施。「GPT OSS 120B」「DeepSeek R1」「Kimi K2.5 1T」の3モデルでJalapeñoはピークスループット時、1kWあたりのAI処理量を1.5倍~1.9倍に向上させ、エンドツーエンドレイテンシを1.7倍~3.6倍に低減しました。インタラクティブ性の高いワークロードではパフォーマンス向上は2.1倍~4.1倍に上ったとのこと。多くの場合、スループットとレイテンシは両立できずどちらを取るか迫られますが、Jalapeñoの場合、単一アーキテクチャで高いスループットと低いレイテンシの両方を実現しています。 最大デコードスループットが3つのモデルとも向上していることが示されています。
社内テストでOpenAIの最先端モデルを利用するとJalapeñoの優位性はさらに拡大しており、ワークロードが大きくなり要求が厳しくなるほど、Jalapeñoの価値が高まると示唆されています。 OpenAIは年末までに、社内のコンピューティングインフラストラクチャ内にJalapeñoの第1世代を導入する予定。第1世代のフィードバックをもとに効率と速度が向上していた第2世代は開発が進んでいて、さらに、第3世代も形になりつつあるとのことです。
・関連記事 AnthropicがSamsungと独自のAIカスタムチップ開発について協議しているという報道 - GIGAZINE GoogleはGeminiの効率性を向上させるための新しいAIチップの開発に取り組んでいる - GIGAZINE NVIDIAが大手顧客に対してAI関連製品を15%以上値上げすると通知、「Vera Rubin」や「Grace Blackwell」などにも影響か - GIGAZINE GPUと比較して最大30倍高速にAIを動かすCerebrasの「CS-4」ラックスケールソリューションが登場 - GIGAZINE
You can read the machine translated English article OpenAI releases benchmark results for it… .
この要約はメディアの公開フィードから5Newsが集約したものです。 文脈も含めた全文はgigazine.netにあります — コンテンツの権利はGIGAZINEに帰属します。