2026年8月18日火曜日 掲載メディア5Newsについて🌓
🇯🇵 JP ▾
速報
2歳児が暴行受け死亡 傷害容疑で母の交際相手を逮捕 横浜 All aboard as Asian Games preparations enter ‘final stages’ Tepco begins removal of radioactive spent fuel from Fukushima No. 2 reactor 大谷が28号ソロと29号2ラン 1試合2本塁打は今季2度目 Googleが倒産したスピリット航空のメール1億件・Teamsチャット5億件を約16億円で購入へ、AIモデルの学習などに利用 本屋を引き継ぎませんか? 異色の書店主が「未来」に託す思い ついにUber Eatsがドローン配送開始、全米展開を目指し2029年には1日100万件の配送を達成する計画 ライフカード、信用情報の不適切利用が判明 アイフルの顧客情報94万件超を保険営業の対象選定に Takaichi’s punishing workload draws renewed scrutiny after 6½-hour checkup at hospital 新スマホ「arrows Alpha2」は“世界一タフ”なのか、FCNTが示した根拠は? 2歳児が暴行受け死亡 傷害容疑で母の交際相手を逮捕 横浜 All aboard as Asian Games preparations enter ‘final stages’ Tepco begins removal of radioactive spent fuel from Fukushima No. 2 reactor 大谷が28号ソロと29号2ラン 1試合2本塁打は今季2度目 Googleが倒産したスピリット航空のメール1億件・Teamsチャット5億件を約16億円で購入へ、AIモデルの学習などに利用 本屋を引き継ぎませんか? 異色の書店主が「未来」に託す思い ついにUber Eatsがドローン配送開始、全米展開を目指し2029年には1日100万件の配送を達成する計画 ライフカード、信用情報の不適切利用が判明 アイフルの顧客情報94万件超を保険営業の対象選定に Takaichi’s punishing workload draws renewed scrutiny after 6½-hour checkup at hospital 新スマホ「arrows Alpha2」は“世界一タフ”なのか、FCNTが示した根拠は?
テクノロジー

ローカルで動く中国製オープンモデル「Qwen3.8 27B」はGPT-5.6 Terra超えのエージェント性能で同等規模のモデルより圧倒的に高性能という分析結果

GIGAZINE ·
ローカルで動く中国製オープンモデル「Qwen3.8 27B」はGPT-5.6 Terra超えのエージェント性能で同等規模のモデルより圧倒的に高性能という分析結果

親愛なる読者の皆さまへ。ご存じの通り価格高騰などの悪影響でサーバー運営がとても苦しい状態です。回線や台数を整理し見直せる部分は全て見直しましたが、やはりまだ危険水域です。このままだと1ページを10分割ぐらいして無理矢理PVを増やさざるを得なくなってしまいます。そこで、GIGAZINEの物理的なサーバーたちを、たった1円でも良いので親愛なる読者の皆さまに支援してもらえればとっても助かります!今すぐ寄付は上のボタンから! ・ これまでGIGAZINEを支援してくれたメンバーのリスト

中国企業のAlibabaはローカルで実行できるAIモデル「 Qwen3.8 27B 」を日本時間の2026年8月15日に公開しました。このQwen3.8 27Bについて、第三者機関の Artificial Analysis が性能分析結果を2026年8月17日に公開し、Qwen3.8 27Bがローカルで動くオープンモデルでありながらGPT-5.6 Terraといったクローズドモデルに匹敵する性能を備えていることが明らかになりました。 Qwen3.8 27B - Intelligence, Performance & Price Analysis https://artificialanalysis.ai/models/qwen3-8-27b Qwen3.8 27Bはオープンモデルとして無償公開されたモデルで、OllamaやLM StudioといったAI実行アプリを用いて高性能な家庭用PCで実行することができます。Alibabaが公開したベンチマーク結果ではClaude Opus 4.6 Maxを複数のテストで上回ったことが明らかになっていました。 ローカルで動かせる「Qwen3.8-27B」が無償公開、一部ベンチマークでClaude Opus 4.6 Max超え - GIGAZINE

Artificial AnalysisによるQwen3.8 27Bのテスト結果は以下の通り。複数のベンチマークテストを実行してインテリジェンス性能を算出するArtificial Analysis Intelligence Indexのスコアは「52」で、GPT-5.6 Lunaと並びました。

エージェント性能を算出するArtificial Analysis Agentic Indexのスコアは「51」で、GPT-5.6 TerraやClaude Opus 4.8を上回っています。

以下のグラフは横軸がモデルの総パラメーター数、縦軸がArtificial Analysis Intelligence Indexのスコアを示しています。Qwen3.8 27Bは同等性能のモデルと比べて規模が小さく、ローカルで動作するモデルでありながら高い性能を備えていることが分かります。

タスクごとの出力トークン数を比較したグラフが以下。Qwen3.8 27Bは出力トークン数がかなり多いのが特徴です。APIやサブスクリプションサービスで利用するモデルの場合は出力トークン数の多さが費用の高さに直結しますが、Qwen3.8 27Bの場合はローカルで実行できるのでAPI料金などを考慮する必要がありません。一方で「出力トークンが蓄積してコンテキストウィンドウの上限に達するのが早くなる」「出力トークンが蓄積してメモリ使用量が増える」といった問題は発生します。

Artificial AnalysisはQwen3.8 27Bの性能について「インテリジェンス性能においてトップクラスのモデルである」「Artificial Analysis Intelligence Indexのテストで合計1億6000万トークンを出力した。これは中央値の4300万トークンと比較すると非常に冗長である」と評価しています。

・関連記事 ローカルで動かせる「Qwen3.8-27B」が無償公開、一部ベンチマークでClaude Opus 4.6 Max超え - GIGAZINE アリババのAI「Qwen」が6カ月間に30億回ダウンロードされる世界1位のAIモデルに - GIGAZINE 2.4兆パラメーターの中華AI「Qwen3.8」がオープンモデルとして無償公開される、OpenAIやAnthropicの最先端モデルに匹敵する性能 - GIGAZINE Metaがローカル動作するオープンモデル「Muse Glimmer」を公開、30BでGoogleのGemma 4 31Bより高性能 - GIGAZINE Googleが「Gemini 3.7 Flash」をリリース、Claude Sonnet 5やGPT-5.6 Terraに並ぶ性能で年末まではGemini 3.6 Flashの半額で利用可能 - GIGAZINE Z.aiがコーディング能力に優れたオープンウェイトAIモデル「GLM-5.3」リリース、前モデル比で50%の性能向上 - GIGAZINE

You can read the machine translated English article Analysis shows that the locally running … .

GIGAZINEで全文を読む ›

この要約はメディアの公開フィードから5Newsが集約したものです。 文脈も含めた全文はgigazine.netにあります — コンテンツの権利はGIGAZINEに帰属します。

GIGAZINEのその他の記事

すべて見る ›

テクノロジーのその他の記事

すべて見る ›