2026年8月19日水曜日 掲載メディア5Newsについて🌓
🇯🇵 JP ▾
速報
「国のために死ぬ」日露戦争で根付いた? パゴダは「生きた痕跡」 Americans love giant trucks — but they’re killing us Copilotが騙されて自分自身のハッキング方法を教えてしまう U.S. sanctions Japanese ICC chief, testing Tokyo’s support for global court AIエージェントは「記憶」が多いほど賢くなるわけではない、IBM Researchが8モデルで検証 重度障害者を2時間半放置しパチンコ ヘルパーを虐待認定 京都 ドーム型で4人が寝られる「コールマン テント BCクロスドーム 270」が36%オフの1万9000円で販売中 踏切で道ふさぎ車が列車と衝突 殺人未遂容疑で52歳逮捕 埼玉 200W出力で8台同時充電「UGREEN 200W 8ポート卓上急速充電器」が30%オフの9799円に AIを活用した特殊詐欺対策、官民から募集 警察庁×GENIAC、懸賞金総額5000万円 「国のために死ぬ」日露戦争で根付いた? パゴダは「生きた痕跡」 Americans love giant trucks — but they’re killing us Copilotが騙されて自分自身のハッキング方法を教えてしまう U.S. sanctions Japanese ICC chief, testing Tokyo’s support for global court AIエージェントは「記憶」が多いほど賢くなるわけではない、IBM Researchが8モデルで検証 重度障害者を2時間半放置しパチンコ ヘルパーを虐待認定 京都 ドーム型で4人が寝られる「コールマン テント BCクロスドーム 270」が36%オフの1万9000円で販売中 踏切で道ふさぎ車が列車と衝突 殺人未遂容疑で52歳逮捕 埼玉 200W出力で8台同時充電「UGREEN 200W 8ポート卓上急速充電器」が30%オフの9799円に AIを活用した特殊詐欺対策、官民から募集 警察庁×GENIAC、懸賞金総額5000万円
テクノロジー

AIエージェントは「記憶」が多いほど賢くなるわけではない、IBM Researchが8モデルで検証

GIGAZINE ·
AIエージェントは「記憶」が多いほど賢くなるわけではない、IBM Researchが8モデルで検証

親愛なる読者の皆さまへ。ご存じの通り価格高騰などの悪影響でサーバー運営がとても苦しい状態です。回線や台数を整理し見直せる部分は全て見直しましたが、やはりまだ危険水域です。このままだと1ページを10分割ぐらいして無理矢理PVを増やさざるを得なくなってしまいます。そこで、GIGAZINEの物理的なサーバーたちを、たった1円でも良いので親愛なる読者の皆さまに支援してもらえればとっても助かります!今すぐ寄付は上のボタンから! ・ これまでGIGAZINEを支援してくれたメンバーのリスト

AIエージェントに過去の経験を「記憶」として大量に与えても、必ずしも性能が高くなるわけではないことがIBM Researchの実験で示されました。AIモデルによっては、すべての記憶を渡すより必要な情報だけを選んだ方が高い性能を発揮するとのことです。 How Much Memory Does Your Agent Actually Need? https://huggingface.co/blog/ibm-research/altk-evolve-hmm

AIエージェントは大規模言語モデルに外部ツールを操作する能力などを加え、複数の手順が必要な仕事を進められるようにしたシステムです。ただし過去の成功や失敗をうまく再利用できず、同じ失敗を繰り返す場合があります。 IBM Researchが開発している「ALTK-Evolve」は、過去の作業記録から成功した戦略や失敗から得た教訓をガイドラインとして抽出し、次の仕事で利用する仕組みです。ALTK-Evolveを使うとAIモデルの再トレーニングなしで過去の経験を活用できるといわけです。

研究チームはALTK-Evolveがカレンダーやメッセージなど9種類の架空アプリを操作する「AppWorld」の訓練用タスクから作成したガイドラインを「記憶」として利用し、585件のタスクを8種類のAIモデルに実行させました。実験では「記憶なし」「すべてのガイドラインを渡す」「タスクに応じて必要なガイドラインだけを選ぶ」という3方式を比較しました。 以下は通常タスク168件について、8モデルのうち代表的な5モデルで「記憶なし」と最も成績が良かった記憶方式を比較したグラフです。特にgpt-oss-120bでは、必要なガイドラインだけを選ぶことでタスク完了率が39.9%から56.0%へ上昇しました。トークン消費量の増加も約5%にとどまった一方、すべてのガイドラインを渡す方式ではトークン消費量が約51%増えたにもかかわらず、性能の伸びは必要なガイドラインを選ぶ方式を下回ったとのこと。大量の情報を渡せばよいわけではなく、モデルに合わせて記憶の与え方を調整する必要があるというわけです。

一方でDeepSeek-V3.2やClaude Opus 4.6、GPT-5.5では、すべてのガイドラインを渡した場合に最も高い性能を示しました。適した記憶の与え方はモデルごとに異なり、モデルの規模だけでは決まらないと研究チームは説明しています。 研究チームは今後、文章の意味の近さだけでなく、実際のタスクの成否を基に役立つ記憶を選ぶ仕組みを研究する予定です。また今回の結果はAppWorldを使った実験に基づくため、より幅広い環境でも検証を進めるとのことです。

・関連記事 AIエージェントの「記憶」は人間の記憶とどう異なるのか? - GIGAZINE AIエージェントの「物忘れ」を防ぐMicrosoftの長期記憶アーキテクチャ「Memora」とは? - GIGAZINE GoogleがAIの長期記憶を支援するアーキテクチャ「Titans」とフレームワーク「MIRAS」を開発 - GIGAZINE 「AIも使い続けていると人間のように老化する」という指摘、セッションを重ねて記憶が蓄積されることで性能悪化 - GIGAZINE 「AIモデルには睡眠が必要」という研究結果 - GIGAZINE

You can read the machine translated English article An AI agent doesn't necessarily beco… .

GIGAZINEで全文を読む ›

この要約はメディアの公開フィードから5Newsが集約したものです。 文脈も含めた全文はgigazine.netにあります — コンテンツの権利はGIGAZINEに帰属します。

GIGAZINEのその他の記事

すべて見る ›

テクノロジーのその他の記事

すべて見る ›