全ニュース

技術ニュース 987 件

AI 研究

外部メモリにより、重みを凍結したエージェントがデプロイ後のフィードバックから学習――τ-benchの単発成功率は最大2.6倍に

新たな研究では、エージェントの各実行の成否と事後の修正を検索可能なルールへ蒸留し、モデルの重みを更新せずに経験を蓄積する。τ-benchの銀行業務タスクでは、Mistral LargeとClaude Sonnet 5の両方で効果が再現されたが、評価には完全なフィードバックが用いられ、各シナリオは4回ずつ繰り返された。

AI 開發工具

GitHub Agentic Workflows 0.83.4、Googleのキーレス認証に対応し、エージェント出力のポリシーコンパイルを強化

GitHubのオープンソース・エージェントワークフローツールがGoogle Vertex AI Workload Identity Federationに対応し、Geminiワークフローで長期有効なサービスアカウントキーを保存する必要がなくなった。新版では安全な出力チェックとBYOKパラメータも拡充されたが、カスタムヘッダーやリクエストフィールドは依然としてデータ流出のリスクを拡大する可能性がある。

AI 程式開發工具

GitHub Copilot、JetBrainsでエージェントのテレメトリとtoken上限を開放、BYOKエンドポイントでモデルを一元管理可能に

GitHubはJetBrainsプラグインを更新し、エージェントワークフローからOpenTelemetryをエクスポートできるようにしたほか、持ち込みキーとカスタムエンドポイント向けに入力・出力tokenの上限を設定可能にした。Claude agent flowからMCPサーバーやカスタムエージェントへ直接接続できるようになった一方、ツール呼び出しの内容、コストの帰属、データのマスキングについては、導入チームによる検証が引き続き必要となる。

邊緣 AI/推論系統

ESP32-S3、階層型埋め込みにより16MB Flash上で2,890万パラメータモデルを実行、生成速度は毎秒約9.5 token

オープンソースプロジェクト「esp32-ai」は、パラメータの大部分をメモリマップドFlashへ移し、小型のTransformerコアだけを高速メモリに配置することで、約8ドルのマイクロコントローラーによる完全オフラインのテキスト生成を実現した。この成果は階層型モデルをファームウェアに組み込めることを示す一方、TinyStoriesレベルの出力を汎用的な言語理解やデバイス制御能力と同一視することはできない。

AI 程式開發

5万5,000件の実際のレビューコメントが示す、短くそのまま適用できるAI修正案ほど開発者に採用されやすい

5種類のコーディングエージェントが342件のPythonリポジトリに残した54,791件のレビューコメントを分析した実証研究により、インラインコード提案がコメントの解決を予測する最も強い因子であることが分かった。誤った提案とプロジェクトの既存設計の無視は、未解決の議論で特に多い類型だったが、観察データから各エージェントの品質を直接順位付けすることはできない。

推論系統

HPD-Parsing、文書生成を並列分岐に分解、1Bモデルでピークスループット毎秒4,752 tokenを達成

PaddlePaddleは、1BパラメータのHPD-Parsingを公開した。グローバルレイアウト分岐で複数のブロックデコーダーを協調させ、ページ全体をtoken単位で逐次生成する際のボトルネックを回避する。公式テストでは、既存の比較対象で最速のモデルに対して2.62倍のスループットを示したが、現時点ではカスタムvLLMパッケージに依存しており、ピーク値をエンドツーエンドのPDF処理速度と直接同一視することはできない。

企業代理平台

Cohere Northが多段階Automationsを追加、エンタープライズエージェントを単発の質疑応答から継続実行可能なワークフローへ

CohereはNorthに設定可能な多段階Automationsを追加し、エージェントが条件に応じてデータを処理し、企業向けツールを呼び出し、ほかのエージェントと連携できるようにした。プラットフォームはプライベートデプロイ、MCP、監査ログをサポートするが、障害時の再試行セマンティクス、バージョン管理、定量的な信頼性データはまだ公開されていない。

AI 晶片設計

Nemotron 3 Ultra、ACE-RTL反復型エージェントに統合——9種類のチップ設計タスクで平均合格率97.1%

NVIDIAはNemotron 3 Ultraを、生成・シミュレーション・リフレクションからなる固定ループに組み込み、CVDPの9種類のRTLタスクで平均合格率97.1%を達成した。エージェントフレームワークによって各モデルの成績が大幅に向上することも示されたが、比較対象は3つのオープンモデルと単一の評価フローに限られる。

AI 安全與隱私

Claudeの公開共有ページが検索インデックスに登録、「リンクを知る人だけが閲覧可能」は探索不可能を意味しない

一部のユーザーが自ら共有したClaudeの会話やArtifactsがGoogle検索結果に表示され、当初はリンクを持つ人だけに限定されているように見えたコンテンツが、キーワードで見つけられる状態になった。未共有の非公開会話が侵害されたわけではないが、公開リンク、クローラー制御、ユーザーの認識の間にあるセキュリティ上のギャップが露呈した。

AI 程式開發與治理

GitHub、Copilot Appとクラウドエージェントを一元管理ポリシーの対象に――プラグインと承認バイパスをクライアント横断で制御可能に

GitHubの`managed-settings.json`は、Copilot App、クラウドエージェント、CLI、VS Codeを一括して制御できるようになり、デスクトップAppの有効化権限もCLIポリシーから分離された。既存のエンタープライズ設定ではAppがデフォルトで有効になるため、クローズドな導入を求める管理者は、新しいポリシーとプラグインの許可リストを能動的に確認する必要がある。

AI 標準與代理基礎設施

MCP 2026-07-28、接続フェーズのsessionを撤廃し、ツールサーバーをステートレスHTTPへ移行

MCPの新改訂では、初期化ハンドシェイクと`Mcp-Session-Id`を廃止し、単一のリクエストを任意のサーバーインスタンスで処理できるようにする。これは破壊的なプロトコル変更であり、最終版の確定と主要SDKの対応完了までは、デプロイ担当者は引き続きバージョンネゴシエーションと旧バージョンへのフォールバックを維持する必要がある。