全ニュース

技術ニュース 987 件

推論系統

AMD、Hyperloomをオープンソース化:マルチエージェントのクローズドループでGPU推論最適化を自動的に書き換え・検証

AMDはROCm Hyperloom 1.0.0a1を公開した。エージェントがパフォーマンスプロファイリングからカーネルおよびホストプログラムの修正までを実行し、正確性と速度のテストに基づいて変更を採用するか判断する。初版が対応するInstinct GPUは3モデルのみで、「数週間から数時間への短縮」も現時点ではAMDによる主張にとどまるため、導入者は自身のモデルで再現性を検証する必要がある。

模型評測

TriviaRoomQAが6言語の日常知識を評価、30のオープンモデルにポップカルチャーとニュース分野の体系的な知識欠落

新ベンチマークは、6言語で並行作成された3,300問とフランス語5,340問を用い、モデルが言語をまたいで同じ日常知識やロングテール知識にアクセスできるかを検証する。大規模モデルほど全体的な精度は高いものの、ポップカルチャー、最近の出来事、言語切り替えによる格差は依然として解消されていない。

AI 與軟體安全

AIによる低品質な報告がトリアージコストを押し上げ、GitHubのバグバウンティは本日から公開・招待制の二本立てに

GitHubは7月27日から、HackerOneのsignal基準により実績の乏しい報告者からの提出を制限し、より高額な報奨金と迅速な対応を招待制のVIPプログラムへ移行する。この制度は、低労力およびAI生成の報告増加に直接対応するものだが、新規研究者が有効な脆弱性を報告する際のハードルを高める可能性もある。

AI 研究與訓練

VIGOR、報酬分散に応じてRLVRのrolloutを動的に配分――数学的推論の学習でサンプリング量を最大2.3分の1に削減

新たな研究では、各問題について同数の推論軌跡を固定的に生成するのではなく、報酬のばらつきが大きいサンプルに追加の計算資源を集中させる。著者らは数学およびプログラミングタスクでrollout効率が向上したと報告しているが、コードはまだ公開されておらず、実際のGPU時間や大規模モデルへのスケーラビリティは今後の検証を待つ。

AI 程式工具

Antigravity CLI 1.1.7、無効化されたプラグインによる hooks の実行を停止し、複合コマンドの承認内容を完全表示

Google は、Antigravity CLI でプラグインを無効化した後も hooks、ルール、その他のカスタムコンポーネントが読み込まれる問題を修正し、機能しない、または信頼されていないスクリプトがエージェントの処理フローに介入し続ける事態を防いだ。新版では、承認が必要な複合 shell コマンドも完全に表示される。一方、標準に厳密には準拠していない MCP プロバイダーとの互換性確保のため OAuth issuer 検証が緩和されており、デプロイ担当者は別途精査する必要がある。

開放模型

AMD、Instella-MoEの全トレーニングチェーンを公開—16Bモデルでtokenごとに有効化するパラメータはわずか2.8B

AMDは、Instella-MoEの事前学習、長コンテキスト対応、SFT、DPO、強化学習など6段階のチェックポイントを公開し、トレーニングフレームワーク、データレシピ、推論コードも同時に提供した。モデルはGated MLAとFarSkip-CollectiveによってAttentionとGPU間通信のコストを削減するが、正式な技術レポートと独立評価はまだ完了していない。

模型與代理研究

Photon-1、ラベルなしの画面動画からコンピューター操作を学習——行動ラベルを潜在状態予測で代替

Induction Labsは、106B-A5BのスパースMoEモデル「Photon-1」を発表した。事前学習では画面動画を見るだけで、マウスやキーボードの行動ラベルを必要としない。モデルは次の潜在的な画面状態を予測した後、その状態に到達するための操作を生成する。ただし、現時点で性能を裏付ける証拠は主にチーム内部の評価に基づいている。

AI 程式開發工具

Cursor Router、リクエストごとにコーディングモデルを振り分け――コストモードではGrok 4.5をルーティング候補に残す必要

CursorはAutoモードを、リクエスト単位で分類・モデル選択を行うRouterへと刷新した。企業は品質、バランス、コストの3つの戦略を切り替えられる。公式はオンラインテストで費用を60%削減できるとしているが、モデルがデフォルトで非表示となる仕様や、特定のルーティング候補を必須とする要件により、監査可能性が導入時の重要課題となる。

AI 代理安全

NanoClawのMCP承認カードが実行パラメータを非表示にし、エージェントが一度の同意を永続的な実行設定に転換可能

新たに登録されたCVE-2026-17434は、NanoClaw 2.0.64より前のバージョンに存在する認可上の欠陥を指摘している。管理者が目にするMCPサーバー承認カードには、実際に適用される引数と環境変数が完全には表示されていなかった。修正後はペイロード全体を表示し、機密値をマスキングするとともに入力サイズを制限するようになったが、影響を受けるデプロイでは引き続きバージョンと既存設定を確認する必要がある。

MCP 與應用安全

SiYuanのMCPエンドポイントにロールチェックの不備、3.7.2で低権限ユーザーがコアツールを呼び出せる脆弱性を修正

新たに公開されたCVE-2026-66012により、SiYuan 3.7.2より前の`POST /mcp`エンドポイントは通常のログイン状態しか確認せず、管理者ロールや読み取り専用制限を強制していなかったことが判明した。MCPはノート機能の中核をAIクライアントに公開できるため、本来はコンテンツの読み取りのみを許可されたアカウントが、状態を変更する操作を実行できる可能性があった。

模型評測與安全

英米共同評価:Kimi K3は模擬企業侵害を完遂するも、41件の脆弱性悪用はいずれも任意コード実行に至らず

UK AISIと米国CAISIによる初期テストでは、Kimi K3のExploitBenchスコアは32%でGLM-5.2を上回ったものの、評価対象となった米国のフロンティアモデルには大きく後れを取った。同モデルは32ステップの模擬企業攻撃を一度完遂したが、評価条件とサンプル数が限られているため、現実世界での攻撃成功率を直接推定することはできない。

AI 安全

AgentForger、URLパラメータを悪用してChatGPT Workspace Agentを偽造し、ユーザーの既存コネクタ権限を継承

Zenityは、すでに修正済みのCSRF型攻撃チェーンを公開した。ログイン中のユーザーが細工されたリンクを開くだけで、ChatGPT Agent Builderが攻撃者の制御するエージェントを自動的に作成、スケジュール設定、実行する可能性があった。この脆弱性はOAuthを回避するのではなく、既存の認可を継承するものであり、エージェントの作成フロー、実行主体、ツール権限の間に生じる新たな信頼の隙間を浮き彫りにした。