全ニュース

技術ニュース 964 件

生成式影片與推論加速

FastH3、MiniMax H3を4回のDiT呼び出しに圧縮――B200×8基で15秒の映像を13秒で生成

FastVideoはDMD2蒸留と90%のスパース・アテンションにより、ベースモデルの49回のDiT呼び出しを4回に削減し、完全な重みとLoRAを公開した。リアルタイム生成の数値はB200×8基、専用VSAカーネル、ウォームアップ後のテストを前提としており、単一GPUや一般消費者向けGPUではまだ同等の速度に達していない。

AI 代理安全與執行期

NemoClaw 0.0.116、サンドボックスのアイデンティティを永続的にバインドし、復旧・引き継ぎ・削除権限を厳格化

NVIDIAは、0.0.113でローカル推論と状態ドリフトの検証を強化したのに続き、サンドボックス、推論サービス、ライフサイクル権限を永続的に検証可能なアイデンティティにバインドし、再試行や復旧操作が同名ながら別の実行環境を引き継ぐことを防ぐ。

機器人與實體 AI

Microduck、完全なsim-to-real強化学習スタックを公開—25cmの二足歩行ロボットがONNXで方策を実行

Pollen Roboticsは、Microduckの制御ランタイム、MuJoCoシミュレーション環境、PPOの学習レシピ、7種類のプリインストール済み方策をApache 2.0で公開した。399ドルの予約価格は実機強化学習への参入障壁を下げる一方、方策の汎化性能、ハードウェアの耐久性、量産・出荷については、今後コミュニティによる検証が必要となる。

AI 安全

Claude Code Auto Mode、マルチホップ・プロンプトインジェクションで回避される――小規模サンプルでの攻撃成功率は最大80%

研究者は Python のモジュールシャドーイングを悪用し、Claude Code が自ら作成した安全なデコーダーに悪意ある `struct.py` を読み込ませ、最終的にリモートコード実行を実現した。この事例は、ツール呼び出しごとの分類器が OS レベルの隔離の代替にはならず、公式評価で成功率がゼロでも、未知の攻撃チェーンにまでその結果を一般化できないことを示している。

代理系統與科學運算

Anthropic、標準駆動レイヤーでAIエージェントによる研究・製造機器の操作を可能にするMHSをプレビュー

Model Hardware Standardは、機器の機能、自然言語による説明、安全上の制約を探索可能なドライバーインターフェースにカプセル化し、エージェントがMCP、CLI、APIを介して複数の機器を連携制御できるようにする。現時点では申請制の研究プレビューであり、仕様、コード、モデル横断の安全性評価はまだ公開されていない。

AI 程式開發工具

Cursor Cloud Agentsが空のプロジェクトから起動可能に、リポジトリ、プレビュー、デプロイをクラウドワークフローへ統合

Cursorでは、既存のGitHubなどのソースコードリポジトリへの接続が不要になり、エージェントがプロジェクトを直接作成し、ブラウザからリアルタイム環境を操作できるようになった。新しいワークフローはプロトタイプからデプロイまでの距離を縮める一方、クラウド実行、ネットワーク公開、サプライチェーン権限に関する監査範囲も拡大させる。

AI 研究

CritICL、小規模モデルの失敗モードをプロンプト・ライブラリ化し、単一生成で複数サンプルのテスト時計算に迫る

CritICLは、小規模モデルの誤り、失敗タイプ、批評を事前にオフラインで整理し、問題ごとに繰り返しサンプリングする代わりに、関連事例を大規模モデルのプロンプトへ組み込む。著者らはQwen2.5による数学ベンチマークでself-consistencyをわずかに上回る正解率を報告したが、オフラインでのライブラリ構築コストと未公開のコードが再現性を制限している。

AI 開發工具

Experiential、エージェント向けモデルゲートウェイを公開、実際のトラジェクトリに基づきコストと品質の間で自動ルーティング

Experientialは、クラウド、Bring Your Own Key(BYOK)、ローカルモデルをOpenAI互換インターフェースに統合し、IDスコープ、モデルの許可リスト、厳格な予算管理を提供する。さらに、OpenTelemetryのエージェントトラジェクトリからタスクルーターを構築できるが、コスト削減の数値は現時点で主にチーム独自の評価に基づいている。

Open-source governance

Debian決議、AI支援によるコントリビューションを禁止せず バッチ型エージェント操作には引き続きコミュニティの事前合意が必要

Debian開発者は「生成AIの責任ある利用」案を選択した。既存の品質・ライセンス基準を引き続き適用し、AIの出力については提出者が全面的な責任を負う。決議はAI利用の開示を義務付けていないが、機密データの外部送信を明確に制限し、大規模な自動変更については事前の協議を求めている。

AI coding tools

Codex CLI 0.151.0、MCP結果のインターセプトを開放——拡張機能がモデルによる読み取り前にツール出力を書き換え可能に

新バージョンでは`on_mcp_tool_result`ライフサイクルインターフェースが追加され、拡張機能がMCPの成功結果とエラー結果を検査または置換できるようになった。これはデータマスキングと出力正規化のための新たな制御ポイントを提供する一方、拡張機能を監査が必要なエージェントの信頼境界へと押し上げる。

AI 開發工具

OpenAI Python SDK 3.6.0がHTTPX2へ移行、エンタープライズTLS、テストインターセプト、カスタムトランスポート層に移行対応が必要

OpenAI Python SDKは、同期・非同期のデフォルトクライアントをHTTPXからHTTPX2へ切り替え、旧版の`httpx`と`certifi`を推移的依存関係として提供しなくなった。通常のAPI呼び出しはほぼ変わらないが、企業プロキシ、カスタムtransport、RESPXテスト、証明書の信頼設定はアップグレード後に機能しなくなる可能性がある。

AI 代理研究

PILOT、監督エージェントがタスク実行中に進路を修正し、実行経験を永続スキルへリアルタイムで反映

PILOTは双方向チャネルでsupervisorとworkerエージェントを接続し、長時間タスクが完了する前でも、前者が指示を与えたり、誤った経路を中止したりできるようにする。著者らは3つのエージェント・ベンチマークで精度とtoken効率の向上を報告しているが、「自己改善」が更新するのはharness、スキル、メモリのみで、モデルのパラメータは変更しない。