全ニュース

技術ニュース 987 件

AI 推論與邊緣部署

Ultralytics 8.4.105、YOLO26深度モデルのエッジ展開を拡充し、量子化とエクスポート経路を修正

Ultralytics 8.4.105では、YOLO26深度推定モデルでHailo-8LとQualcomm QNNのサポートが追加され、CoreML、OpenVINO、NCNNなどのデプロイバックエンドも改善された。また、中断された知識蒸留チェックポイントを直接検証・エクスポートできるようになったが、性能向上についてはターゲットハードウェアごとに個別の測定が必要だ。

代理標準與基礎設施

DNS-AID、SVCBとDNSSECでエージェント発見レイヤーを構築――MCP・A2Aエンドポイントの中央ディレクトリ依存を解消

DNS-AIDは公開WebサイトとApache 2.0ライセンスのリファレンス実装を提供し、組織がエージェントのエンドポイント、プロトコル、ケイパビリティ文書を既存のDNSレコードとして公開できるようにする。この仕組みではDNSSECを利用して公開元ドメインを検証できるが、エージェント自体の安全性、ケイパビリティ宣言の正確性、認可に値するかどうかまでは証明できない。

AI 程式工具

Hallmark、2日間で約7,200スターから17,000スターへ——ルールベースのSkillでエージェントによるUI生成を制約

HallmarkがGitHubで急速に普及している。レイアウトの骨格、フォント、色彩、反テンプレート検査を、Claude Code、Cursor、Codexが読み込めるSkillとしてパッケージ化したものだ。モデルの訓練やファインチューニングは行わず、生成の前後にバージョン管理可能なデザインポリシーと自己レビューを組み込む。

模型與代理平台

Claude Opus 5、推論をデフォルトで有効化し、会話途中でのツール変更にも対応――旧バージョン向けのエージェント設定では即座にエラーとなる可能性

AnthropicはClaude Opus 5をリリースした。100万tokenのコンテキストと最大12.8万tokenの出力に対応し、thinkingがデフォルトで有効になった。新モデルでは、プロンプトキャッシュを維持したままエージェントがツールを追加・削除できる一方、推論の無効化と高いeffortを組み合わせる設定には破壊的変更がある。

AI evaluation

EvolvingIntent、静的ベンチマークを要件が変化する対話へ再構成し、エージェントの修正指示追跡におけるギャップを明らかに

Microsoft ResearchはEvolvingIntentを提案した。既存の数学、SQL、検索、プログラミングタスクを、情報の段階的な開示、修訂、方向転換を含むマルチターン対話へ分解する。実験では、シングルターン・ベンチマークでのモデルの能力が、要件が継続的に変化する状況へ安定して転移しないことが示された。関連するデータ構築・評価コードは公開されている。

AI coding tools

Spec Kit 0.14、エージェントワークフローを再現可能なBundleとしてパッケージ化し、リモートカタログのダウンロード境界を厳格化

GitHubの仕様駆動開発ツールSpec Kit 0.14では、バージョン管理可能なBundle、Pythonスクリプトパス、再現可能なビルドが追加された。直後にリリースされた0.14.2では、shell実行パラメーターの削除と入力検証の強化も行われ、エージェントワークフローがパッケージのサプライチェーンやコマンドインジェクションの問題に直面し始めていることを示している。

代理框架與開發工具

Block、Buzzをオープンソース化し、Nostr署名イベントでAIエージェント、会話、Git監査ログを統合

BlockはBuzzをApache 2.0ライセンスで公開し、人間とAIエージェントがそれぞれ固有の鍵を使ってチャンネル、コードレビュー、ワークフローに参加できるようにした。すべての操作を単一relay上の署名イベントとしてモデル化する一方、relayのレプリケーション、完全な承認ゲート、エンドツーエンド暗号化はまだ提供されていない。

模型與邊緣推論

VibeVoice-ASR-BitNet、異種量子化で音声認識モデルを1.58 GBに圧縮、CPU 3スレッドでリアルタイム文字起こしを実現

Microsoft ResearchはVibeVoice-ASR-BitNetを公開した。音声エンコーダーと言語モデルにそれぞれINT8量子化と三値重み量子化を適用し、GPUなしで多言語ASRを実行可能にする。公式テストでは、同程度のモデルサイズのWhisper.cppより1.6~2.3倍高速だが、現時点ではオフラインのバッチ文字起こしにのみ対応する。

AI coding tools

Claude Code 2.1.219、3階層のサブエージェントツリーを解禁し、サンドボックスに厳格なネットワーク許可リストを導入

Anthropicは、Claude Codeのサブエージェントのデフォルトのネスト深度を1階層から3階層に拡大し、深層エージェントの出力を構造化ストリーミングに組み込んだ。新バージョンでは、許可リストに含まれていないネットワークホストへの接続を直接拒否できるため、無人エージェントでデフォルト拒否ポリシーを採用しやすくなる。

Enterprise AI applications

GrokがGoogle Docs、Sheets、Slidesに進出、広範なファイル権限が導入審査の焦点に

SpaceXAIは、Grokが文書、スプレッドシート、プレゼンテーションのサイドバーでコンテンツを生成・編集できる単一のGoogle Workspaceアドオンを公開した。Marketplaceで公開されているOAuth権限は、すべてのDocsとSlides、およびアドオンがインストールされたスプレッドシートに及ぶため、企業は導入前にデータ転送と最小権限について明確にする必要がある。

AI 基礎設施

Hetzner、OpenAI互換の推論APIを試験提供――単一のFP8 MoEモデルで欧州ホスティング需要を検証

Hetznerは実験的なLLM推論サービスをひっそりと公開した。現在利用できるのはQwen3.6-35B-A3B-FP8のみで、既存のOpenAI SDKからbase URLを差し替えるだけで接続できる。コミュニティによる低負荷テストでは、最初のtokenが返るまでの時間の中央値は153ミリ秒、生成速度は約224 token/sだった。ただし、SLA、課金、プロダクション利用の保証はない。

AI 研究與推論

100万tokenは利用可能なメモリを意味しない:実測で少数のretrieval headsが長文コンテキストのボトルネックと判明

未公開の27Bハイブリッドモデルを対象とした推論時の実験では、約100万tokenにおける埋め込み情報の再取得率は21.4%にとどまり、3.3万token時の92.9%を大きく下回った。位置スケーリング、attention temperature、高精度KV cacheのいずれも問題を顕著には改善せず、検索能力は18個のattention headに高度に集中していた。