全ニュース

技術ニュース 953 件

開發者平台

OpenAI Java SDK 4.58、未完了のWeb検索呼び出しを識別しResponsesのステータス処理を補完

OpenAI公式Java SDK 4.58.0は、未完了のweb search呼び出しステータスを新たに識別できるようになり、アプリケーションが中断された検索ステップを成功または不明な値として誤認することを防ぐ。このバージョンはすでにMaven Centralで公開されているが、サポートが終了したSpring Boot 2 starterを引き続き使用している場合、新版パッケージへそのまま移行することはできない。

AI 代理工具

RoutineKit 0.2、成功したMCPツールシーケンスをレビュー可能・再実行可能なツールとしてパッケージ化

独立系オープンソースプロジェクトのRoutineKitは、成功した一連のエージェントツール呼び出しを、型付き入力を持つ名前付きツールへ変換し、新しいパラメータで再実行できる。人による承認とホスト側の保護機構は維持されるが、現時点では線形フローとローカルのstdio MCPのみをサポートしており、汎用的なエージェント記録ツールではない。

代理執行期與推論系統

Speculative Macro Commit:エージェントのツールチェーンを先行実行し、AppWorldの実時間を44.9%短縮

新たな研究では、小型のドラフトモデルが隔離された環境スナップショット内で複数ステップのツール操作を先行実行し、大型の権威モデルが最初のステップを確認した後、一連の結果をまとめてコミットする。2つのエージェントベンチマークでレイテンシを削減した一方、3基のGPUを必要とし、AppWorldのタスク完了率は41.67%から40.48%に低下した。

AI 代理與研究自動化

OpenAI、研究エージェントの作業時間が人間の3倍を超えたと発表、ただし出力指標は依然として研究の進展と同一視できず

OpenAIは社内データを公開し、8月中旬時点で人間の研究者の1営業日当たり3.1エージェント営業日に相当し、社内マイルストーンである「自動化された研究インターン」に到達したと発表した。データは、エージェントが実験とエンジニアリングのスループットを拡大していることを示す一方、長時間タスクの大半では依然として人間の介入が必要であり、計算資源の増加によって因果関係の切り分けも難しくなっている。

AI 晶片與推論

Extropic Z1Tは確率チップ向けにTransformerを再設計、ただし100倍の省エネ性能は主要コストを除外した試算

Z1Tは、固定された4入力の疎な射影、Dynamic Tanh、畳み込みベースのアテンションを用いて、デコード処理の一部をExtropicのZ1確率ビットチップにマッピングする。コードと1組の重みは公開済みだが、省エネ性能とスループットの数値は主にハードウェアモデルに基づくもので、完全なエンドツーエンドの実測結果ではない。

開源模型

LLaDA-Image、中英バイリンガルの画像生成・編集モデルを公開、Turboはサンプリングを4ステップまで短縮

InclusionAIはLLaDA-ImageのBase、Turbo、FP8の各ウェイトを公開し、単一モデルでテキストからの画像生成、参照画像の編集、中国語・英語テキストのレンダリングを可能にした。論文では2億2,000万件のサンプルを用いた段階的な学習手法を詳述しているが、予告された学習コードは現時点でまだ公開されていない。

本機 AI/開發平台

Microsoft Project Zenith、ローカル30Bモデルとエージェント隔離レイヤーを開発者向けWindowsデバイスに統合

Project Zenithは、64GB以上のユニファイドメモリと250GB/sの帯域幅を備えたデバイス向けに事前構成されたWindows 11開発環境で、第一弾としてAMD Ryzen AI Haloに搭載される。ローカルモデル、WSLツールチェーン、エージェントコンテナを単一のプラットフォーム構想にまとめるが、現時点のMXCはセキュリティ境界とは見なせない初期プレビュー段階にある。

推論系統

SGLang 0.5.19がBeam Searchを追加し、NVIDIA/AMD間の推論パスを再編

SGLangの新バージョンでは、同一サービス内で`beam_width`を指定して複数の候補シーケンスを返せるようになり、統一radix treeが全モデルのデフォルトキャッシュとなった。MoE、長コンテキスト、ROCmカーネルも拡充された一方、依存関係や設定動作に変更があるため、アップグレード前の再検証が必要だ。

代理基礎設施

AWS、AgentCore のメモリ廃棄フローをオープンソース化——スケジュール型ワークフローで組み込み TTL の不足を補完

AWS は、長期稼働するエージェントのメモリを定期的に評価、統合、削除する、CDK でデプロイ可能なリファレンスアーキテクチャを公開した。これは AgentCore の新しいネイティブ TTL 機能ではなく、サンプルのドキュメントとリポジトリでは、評価式の説明がまだ完全には一致していない。

模型訓練研究

補助的視点の実験:同じ知識を教材・Q&A・記事に書き換える方が、原文を繰り返すよりモデルの学習に有効

ペンシルベニア大学の研究者らは、知識に割り当てるtoken予算を固定したうえで、原文の反復の一部を複数の概念的表現に置き換え、事実の想起と推論を改善した。効果は主に7B以上のモデルで確認されたが、実験は短期間の継続事前学習にとどまり、フロンティアモデルの完全な事前学習へ直接一般化することはできない。

本機推論/開發工具

Ollama 0.34 RC、ローカルモデルをChatGPT Desktopに接続——ツール検索とレスポンス圧縮の互換性も強化

OllamaのmacOSアプリから、ローカルのオープンモデルを新版ChatGPT Desktopへ直接接続できるようになった。ただし、現時点ではリリース候補版であり、クラウドモデルへ切り替えられないUI上の問題もコミュニティから報告されているため、そのまま大規模展開するのは適切ではない。