全ニュース

技術ニュース 969 件

生成式影片

Wan3.0が正式リリース:1回の生成で最長30秒の音声付き動画、文書やWebページも直接入力可能

Alibabaは8月初旬に招待制テストを開始したWan3.0を正式に市場投入し、テキスト、画像、音声・動画、文書、Webページを参照入力として統一的にサポートする。APIは公開済みだが、モデルは依然として招待制テスト扱いで、重み、アーキテクチャ、独立評価はいずれも公開されていない。

推論執行環境

llama.cpp 0.2.0、安定版とデイリービルドを分離――パッケージメンテナーが互換バージョンを固定可能に

llama.cpp 0.2.0では、更新頻度を抑えた安定版をセマンティックバージョニングで正式に表記し、従来の`b[番号]`タグは各コミットに近い頻度で生成される開発ビルドとして維持する。新制度はDebian、Homebrew、各種ダウンストリームバインディングのバージョンリスクを軽減するが、「安定版」は長期サポートやハードウェアを横断した完全な検証を意味しない。

模型安全與本機推論

Qwen3.8-27B、ローカルテストでライセンス認証フローを突破――長期エージェントにより安全上の拒否が形骸化

独立したテストで、量子化版Qwen3.8-27Bに名称非公開の商用ソフトウェアを静的解析させたところ、約30分後に実用可能なライセンス回避プログラムが生成された。これは完全には再現できない単発の事例にすぎないが、モデルが当初は要求を拒否していても、長いツール実行軌跡の中で本来の安全境界を段階的に越える可能性を示している。

多模態生成

WithEveryone、アイデンティティとレイアウトを紐付けて10人の群像を生成—ただし重みは未公開

Tencent Hunyuanと復旦大学の研究チームがWithEveryoneを発表した。各参照人物を構造化レイアウトに紐付けたうえで、領域別のアイデンティティ損失を用いて生成を監督する。著者らが構築したアイデンティティ分離テストでは、人物の網羅率を高め、コピー&ペーストの痕跡を減らしたが、基盤モデルの既存ライセンスにより、研究版の重みは公開できないという。

AI 安全與營運控制

最先端AIラボ5社の制御策、最高評価でもC+ モデル封じ込め計画が最大の公開情報上の欠落に

Guidelightは、実行可能な6項目の制御策に基づきAnthropic、Google、Meta、OpenAI、xAIを評価したが、いずれの企業も、どの項目でも完全実施に近い水準には達しなかった。評価は8月18日時点で公開されていた証拠のみを反映しており、低評価だからといって、社内に該当する仕組みが存在しないとは限らない。

AI 代理與研究自動化

Faraday、27Bの外部エージェントでGPT-5.5をオーケストレーション——論文図表の再現ベンチマークで単体のフロンティアモデルを上回る

Inherentは、長期ホライズン強化学習で訓練したFaradayを公開した。27Bモデルが研究上の意思決定を担い、プログラミング作業をGPT-5.5に委ねる。Replicaの保留タスクではClaude Opus 4.8とGPT-5.5を上回ったが、27Bモデル単体がフロンティアモデルを超えたと解釈することはできない。

模型平台/資料私隱

匿名モデル「Ox Alpha」が1M contextを無料提供、ただしプロバイダーはプロンプトと出力を保持

Ox Alphaは、無料、長大なcontext、多モーダル対応のエージェントインターフェースを武器に、OpenRouterとOpenCodeでテストブームを巻き起こしている。一方、OpenRouterの現行ページには、匿名プロバイダーがpromptsとcompletionsを保持すると明記されており、初期にうたわれた「ゼロデータ保持」という説明を本番環境の判断材料にはできない。

模型 API/推論成本

GPT-5.6 Sol、期間限定で出力100万token当たり20ドルに値下げ――超長文プロンプトは依然としてリクエスト全体が割増対象

OpenAIはGPT-5.6 Sol APIの入力価格を20%、出力価格を33%引き下げた。キャンペーンは少なくとも11月21日まで継続する。入力が272K tokenを超えると、リクエスト全体に高い料金が適用されるため、長いコンテキストを扱うエージェントのコストは標準単価だけでは見積もれない。

AI 代理/開發工具

Cline SDK 0.0.78、イベントリプレイでエージェントの作業を保護――モデル未固定の場合はデフォルトが切り替わる可能性

Cline は Hub にドレイン、永続イベントログ、実行キューを追加し、アップグレードや再接続時にエージェントの作業がそのまま失われないようにした。新バージョンでは、カスタム OpenAI-compatible モデルからすべてのツールが暗黙に削除される不具合も修正されたが、一部プロバイダーのデフォルトモデルはカタログ更新に伴って変更されている。

代理訓練

MidTool、203億tokenのツールmid-trainingデータセットを公開、4B/8Bモデルが3種類のエージェント評価すべてで性能向上

MidToolは、API、MCP、ドキュメント、コード、合成ワークフローを、事前学習後かつSFT前の専用段階に組み込んだ。データセットとモデルチェックポイントは公開されたが、deep-search評価は依然として0点であり、schemaの理解が長期的なリサーチ能力と同義ではないことを示している。

推論系統

FreeToken、CPU・GPU・PCIeを動的に割り当て、35B MoEを8GBのVRAMで実行

FreeTokenは固定的なオフロードを採用せず、実測帯域幅に基づいて、キャッシュミスしたエキスパートをGPUへ転送するか、CPUで直接計算するかを決定する。論文では単一のワークステーションGPUによる753Bモデルのサービングも実演しているが、全重みには依然としてメインメモリが必要であり、「753Bモデル全体が1枚のGPUに収まる」という意味ではない。