推論基礎設施
NVIDIA Dynamo、Kimi K3向けマルチノード展開レシピを提供——100万tokenの推論には少なくとも16基のGB200/GB300が必要
Dynamoの実験版がKimi K3のマルチモーダル処理、推論、ツール呼び出しの解析に対応し、集約型およびprefill/decode分離型のKubernetesレシピを公開した。このレシピは2.8T MoEの展開要件をラックトポロジー単位で定量化しているが、現時点では正式なQAを通過しておらず、GB200構成には既知の起動エラーも残っている。