V

vLLM

V
vLLM AI v0.26.1rc0

v0.26.1rc0

[CI][ROCm] test_ocp_mx_wikitext_correctness参照値を修正する (#4...

V
vLLM AI v0.26.0

v0.26.0

vLLM v0.26.0 リリースノート ハイライト このリリースには 212人の貢献者 (61人) から411件のコミットメントがあります!新しいインクリングモデルファミリー、完全なサポートスタック:ベースモデリング (#48799),ピースワイドCUDAグラフサポート (#48822),ホッパーFA4相対注意 (#48858),MTP=1憶測解読 (#48869),LoRA (#48884),標準モデルオプトNVFP4量子化 (#48990).ディープサーチV4の性能は。..

V
vLLM AI v0.25.1

v0.25.1

vLLM v0.25.1 ハイライト このリリースには2人の貢献者からの2つのコミットメント (1個新しい) が含まれています!v0.25.1は、v0.25.0の上に2つの標的バグ修正が含まれているパッチリリースです。バグ修正 TorchCodec (#47888) のためにシステムFFmpegが利用できない場合にモデル起動をブロックすることを避ける。以前は import torchcodec で、システムFFmpegが欠落したときに、ランタイムエラーが発生し、起動がブロックされました (例えば、待って。..

V
vLLM AI v0.25.0

v0.25.0

vLLM v0.25.0 リリースノート ハイライト このリリースには、232人の貢献者 (64人の新規) から558件のコミットが含まれています!モデルランナー V2 は、すべてのデントモデル (#44443) のデフォルトになっています。前回のリリースからの量子モデルサポートを基に、MRv2は、EVS (#46535),リアルタイムエンベッディング (#46762),Mambaハイブリッドモデル (#42406),マルチモダル-p...

V
vLLM AI v0.25.0rc3

v0.25.0rc3

[P/D][Bugfix] MTPスペックでPDアシンクロ KV負荷の見出しヘッド処理を修正する。..

V
vLLM AI v0.25.0rc2

v0.25.0rc2

トランスフォーマーモデリングバックエンド (#4...

V
vLLM AI v0.25.0rc1

v0.25.0rc1

[CPU][バグ修正] ARMで短コンブプレフィールテストを修正 (初期化されていない。..

V
vLLM AI v0.24.0

v0.24.0

vLLM v0.24.0 リリースノート ハイライト このリリースには、 256人の貢献者 (77人の新規) から 571件のコミットメントがあります!MiniMax-M3:新しいMiniMax-M3モデル (#45381) のサポートを追加し、MSA (#45892),MXFP4サポート (#45896),FP8稀有GQA (#45744) によるBF16/FP8インデクサーの迅速なフォローアップ、MI300X45 (#854) のbf16重量のためのfp8_per_channel,および広範なAMD/ROCmチューニング

V
vLLM AI v0.23.0

v0.23.0

vLLM v0.23.0 リリースノート このバージョンではまだ Minimax M3 がサポートされていないことに注意してください。M3の使用ガイドの vLLM レシピに従ってください。このリリースには200人の貢献者 (63人の新規) から408件のコミットメントがあります!DeepSeek-V4はバックエンド全体で成熟: DeepSeek-V4は、v0.22.0で導入された後、また大きな硬化と最適化パスを受けました。MLAのメタデータも 薄いので。..

V
vLLM AI v0.22.1

v0.22.1

このリリースには6人の貢献者から8つのコミットメント (1個新しい) が含まれています。v0.22.1は、JetBrainsのMellum v2の新しいモデルサポート、AMD Zen CPUのzentorch加速量子化線形推論、およびマルチノードRayデータ並行配送、DeepSeek-V4初期化、いくつかのモデルロード回帰の修正。モデル。..