H

Hugging Face Text Generation Inference

H

v3.3.7

misc(gha): @mfuntowicz で #2964 の秘密としてアクションキャッシュ url と実行時間を暴露 feat: @drbh で #3339 で @drbh で max_image_fetch_size を制限するサポート @LysandreJik で #33344 で @LysandreJik で #3345 で #3345 で メンテナンスモードで #3345 で 修正 (((num_devices): NVIDIA_VISIBLE_DEVICES == "all" または "void" のとき num_shard / num デバイスの自動計算を修正する #3346 で @oOraph で 完全な変更ログ: v3.3.6...v3.3.7

H

v3.3.6

変更点 追加 欠落したバックスラッシュ @philsupertramp in #3311 "feat: bump flake including transformers and huggingface_hub versions" by @drbh in #3323 修正: azure を削除 @drbh in #3325 @danieldk in #3324 flashinfer に渡されたマスクを修正 ストリーミングデモのためのiframeソースを更新 @coyotte508 in #3327 "Revert "feat: bump flake including transformers and huggingfa... by @drbh in #3327...

H

v3.3.5

変更点 [ガウディ] ロープメモリを洗練し、レイヤごとに sin/cos キャッシュを保存する必要はありません。 @sywangyi in #3274 ガウディ: @baptistecolle in #3160 の CI を追加 [ガウディ] Gemma3 スライディングウィンドウサポート @sywangyi in #3280 xpu lora サポート @sywangyi in #3232 Optimum neuron 0.2.2 @dacorvo in #3281 [ガウディ] 不必要を削除 異性NextTokenChooser に再起動する @sywangyi in #3284 [ガウディ]...

H

v3.3.4

batch_size 1 で輸出された Neuron モデルの修正。[ガウディ] Gemma3テキストとVLMモデル初期サポート@sywangyi @dacorvo @dacorvo @dacorvo @dacorvo @dacorvo @dacorvo @dacorvo @dacorvo #dacorvo #dacorvo #dacorvo #dacorvo #dacorvo #dacorvo #dacorvo #dacorvo

H

v3.3.3

ニューロンバックエンド更新何が変わったか 役に立たないパッケージを削除する @yuanwu2017 in #3253 Bump neuron SDK バージョン @dacorvo in #3260 Perf opt by @sywangyi in #3256 [gaudi] Vlm リベースと問題修正 ベンチマークテストで @sywangyi in #3263 _update_cos_sin_cacheを get_cos_sin に移動する @yuanwu2017 in #3254 [Gaudi] Optimum-habana を削除する @yuanwu2017 in #3261 [gaudi] HuggingFaceM4/idefics2-8b 問題を。..

H

v3.3.2

ガウディの改良What's Changed 新しい vllm拡張 ops にアップグレードする (###############################################################################################################################################################################################################################################

H

v3.3.1

このリリースではTGIをTorch 2.7とCUDA 12.8に更新しています。変更点 HPU ウォームアップ ロジック: seq 長さは @kaixuanliu に関する指数関数的な増加でなければならない #3217 に関する。.. @kaixuanliu に関する #3224 に関する ウォームアップ 段階に準拠するように round_up_seq ロジックを調整する #3221 に関する @danieldk に関する Torch 2.7.0 に更新する #3221 に関する @yuanwu2017 に関する #3221 に関する Llama4 を有効にする #3223 に関する #3223 に関する 修正: NVIDIA_VISIBLE_DEVICE に関する gpu uuids をカウントする。..

H

v3.3.0

注目すべき変更は、VLMのプリフイル・チャンキングである。Qwen 2.5 VL (32B) を固定する変更は?@Narsil in #3157 https://github.com/huggingface/text-embeddinのようなトークネジゼーションを修正する。.. @Narsil in #3156 Gaudi: hpu バックエンドでクリーン cuda/rocm コード、 flat_hpu を有効に @sywangyi in #3113 L4 の修正 @mht-sharma in #3161 setuptools <= 70.0 は脆弱です: CVE-2024-6345 by @Narsil in #3171 トランスフォーマーフラッシュ llm...

H

v3.2.3

主な変更 パッチ付け Llama 4 何が変わったか ROCM 6.3.1 を使用する @mht-sharma in #3141 トランスフォーマーを 4.51 に更新する @mht-sharma in #3148 ガウディ: ガウディ バックエンドのための統合テストを追加する @baptistecolle in #3142 修正: 計算タイプタイプミスをする @oOraph in #3150 3.2.3 by @Narsil in #3151 完全変更ログ: v3.2.2...v3.2.3

H

v3.2.2

変更されたものは 修正されます@Narsil in #3125 設定可能な終了タイムアウト @ErikKaum in #3126 CI: バックエンドのサーバーテストを有効に @baptistecolle in #3128 Torch 2.6 by @Narsil in #3134 Gaudi: llava-nextとmllamaクラッシュの問題を解決する @yuanwu2017 in #3127 nix-v3.2.1 -> v3.2.1-nix by @co42 in #3129 Gaudi: BATCH_BUCKET_SIZE を @yuanwu2017 で置き換える指数関数的な成長を使用する