H

Hugging Face Diffusers

H
Hugging Face Diffusers AI v0.39.0

ディフューザー 0.39.0: 新しい画像とビデオパイプライン、コアライブラリの改良、その他

New Pipelines Cosmos 3 コスモス3は、NVIDIAのフィジカルAIのための統一世界基盤モデル (WFM) であり、以前のコスモスリリースからの別々のPredict,Reason,およびTransferモデルを置き換え、世界生成、物理的推論、アクション生成を組み合わせるMixture-of-Transformers (MoT) アーキテクチャに構築された単一のオムニモデルです。単一のコスモス3オムニトランスフォーマーで QWEN 式言語モデ。..

H
Hugging Face Diffusers AI v0.38.0

ディフューザー 0.38.0: 新しい画像とオーディオパイプライン、コアライブラリの改良、その他

新しいパイプライン LLaDA2 LLaDA2は、ブロックサイズの繰り返しの精製を通じてテキストを生成する離散拡散言語モデルの家族です。自動回帰的なトークンごとにトークン生成の代わりに、LLaDA2は完全にマスクされたシーケンスから始まり、複数の精製ステップで信頼によって徐々にトークンを解明します。PR: #13226 ドキュメント: https://huggingface.co/docs/diffusers/main/api/pipelines/llada2 Nucleu...

H
Hugging Face Diffusers AI v0.37.0

ディフューザー 0.37.0:モジュール式ディフューザー、新しい画像とビデオパイプライン、複数のコアライブラリの改良、その他

モジュラーディフューザーは、再利用可能なブロックを組んで拡散パイプラインを建設する新しい方法を導入します。パーソナライズされたワークフローを 作り出すことができますこれは、既存の DiffusionPipeline クラスを補完し、カスタム diffusion パイプラインを作成するためのより柔軟な方法を提供します。もっと調べて。..

H
Hugging Face Diffusers AI v0.36.0

ディフューザー 0.36.0: パイプラインが豊富、新しいキャッシング方法、トレーニングスクリプト、その他

このリリースには多くの新しい画像とビデオパイプライン、新しいキャッシング方法、新しいトレーニングスクリプト、新しいカーネル駆動の注意バックエンドなどがあります。リリースノートを完全に読むことを確認してください 新しい画像パイプライン Flux2: Flux2はブラックフォレストラボの最新世代の画像生成と編集モデルです。複数の。..

H
Hugging Face Diffusers AI

トランスフォーマーモデル、輸入、

すべてのコミットリリース: v0.35.1-パッチ @sayakpaul (v0.35.2-パッチで直接コミット) 処理 offload_state_dict トランスフォーマーモデルを起動するときに @sayakpaul #12438 [CI] 修正 TRANSFORMERS_FLAX_WEIGHTS_NAME 輸入問題 @DN6 #12354 修正 PyTorch 2.3.1 互換性: トーチ。ライブラリのためのバージョンガードを追加。... @Aishwarya0811 #12206 修正 scale_shift_factor は wan と ltx の CPU に存在している @vladmandi...

H
Hugging Face Diffusers AI v0.35.0

ディフューザー 0.35.0:Qwen イメージパイプライン、フルックスコンテキスト、Wan 2.2 など

新しい画像生成と編集パイプライン、新しいビデオパイプライン、新しいトレーニングスクリプト、生活の質の改善、そしてさらに多くのものがあります。楽しい内容を見逃さないために リリースノートの残りの部分を完全に読んでください。新しいパイプライン このリリースでは新しいパイプラインを歓迎しました: Wan 2.2 フルックスコンテキスト Qwen-画像 Qwen-画像編集 Wan 2.2 このWanの更新は重要な改善をもたらします。..

H
Hugging Face Diffusers AI v0.34.0

ディフューザー 0.34.0: 新しい画像とビデオモデル、より良いtorch.compileサポート、その他

新しいビデオ生成パイプライン Wan VACE Wan VACEは制御可能なビデオ生成を実現するさまざまな生成技術をサポートします。1.3Bモデルが高速な繰り返し&プロトタイプ作成と 14Bモデルが高品質な生成に利用できます機能の一部は: ビデオへの制御 (深さ、ポーズ、スケッチ、フロー、グレイスケール、スクリブル、レイアウト、境界ボックスなど).図書館の推薦。..

H
Hugging Face Diffusers AI v0.33.0

ディフューザー 0.33.0: 新しい画像とビデオモデル、メモリ最適化、キャッシング方法、リモートVAE,新しいトレーニングスクリプトなど

Wan2.1は、ビデオ生成の限界を押し広げ、包括的でオープンなビデオ基盤モデルです。モデルリリースには4つの異なるモデルバリエーションとテキストからビデオ、画像からビデオ、ビデオからビデオの3つの異なるパイプラインが含まれています。WAN-AI/WAN2.1-T2V-1.3B-ディフューザーWAN-AI/WAN2.1-T2V-14B-ディフューザーWAN-AI/WAN2.1-I2V-14B-480P-ディフューザーW...