P

PyTorch

P
PyTorch AI

viable/strict/1785584542: run_test.py ログ (#191754) で終了したテストの名前

テストのタイムアウトが表示される時 CI ログには タイムアウトが表示される線に タイムアウトが表示されるものを 特定する方法がありませんretry_shell prints コマンドは30分以上かかり 124を返します リストは何も表示しませんので ログクラシファーは1行だけ選び HUDのグループキーとしてそのキャプチャを使用します試行錯誤したファイルは 見えません

P
PyTorch AI

viable/strict/1785574758: MPS maxBufferLengthゲティング (#191751) のために largeMPSBufferTestを追加する

test_reductions_large_half_tensorsは、trunk macos-py3-arm64デフォルトシャードで、commit-induced (隣接する2つのSHAが赤、緑) のように見えていましたが、実際にはスキップゲートです。ルーツ原因:テストは largeTensorTest (("8GB") によってゲートされています。 MPSでは psutil.virtual_memory (().可用 >= 8GiB に縮小されます。16GBの m1 安定ランナーで 門戸のすぐ近くで スキップが発射されるか。..

P
PyTorch AI

trunk/2264afc35b2a313e9d20a18430a50a6a3e5991fd: isFwGradの過負荷を追加する オプション ctor (#191813) を避けるために定義

isFwGradDefinedはtorch/csrc/autograd/generated/VariableType*で多くのことを呼びます。これらの呼び出しの多くは、関数にテンソーを渡します。この機能の初期実装では 選択的な機能のみが認められましたこれは、その関数が呼び出されるたびにオプションコンストラクタへの呼び出しを強制し、後でオプション::has_value (は) に不要な呼び出しを強制した。このコンミットにより、テンソールを受け入れるオーバーロードが追加されます。わかった。..

P
PyTorch AI

trunk/b01be4f06bd0ebaaea0a5ca5c2bca5783e8209bb: [ダイナモ] Wrap module.compile leaf module コールフレーム (#185722)

module.compile() はtorch.compile ((self._call_impl) をインストールします。Conv2d などの組み込みリーフモジュールでは、Module._call_impl とモジュールフォワードの両方がスキップルールのファイルに表示されます。torch.compile ((module) パスは既に、wrap_inline でスキップルルがある先のモジュールをラッピングすることでこれを処理していますが、 module.compile (()) は _call_impl をトップレベルのラッピングから除外しました。撮影できるフレームが なかったので カスタム。..

P
PyTorch AI

トランク/46b20026392d0c98b45a0a1c96d75bd823353169: [c10d] 全部の分割サイズ (#191511) を検証する

nccl2 オール・トゥ・オール パスは、分割サイズを直接サインされていない値に投影し、両方の分割リストが空だった場合にのみ正規化しました。ネガティブな値が NCCLに届きましたGlooとstock NCCLは、両方のリストが空であるときにリード次元検証を回避し、テンソールを次元ゼロに沿って分割しない等分を許可した。C10Dの分割チェックを Eveに適用する。..

P
PyTorch AI

trunk/1edebe6d2f83b6d319609e1c211abdd3936c3488: [CI] TVMドッカー画像ビルド (#191710) を修正するために apache-tvm-ffiをピンします。

TVM対応画像 (pytorch-linux-jammy-py3.{11,12,13}-clang21) のDockerビルドをブロックする #190927 を解凍するには、OSエラー: .../tvm/lib/libtvm_runtime.so: undefined シンボル: _ZN3tvm3ffi4json9StringifyERKNS0_3AnyENS0_8OptionalIivEE ルーツ原因は浮き放たれる自由に残された移行依存関係です。#190799 アパッチ-tvm==0.25.0.post1を固定した しかし、そのパッケージはアパッチを宣言。..

P
PyTorch AI

ciflow/slow/191816: GPU CI ランナーでのみ test_vec_compare_op_cpu_をスキップする

このテストは純粋なCPUベクトリ化コードゲンで、2x9CPUテンソール上で比較操作をコンパイルし、生成された_cpp_vec_kernel_countを主張します。CUDA カーネルが起動することはありませんCUDA sm86のスローシャードで動作し、 a10g GPUがイドリング状態で ~57分 (測定 3429s と 3489s) かかります。 CI のテスト選択は、デバイスごとにではなくビルドコンフィギュレーションごとに行われます。

P
PyTorch AI

trunk/70147dd482f51f736c227969bf0e5b147c893b22: コムス (#189069) を通して TorchComms の所有のバックエンドのみをルートする

概要: _torchcomms_handles_backend() を追加し、TorchComms パスをゲート (init_process_group バックエンドの自動資格と _new_process_group_helper) に追加する。独自のc10dプラグインは持っていないので、 new_comm を強制する代わりに、ネイティブのc10d作成経路を維持します。is_backend_built を使ってバックエンドを報告する。動的に登録されたアダプター r...