P

PyTorch

P
PyTorch AI

viable/strict/1789588240: miopen_batch_norm分解をコアテーブル (#197160) に移動する

DTensorのシャードングプロパゲーターには aten.miopen_batch_norm の戦略がないため、シャードされた 4D 入力上の F.batch_norm は ROCm で失敗し",オペレータ aten.miopen_batch_norm.default にはシャードング戦略が登録されていません".CUDAは、 aten.cudnn_batch_norm がtorch/_decomp で分解しているため、DTensor の DecompSharding Strategy に戻ってくるので、同値に決して到達しません。ROCmの分解は。..

P
PyTorch AI

viable/strict/1789577445: [BE] XPUのホイールを1つのランナーで構築する (#195699)

#188136を担当するすべての Linux XPU manywheel バリアントを1つの作業で構築し、 Python バージョン全体で ABI 独立 C++/SYCL アーテファクトを再利用し、インタープリターごとに Python 結合アーテファクトを再構築する。前と後の 8 つの XPU マトリックスビルドを、この PR の統一ビルドと比較する。 34123506914 を実行する。 Linux XPUビルドのランナー分前 (Python マトリックス、 8 つの仕事) 後。..

P
PyTorch AI

viable/strict/1789559427: Xe2+ (#197210) のtorch.xpu.utilization (t.xpu.utilization) に対するエラーメッセージを修正する

モチベーション 私たちは#196950でBMGで pyzesテストを有効化すると、zesDeviceEnumEngineGroupsが pyzes.ZE_RESULT_ERROR_INSUFFICIENT_PERMISSIONSで失敗すると発見しました。これはXeアーチとは異なる論理ですレベル0のシスマンは 次のバージョンで修正するこの論理をPyTorch側で一時的に処理します。この修正により:テストはスキップされます。そうでなければ、ランタイムエラーで失敗します。

P
PyTorch AI

持続可能/厳格/1789554516

[テストケースリファクタリング] テストのためのデバイスアグノスティックテストクラスを分類。..

P
PyTorch AI

viable/strict/1789552248: [MPS] 固定ランドと均等_ 上限丸め (#197081)

== に値を加えることで?から: 値 ternary の終わりに static_cast<bfloat> の誤った排除を防ぐために、変形性を使用してください。 下の再生器を参照してください。 import torch lib = torch.mps.compile_shader (("""#include <metal_stdlib> using namespace metal; bfloat volcast(volatile float x) { return static_cast<bfloat>(x); } kernel void repro_bug ((デバイス bfloat* out, constant float2& 境界、 constant float* サンプル、...

P
PyTorch AI

トランク/5038832e12e07068a5231c3e9e6c9700fcc98ca8: [MPS]固定ランドと均等_上限丸め (#197081)

== に値を加えることで?から: 値 ternary の終わりに static_cast<bfloat> の誤った排除を防ぐために、変形性を使用してください。 下の再生器を参照してください。 import torch lib = torch.mps.compile_shader (("""#include <metal_stdlib> using namespace metal; bfloat volcast(volatile float x) { return static_cast<bfloat>(x); } kernel void repro_bug ((デバイス bfloat* out, constant float2& 境界、 constant float* サンプル、...

P
PyTorch AI

trunk/23341ddcfe7cc4813eb7ef760847d9b786336e1e: [ダイナモ] TestCase (#195662) でテストの間での自動キャスト状態を復元する

#195487を修正するtorch._dynamo.test_case.TestCase.setUp/tearDownは、torch.is_grad_enabledを既にスナップショットし、テストが変更された場合、 (警告付き) tearDownで復元しますが、自動キャストに相当するものはありません。オートキャスト状態の4つの部分 - - 有効、dtype,cache_enabled,そしてネスティングカウンタ - - はテストの終了後、次に実行されるテストに存続しますこの状態を漏らすテスト (...

P
PyTorch AI

trunk/542330ebe79bfc3e9275d7610f9adcf489e3abf9: 固定されたスケールMM DeepSeek インデックスと収縮検証 (#197028)

人文注釈 私はこれを繰り返しブラックウェルCIエージェントの注目に失敗していることに気付いた。 DeepSeek Tritonメインループは、128x128スケールを拡張するときに、GEMMブロックよりも小さいタイルのために、長階スケールインデックスが間違って、および外側/K寸法が交わされていることを仮定した。実際の歩みと論理軸を尊重し、 要素の偏移からスケール座標を計算し、

P
PyTorch AI

実行可能/厳格/1789545173: [cuda][nccl] 死者の腕を落とす NCCL_ALLTOALL_SUPPORTED

概要: NCCL_ALLTOALL_SUPORTED はレポのどこにも定義されていません。D115674668 ("[ncclx][fix-build] Remove NCCL_ALLTOALL_SUPPORTED macro") は、nccl.h.in の v2_29 と v2_30 の両方で、特に新しい NCCLX に基づいて構築された古い PyTorch が、大文字T ncclAllToAll API を選択するのを停止するように、nccl.h.in から # define を削除しました。定義された項目 (NCCL_ALLTOALL_SUPORTED) は、現在 al...

P
PyTorch AI

viable/strict/1789540965: ハンドラー認証ロジック (#196102) を更新する

パイテストを使いますpython test_logging.pyの代わりに pytest test_logging.pyを使用しています初期コードは:log_qname in log_internal.log_registry.get_log_qnames (():logger = logging.getLogger ((log_qname) created_handlers.update ((logger.handlers) self.assertEqual (((lenlogger.handlers), 2,f"{log_qname}にはストリームとファイルハンドラーのみがあるべきです")) すべてのアクティ。..

P
PyTorch AI

trunk/57914c6e94732191855bd7f1da207f16052d5859: ハンドラー認証ロジック (# 196102) を更新する

パイテストを使いますpython test_logging.pyの代わりに pytest test_logging.pyを使用しています初期コードは:log_qname in log_internal.log_registry.get_log_qnames (():logger = logging.getLogger ((log_qname) created_handlers.update ((logger.handlers) self.assertEqual (((lenlogger.handlers), 2,f"{log_qname}にはストリームとファイルハンドラーのみがあるべきです")) すべてのアクティ。..

P
PyTorch AI

trunk/576a6d8db7b7d07d4955b833d7ac56c0500d1e05: [meta] 非正のピクセル_シャッフル/アンシャッフル因数 (#195224) を拒否する

#153327 の修正 Eager は native_functions の非正因子を拒絶する: RuntimeError: pixel_shuffle は正のアップスケール_ファクタを期待しているが、0 を得ている。 メタ登録と _refs の分解は決して同じチェックを得ていないので、代わりに因子で割る: パスファクター = 0 因子 = -2 eager RuntimeError: ...正のアップスケール_ファクタ、しかし 0 を得ている RuntimeError: ...しかし -2 メタ_ピクセル_シャッフル ZeroDivi を得ている。..