O

ONNX Runtime

O
ONNX Runtime AI v0.2.1

ONNXランタイム WebGPUプラグイン EP v0.2.1

注意を重くするLLMにおける主要業績作業を強調する。FlashAttention の解読カーネルは、任意のシーケンス長 (#28389) に統合され拡張された。FlashAttention の共有メモリ パスが一般化されました (#28520).NVIDIA (#28511) で動的 max_k_step が有効になりました。MultiHeadAttention (#28380) に FlashAttention の QKV バイアス サポート が追加されました。M4 Max 専用の FlashAttention 最適化が着陸しました (#2...

O
ONNX Runtime AI v1.28.0

ONNXランタイム v1.28.0

ONNX 1.22.0とprotobuf 6.33.5 (#28754, #29606, #28967) にアップグレードしました。グラフ最適化器のオプセットバージョンチェックは、それに応じて (#28966) 更新されました。cuDNNとcuFFTはCUDA EPの実行時にオプションで、nvrtcはもはやリンクされていないため、必要なCUDA再配布可能なフットプリント (#29252, #29808, #29705, #29620) が大幅に減少している。C/C++の実験的な API...

O
ONNX Runtime AI v1.27.1

ONNXランタイム v1.27.1

これは v1.27.0 の上に patch のリリースで、標的バグ修正、CUDA QMoE 解読経路最適化、CI/ビルドインフラストラクチャの修正が含まれています。バグ修正 [MLAS] KleidiAI経路 (#28571) の igemm 回帰を修正 嵌入式内操作並列性を排除することによって QMoE CPU ライヴロック (#29081) を修正 グラフキャプチャセッション初期化で回帰を修正 空のグラフ (#29457) を拒否した 修正。..

O
ONNX Runtime AI v1.27.0

ONNXランタイム v1.27.0

N.b.このリリースでは ONNX 1.21.ONNX 1.22 は ORT 1.28 でサポートされます。N.b.このチェンジログは LLM で生成されました協力者のリストのみが確認されましたいつものように、コミット履歴を信頼してください。CUDA 12 パッケージファイルは、現在、明示的にそのように命名されています。CUDA 12 パッケージは廃止されています。 CUDA 13に移動してください。セキュリティの修正 制限外の修正。..

O
ONNX Runtime AI v0.1.0

ONNXランタイム WebGPUプラグイン EP v0.1.0

ONNX Runtimeのプラグイン EPとして WebGPU Execution Provider の初リリースを発表しますWebGPU EPは、core onnxruntimeバイナリに組み込まれることなく、実行時に既存のONNX Runtimeインストールに登録するスタンドアロンアーテファクトとして配布される。WebGPUの広範なオペレーターカバーを強調する。ウェブGPUカーネルを 共有する。..

O
ONNX Runtime AI v1.26.0

1.26.0 について

N.b.次の図は Git の歴史から LLM を使って生成されました協力者のリストのみが確認されましたONNX ランタイムリリース 1.26.0 発表 - 変更変更 CUDA 12 のサポートは 1.27.0 で削除されます。CUDA 13 は onnxruntime-<os>-<arch>-gpu_cuda13-<version>として引き続き公開される。<ext> CUDA の実行時間は、公開されたパ。..

O
ONNX Runtime AI v1.25.1

ONNXランタイム v1.25.1

N.b.このチェンジログはLLMで生成されました協力者のリストのみが確認されましたONNXランタイムリリース 1.25.1 発表・変更 ONNX オプデート 新しいオプセットバージョンで ONNX オペレーターサポート強化: Reshape (opset 25), Transpose (opset 24) (#27752) ✨ 新しい機能 新しいONNX オプス&モデルサポート 線形注意と因果ConvState Qwen3.5モデルサポート (#27907) Ro...

O
ONNX Runtime AI v1.25.0

ONNXランタイム v1.25.0

アナウンス&ブレイキング 変更 ビルド&プラットフォーム C++20 は、ソースからONNXランタイムを構築するために必要になります。最低ツールチェーン:MSVC 19.29+,GCC 10+,Clang 10+.プリビルドパッケージのユーザーは影響を受けません(#27178) CUDA 最低バージョンが 12.0 にアップされた CUDA 11.x はもはやサポートされていません。CUDA 11.x に固定されているユーザーは、ORT 1.24.x に留まるか、CUDA ツールキット/ドライバをアップグレードする。ONNXがアップグレードした。..

O
ONNX Runtime AI v1.24.4

ONNXランタイム v1.24.4

これは ONNX Runtime 1.24 のパッチリリースで、バグ修正と実行プロバイダ更新が含まれています。バグ修正コア:nvidia-drmが読み込まれておらず、GPU PCIデバイスがまだsysfsで露出しているコンテナ化された環境 (例えばAKS/Kubernetes) でLinux GPU デバイス発見のためのPCI バスバックを追加。(#27591) プラグイン EP: GetOutputIndex で出力範囲を繰り返すときにゼロポインタのデレフェランスを修正。...

O
ONNX Runtime AI v1.24.3

ONNXランタイム v1.24.3

これはONNXランタイム1.24のパッチリリースで、バグ修正、セキュリティ改善、パフォーマンス強化、実行プロバイダ更新が含まれています。セキュリティ 修正 コア: ハイプの読み/書き込みを制限する GatherCopyData の整数切断を修正。(#27444) コア: チェックされていないバッチ_インデックスで読み取れる RoiAlign ハープの境界外を固定した。#275433 核:悪意あるLora Adから OOBの堆積を防止する。..

O
ONNX Runtime AI v1.24.2

ONNXランタイム v1.24.2

これはONNXランタイム1.24のパッチリリースで、いくつかのバグ修正、セキュリティ改善、実行プロバイダ更新が含まれています。NuGetのバグ修正: Linux と macOS の ONNX ランタイム NuGet パッケージのネイティブ ライブラリ 読み込みの問題が修正されました。(#27266) macOS: macOS ARM64でJavaサポートとJarテストを修正しました。(#27271) コア: Huggingface ハブキャッシュの外部データに対する強固なシンブルリンクサポートを有効にする。#27...

O
ONNX Runtime AI v1.24.1

ONNXランタイム v1.24.1

発表・最新情報 プラットフォームサポート変更 Python 3.10のホイールが公開されなくなりました Python 3.11+ Python 3.14へのアップグレードをお願いします フリースレッド Python (PEP 703) のサポートが追加されました Linux (#26786) の Python 3.13t と 3.14t のサポートが追加されました macOS/iOS のx86_64 バイナリが提供されなくなり、最小 macOS は 14.0 API バージョンにアップグレードされました ORT_API_VERSION が 24 (#41268) に更新されました ✨ 新しい。..

O
ONNX Runtime AI v1.23.2

ONNXランタイム v1.23.2

ORT 1.23.2 cherrypick 1 (#26368) ORT 1.23.2 のリリース-1.23.2 ブランチに以下のコミットを追加する: - [TensorRT] エンジン更新中にDDS出力バグを修正する - PR: #26272 - commit id: 00e85dd - In-memory 外部データで形状推論の失敗を修正する - PR: #26263 - commit id: d955476 - [CUDA] 90a-virtualを前向き互換性のために90-virtualに置き換える - PR: #26230 - commit id: b58911f - [QNN-EP] 修正。..