O

ONNX Runtime

O
ONNX Runtime AI v1.30.0

ONNXランタイム v1.30.0

ONNX Runtime 1.30.0は、生成的なAI推論を拡張し、CPUとGPUのパフォーマンスを向上させ、Goバインディングを追加し、ランタイム信頼性を強化します。このメモは、ONNXランタイム 1.29.1以降の変更をカバーします。ハイライト 継続的なバッチングのための変数長因果回転、ページ付きXQAの憶測解読、およびチャンネル単位スケール (#32168, #323...

O
ONNX Runtime AI v1.29.1

ONNXランタイム v1.29.1

これは GroupQueryAttention 機能と KV-キャッシュレイアウトの改善、プラグイン Execution Provider 性能ツール更新、ターゲットグラフと最適化修正を含む v1.29.0 の上のパッチリリースです。GroupQueryAttention サポートされていない実行経路の明示的な処理を備えた、バックバック互換性のある因果属性を通じて、CPUとCUDAに対する双方向の GroupQueryAttention サポートを追加。..

O
ONNX Runtime AI v1.28.2

ONNXランタイム v1.28.2

これは v1.28.1 の上に patch のリリースで、Compile API モデルのシリアライゼーションのターゲット修正が含まれています。ハイライト バグ修正 修正 複製されたグラフノード、入力、出力、および最適化されたモデル、組み込みまたは外部初期化器 (#32303) を搭載したモデルを含む値情報の重複を防ぐため、コンパイル API コールバックシリアライゼーションを修正 貢献者 このリリースのための貢献者に感謝!@アドラスト。..

O
ONNX Runtime AI v0.3.0

ONNXランタイム WebGPUプラグイン EP v0.3.0

ONNX Runtime WebGPU Plugin EP 0.3.0は、モデルとデータ型カバーを拡大し、生成モデルパフォーマンスを向上させ、構成、信頼性、リリースツールを強化します。このリリースノートは AIの助けで作成されましたハイライト モデルとオペレーターのカバー 初期 PagedAttention サポート、MRotaryEmbedding,GRU,DFT,PRelu,HardSwish,Trilu,Max and Min,およびMatMulBnb4が追加されました。#31611, #...

O
ONNX Runtime AI v1.28.1

ONNXランタイム v1.28.1

これは v1.28.0 の上に patch のリリースであり、デバイスフリー WebGPU コンパイル、サンドボックス化された Windows プロセスとの互換性の改善、および標的化されたグラフ検証の修正を含む。WebGPU EP デバイスフリーコンパイル専用セッションのサポートが追加され、GPUハードウェア (#29681) にアクセスすることなくオフライングラフ変換と最適化されたモデルシリアライゼーションを可能にしました バグ修正 アクセス違反を防止。..

O
ONNX Runtime AI v0.1.0

ONNXランタイム CUDAプラグインEP 0.1.0

これはONNX Runtime CUDA Plugin EPの最初のリリースで、CUDA実行は別々にパッケージ化されたプラグイン実行プロバイダーとして提供されています。このノートは、CUDA Plugin EP コアコード、CMake 統合、およびその主要なビルドおよびパッケージパイプラインに影響を与えるコミットをカバーします。使用方法については QUICK_START.md を参照してください。プラグインの実行時間をハイライトします CUDAプラグイン EPコアを導入し、デフォルトの CUDA プロ。..

O
ONNX Runtime AI v1.29.0

ONNXランタイム v1.29.0

アナウンス&ブレイキング 変更 onnxruntime-web は WebGL と JSEP の廃止を発表した。WebGPU EPのネイティブ版は、今後も推奨される方法です。詳細については、廃品と移行計画 (#29716, #31683) を参照してください。POSIXテレメトリは、ONNXランタイムがテレメトリを有効に構築された場合、Linux,macOS,Android,iOSで利用できます。WebAssemblyは残っています。

O
ONNX Runtime AI v1.26.0

ONNXランタイム v1.26.0

N.b.次の図は Git の歴史から LLM を使って生成されました協力者のリストのみが確認されました発表 - 変更変更 CUDA 12 のサポートは 1.27.0 で削除されます。CUDA 13 は onnxruntime-<os>-<arch>-gpu_cuda13-<version>として引き続き公開される。ハイリグ。..

O
ONNX Runtime AI v0.2.1

ONNXランタイム WebGPUプラグイン EP v0.2.1

注意を重くするLLMにおける主要業績作業を強調する。FlashAttention の解読カーネルは、任意のシーケンス長 (#28389) に統合され拡張された。FlashAttention の共有メモリ パスが一般化されました (#28520).NVIDIA (#28511) で動的 max_k_step が有効になりました。MultiHeadAttention (#28380) に FlashAttention の QKV バイアス サポート が追加されました。M4 Max 専用の FlashAttention 最適化が着陸しました (#2...

O
ONNX Runtime AI v1.28.0

ONNXランタイム v1.28.0

ONNX 1.22.0とprotobuf 6.33.5 (#28754, #29606, #28967) にアップグレードしました。グラフ最適化器のオプセットバージョンチェックは、それに応じて (#28966) 更新されました。cuDNNとcuFFTはCUDA EPの実行時にオプションで、nvrtcはもはやリンクされていないため、必要なCUDA再配布可能なフットプリント (#29252, #29808, #29705, #29620) が大幅に減少している。C/C++の実験的な API...

O
ONNX Runtime AI v1.27.1

ONNXランタイム v1.27.1

これは v1.27.0 の上に patch のリリースで、標的バグ修正、CUDA QMoE 解読経路最適化、CI/ビルドインフラストラクチャの修正が含まれています。バグ修正 [MLAS] KleidiAI経路 (#28571) の igemm 回帰を修正 嵌入式内操作並列性を排除することによって QMoE CPU ライヴロック (#29081) を修正 グラフキャプチャセッション初期化で回帰を修正 空のグラフ (#29457) を拒否した 修正。..

O
ONNX Runtime AI v1.27.0

ONNXランタイム v1.27.0

N.b.このリリースでは ONNX 1.21.ONNX 1.22 は ORT 1.28 でサポートされます。N.b.このチェンジログは LLM で生成されました協力者のリストのみが確認されましたいつものように、コミット履歴を信頼してください。CUDA 12 パッケージファイルは、現在、明示的にそのように命名されています。CUDA 12 パッケージは廃止されています。 CUDA 13に移動してください。セキュリティの修正 制限外の修正。..

O
ONNX Runtime AI v0.1.0

ONNXランタイム WebGPUプラグイン EP v0.1.0

ONNX Runtimeのプラグイン EPとして WebGPU Execution Provider の初リリースを発表しますWebGPU EPは、core onnxruntimeバイナリに組み込まれることなく、実行時に既存のONNX Runtimeインストールに登録するスタンドアロンアーテファクトとして配布される。WebGPUの広範なオペレーターカバーを強調する。ウェブGPUカーネルを 共有する。..

O
ONNX Runtime AI v1.25.1

ONNXランタイム v1.25.1

N.b.このチェンジログはLLMで生成されました協力者のリストのみが確認されましたONNXランタイムリリース 1.25.1 発表・変更 ONNX オプデート 新しいオプセットバージョンで ONNX オペレーターサポート強化: Reshape (opset 25), Transpose (opset 24) (#27752) ✨ 新しい機能 新しいONNX オプス&モデルサポート 線形注意と因果ConvState Qwen3.5モデルサポート (#27907) Ro...

O
ONNX Runtime AI v1.25.0

ONNXランタイム v1.25.0

アナウンス&ブレイキング 変更 ビルド&プラットフォーム C++20 は、ソースからONNXランタイムを構築するために必要になります。最低ツールチェーン:MSVC 19.29+,GCC 10+,Clang 10+.プリビルドパッケージのユーザーは影響を受けません(#27178) CUDA 最低バージョンが 12.0 にアップされた CUDA 11.x はもはやサポートされていません。CUDA 11.x に固定されているユーザーは、ORT 1.24.x に留まるか、CUDA ツールキット/ドライバをアップグレードする。ONNXがアップグレードした。..

O
ONNX Runtime AI v1.24.4

ONNXランタイム v1.24.4

これは ONNX Runtime 1.24 のパッチリリースで、バグ修正と実行プロバイダ更新が含まれています。バグ修正コア:nvidia-drmが読み込まれておらず、GPU PCIデバイスがまだsysfsで露出しているコンテナ化された環境 (例えばAKS/Kubernetes) でLinux GPU デバイス発見のためのPCI バスバックを追加。(#27591) プラグイン EP: GetOutputIndex で出力範囲を繰り返すときにゼロポインタのデレフェランスを修正。...

O
ONNX Runtime AI v1.24.3

ONNXランタイム v1.24.3

これはONNXランタイム1.24のパッチリリースで、バグ修正、セキュリティ改善、パフォーマンス強化、実行プロバイダ更新が含まれています。セキュリティ 修正 コア: ハイプの読み/書き込みを制限する GatherCopyData の整数切断を修正。(#27444) コア: チェックされていないバッチ_インデックスで読み取れる RoiAlign ハープの境界外を固定した。#275433 核:悪意あるLora Adから OOBの堆積を防止する。..

O
ONNX Runtime AI v1.24.2

ONNXランタイム v1.24.2

これはONNXランタイム1.24のパッチリリースで、いくつかのバグ修正、セキュリティ改善、実行プロバイダ更新が含まれています。NuGetのバグ修正: Linux と macOS の ONNX ランタイム NuGet パッケージのネイティブ ライブラリ 読み込みの問題が修正されました。(#27266) macOS: macOS ARM64でJavaサポートとJarテストを修正しました。(#27271) コア: Huggingface ハブキャッシュの外部データに対する強固なシンブルリンクサポートを有効にする。#27...

O
ONNX Runtime AI v1.24.1

ONNXランタイム v1.24.1

発表・最新情報 プラットフォームサポート変更 Python 3.10のホイールが公開されなくなりました Python 3.11+ Python 3.14へのアップグレードをお願いします フリースレッド Python (PEP 703) のサポートが追加されました Linux (#26786) の Python 3.13t と 3.14t のサポートが追加されました macOS/iOS のx86_64 バイナリが提供されなくなり、最小 macOS は 14.0 API バージョンにアップグレードされました ORT_API_VERSION が 24 (#41268) に更新されました ✨ 新しい。..

O
ONNX Runtime AI v1.23.2

ONNXランタイム v1.23.2

ORT 1.23.2 cherrypick 1 (#26368) ORT 1.23.2 のリリース-1.23.2 ブランチに以下のコミットを追加する: - [TensorRT] エンジン更新中にDDS出力バグを修正する - PR: #26272 - commit id: 00e85dd - In-memory 外部データで形状推論の失敗を修正する - PR: #26263 - commit id: d955476 - [CUDA] 90a-virtualを前向き互換性のために90-virtualに置き換える - PR: #26230 - commit id: b58911f - [QNN-EP] 修正。..