ガイドライン 0.3.2
もっとドキュメントや修正や 性能の向上README のオフライン文法デバッグガイドが追加されました (@biefan ありがとう!) (#1462) OnnxRT-GenAI ランタイムでモデルをロードできない問題 (#1419) stderr と stdout のノートブック標準化の正しい処理 (#1423) llguidance を 1.6.1 に変更しました -- JSON 文字列の URI フォーマットへのサポート; perf 改善 (#1429)
もっとドキュメントや修正や 性能の向上README のオフライン文法デバッグガイドが追加されました (@biefan ありがとう!) (#1462) OnnxRT-GenAI ランタイムでモデルをロードできない問題 (#1419) stderr と stdout のノートブック標準化の正しい処理 (#1423) llguidance を 1.6.1 に変更しました -- JSON 文字列の URI フォーマットへのサポート; perf 改善 (#1429)
モニター導導推論とOnxruntime-genaiのサポートを導入します。数々の修正。Python 3.14 (#1385) のサポートが追加されました。 @naga86によるモニターガイドされた推論 (#1391) による推論時間のセマンティック検証を追加する機能が追加されました。
ガイドライン 0.3.0 より多くのモデル提供者、よりよいLARK露出、再構築されたカスタムツールBreaking Changes 古いスタイルの @guidance ベースのツール呼び出しを削除 (より一般的な OpenAI スタイルツールに有利) ローカルモデルへの呼び出しサポートを一時的に削除 (PR は新しいツールでサポートを回復する予定) litellm による groq および mistralai API のサポートを追加 実験的な sglang モデルを追加 実験を追加。..
ガイドライン 0.2.5 特別なトークンはユーザーによって定義できます。数々の文法修正。すべてのトークンタイプで表示された候補トークン。追加されたウィジェットにはダークモード (主に輸出用) があります。special_token 関数は <think> に追加するために追加されました。echo=True のとき、すべてのトークンタイプ (速速転送、入力を含む) に対して top_k が露出した。温度が1e-5より小さい場合は、貪欲なサンプルを使用します。固定 正常化 捕獲。..
ガイドライン 0.2.4 より良いサンプリング、より良いメトリック、 llama-cpp-python の修正 (最新の更新をお願いします!), 無数のビジュアライゼーションの修正。追加 移動中のサンプリング_パラーム (top_p/top_k, min_p, repetition_penalty) の変更を許可する モデル。with_sampling_params(...) 前回のリファクタで一時的に削除された後、 top_kトークンを vis に戻す モデル。token_count を削除した (現在プライベート) モデル。..
0.2.3 ガイドライン 性能のホットファックがあり エクストラも追加しました追加 追加 Llama3.2 チャットテンプレート 削除 エンジンクラスから特定のサンプル_with_temperature のデッドコードを削除 変更 優先順位キューをフルソートではなく使用する top-k (ウィジェット用) の実装を切り替えた ウィジェット/vis がオンになったときにトークンあたり数ミリ秒を節約する 性能回帰を修正。..
ガイドライン 0.2.2 OpenAI のサポートを向上させ、いくつかのバグも修正しました (少なくとも試みました)!0.2.1の変更も含まれています。トークン確率とJupyterウィジェットのバックトラッキングサポートを追加しましたノートブックをオフラインでレンダリングするサポートモデルのための様々な入力/出力タイプ (JSON出力、画像出力、特別なトークン、選択、...を含む) を表現するためのより高いレベルのAST
0.2.1 放出
何が変わった? 新年おめでとう!このリリースには、ガイドラインの多くの要素が大幅に改訂されています。モデルメトリックや視覚化をサポートするために 多くのコードを追加しましたガイドの基本文法処理が 完全に。..
変更点 パイソンベースの EarleyParser を lexeme ベースの rust 実装で置き換える @hudson-ai & @mmoskal in #951 このガイドラインのプレリリースバージョンは、ガイドライン文法解析に重要なスピードアップとバグ修正を提供する新しい Rust ベースの Earley lexer + パッサーを使用しています。最適化に関する詳細はPR #951を参照してください。初期に現在のガイド (v0.1.16) の行動に変化を期待してください。..