投機的デコーディング
Red Hat AI Inference 3.5
Red Hat AI Inference での投機的なデコード
概要
投機的デコードと、Red Hat AI Inference で Speculator ライブラリーを使用してカスタムスペックエーターモデルをデプロイおよびトレーニングする方法について説明します。
概要
Red Hat は、企業がコアとなるデータセンターからネットワークエッジに至るまで、各種プラットフォームや環境全体で作業を簡素化できるように、強化されたソリューションを提供しています。
Red Hat では、コード、ドキュメント、Web プロパティーにおける配慮に欠ける用語の置き換えに取り組んでいます。このような変更は、段階的に実施される予定です。詳細情報: Red Hat ブログ.