BAIYUN SI / AI LEXICON
Token テキスト処理の基本ユニット
モデル内の情報処理の基本単位は、多くのAIサービスでの利用状況を測定する基盤でもあります。
テキストモデルでは、入力はまずトークンに分割されます。 トークンはテキストの断片、単語の一部、または記号である場合があり、固定されて中国語の漢字や英語の単語と同一視することはできません。
モデルは入力トークンを読み取り、その後出力トークンを生成します。 具体的なセグメンテーション手法、コンテキスト制限、出力制約はモデルとインターフェースによって異なります。 同じパッセージでも、モデルによってカウントが異なる場合があります。
入力、出力、キャッシュの使用量は異なる価格設定になることがあります。 通話コストを比較する際は、単一のリクエストの見えるテキストの長さを比較するのではなく、タスクの結果や実際の使用状況を考慮するべきです。
白雲族との関係
トークン供給量が今や白雲の出発点となっています。 モデルと価格設定のルールを明確にし、学習、開発、ビジネス実務が実際の消費を見られるようにしたいと考えています。 具体的なルールはプラットフォームの発表により適用されます。