Re Reference AI

技術

トークンマキシング(Token Maxxing)とは

Token Maxxing

AIとのやり取りで消費するトークン量をあえて最大化し、出力品質や習熟度を高めようとする戦略

プロンプトエンジニアリング推論最適化

ひとことで言うと

AIにたくさん考えさせたり長いやり取りを重ねたりして、トークンを惜しみなく使うことで良い結果を引き出そうとする使い方。

概要

トークンマキシングとは、AIとのやり取りで消費するトークン量をあえて最大化することで、出力の品質やAI活用の習熟度を高めようとする戦略・姿勢を指す。 長いChain-of-Thoughtを生成させる、コンテキストウィンドウを情報で目一杯まで満たす、対話を粘り強く重ねて回答を練り上げるといった振る舞いが含まれる。 "〇〇maxxing"というインターネットスラングの語法をトークン消費に当てはめた呼び方で、テスト時スケーリングのように推論時の計算量を増やすほど回答品質を高められるという傾向が知られるようになったことを背景に、ユーザー側の振る舞いを指す表現として使われている。

利点

  • 長い思考過程や十分なコンテキストを与えることで、難しいタスクの回答品質を引き上げやすい

欠点

  • 消費トークンが増える分、APIコストやレイテンシが増加する
  • 必要以上にトークンを費やしても品質が頭打ちになる場合があり、常に有効とは限らない

関連用語

テスト時スケーリングChain-of-Thoughtコンテキストウィンドウロングコンテキストトークン消費最適化

よくある質問

テスト時スケーリングとの違いは?

テスト時スケーリングは推論時の計算量配分を扱う技術的な概念であるのに対し、トークンマキシングはユーザーが意図的にトークンを多く使おうとする振る舞いを指し、より口語的な言い方として使われる。