推論モード
モデルが答える前に考える様子を見る。そして、どのモデルが考えられるのかを知る。
書き出す前に返信を練れるモデルがあります——場面を組み立てる、謎の筋を通す、そのキャラクターなら実際どうするかを決める。推論モードはその工程をオンにし、返信の上にある折りたためるペインで見せてくれます。
推論できるモデル
| モデル | 倍率 | 推論 |
|---|---|---|
| DeepSeek V4 Flash | 0.3× | 任意 |
| MiMo V2.5 | 0.3× | 任意 |
| DeepSeek V3.2 | 0.5× | なし |
| GLM 5.3 Flash | 0.5× | 常時オン |
| DeepSeek V4.1 Flash | 0.7× | 任意 |
| DeepSeek V4 Pro | 0.7× | 任意 |
| DeepSeek R1 | 1.0× | 常時オン |
| GLM 4.7 | 1.0× | 任意 |
| Gemini 3 Flash Preview | 1.2× | なし |
| GLM 5 | 1.3× | 任意 |
| Llama 3.1 8B | 無料 | なし |
GLM 5.3 Flash と DeepSeek R1 は返信前に必ず考え、止めることはできません。DeepSeek R1 はツール利用もできないので、ツール駆動のプラグインは動きません。GLM 5 と Gemini 3 Flash Preview は上位モデルで、サブスクリプションが必要です。モデル一覧
オンにする
サイドパネル → 設定 → モデルと生成 → 推論モードで推論を有効にするをオンにします。
この行は、いま使っているモデルが推論できるときだけ存在します。常時推論するモデルでは行は出ますが固定で、常に推論を有効にすると表示されます。
設定の適用範囲はこのデバイスで、モデルごとに記憶され、初期状態はオフです。モデルを切り替えると、直前のものではなくそのモデル自身の設定に戻ります。
モデル選択画面に推論のトグルはありません。 あちらにあるのは、一覧を絞り込む推論フィルターのチップと、該当するモデルに付く推論対応バッジです。スイッチ本体はチャット設定にあります。
ペインの読み方
推論つきの返信は、本文の上に推論という見出しのペインを伴って届きます——受信中は推論中…です。推論を展開と推論を折りたたむで開閉します。
ペインは初期状態で閉じています。最後のメッセージだけは自動展開の設定に従い、それより前のメッセージはあなたが残した状態のままです。
これを制御する設定は2つ。どちらもサイドパネル → 設定 → 表示とインターフェースの下にあり、適用範囲はどちらもこのデバイスです。
| 設定 | トグル | 初期値 |
|---|---|---|
| 推論ペイン | AIの思考プロセスを表示する | オン |
| 推論の自動展開 | 新しいメッセージで自動展開する | オフ |
モデルの分析が場面の興を削ぐならAIの思考プロセスを表示するをオフに——モデルは変わらず推論し、あなたに見えなくなるだけです。自動展開がオフのとき、処理中の待機表示は*入力中…ではなく思考中…*になります。
費用
推論トークンは通常の出力トークンとして、そのモデル自身の倍率で課金されます。推論専用のレートも追加料金もありません。
変わるのは量です。先に考えるモデルは書くトークンが増え、答え始めるまでも長くなります。どれだけ増えるかはモデルと場面次第なので、オンにしたあとの最初の数回は固定の数字で見積もらず、クレジット残高を見ておいてください。