추론 모드
모델이 답하기 전에 생각하는 과정을 보고, 어떤 모델이 그럴 수 있는지 알아 두기.
어떤 모델은 답을 쓰기 전에 한 번 굴려 봅니다 — 장면을 짜고, 미스터리의 아귀를 맞추고, 이 캐릭터라면 실제로 어떻게 할지 정하는 일. 추론 모드는 그 단계를 켜고, 답변 위의 접었다 펼 수 있는 창에 그것을 보여 줍니다.
추론할 수 있는 모델
| 모델 | 배수 | 추론 |
|---|---|---|
| DeepSeek V4 Flash | 0.3× | 선택 |
| MiMo V2.5 | 0.3× | 선택 |
| DeepSeek V3.2 | 0.5× | 없음 |
| GLM 5.3 Flash | 0.5× | 항상 켜짐 |
| DeepSeek V4.1 Flash | 0.7× | 선택 |
| DeepSeek V4 Pro | 0.7× | 선택 |
| DeepSeek R1 | 1.0× | 항상 켜짐 |
| GLM 4.7 | 1.0× | 선택 |
| Gemini 3 Flash Preview | 1.2× | 없음 |
| GLM 5 | 1.3× | 선택 |
| Llama 3.1 8B | 무료 | 없음 |
GLM 5.3 Flash와 DeepSeek R1은 답하기 전에 언제나 생각하며, 말려도 소용없습니다. DeepSeek R1은 도구 사용도 못 하므로 도구로 돌아가는 플러그인은 그 위에서 작동하지 않습니다. GLM 5와 Gemini 3 Flash Preview는 고급 모델이라 구독이 필요합니다. 전체 모델 참고
켜는 법
사이드 패널 → 설정 → 모델 및 생성 → 추론 모드에서 추론 사용을 켭니다.
이 줄은 지금 쓰는 모델이 추론할 수 있을 때만 있습니다. 항상 추론하는 모델에서는 줄이 있되 잠겨 있고 추론 항상 켜기라고 쓰여 있습니다.
이 설정의 범위는 이 기기이고 모델별로 기억되며, 처음엔 꺼짐입니다. 모델을 바꾸면 방금 떠난 설정이 아니라 그 모델 자신의 설정으로 돌아갑니다.
모델 선택기에는 추론 토글이 없습니다. 거기 있는 건 목록을 좁히는 추론 필터 칩과, 해당되는 모델에 붙는 추론 가능 배지입니다. 스위치 자체는 채팅 설정에 있습니다.
창 읽기
추론한 답변은 본문 위에 추론이라는 머리말이 붙은 창과 함께 도착합니다 — 아직 오는 중이면 추론 중…입니다. 추론 펼치기와 추론 접기로 열고 닫습니다.
창은 기본으로 접혀 있습니다. 마지막 메시지만 자동 확장 설정을 따르고, 그보다 오래된 메시지는 당신이 남겨 둔 상태 그대로입니다.
이것을 다스리는 설정은 둘이며, 둘 다 사이드 패널 → 설정 → 표시 및 인터페이스 아래에 있고 범위는 이 기기입니다.
| 설정 | 토글 | 기본값 |
|---|---|---|
| 추론 창 | AI 생각 과정 표시 | 켜짐 |
| 추론 자동 확장 | 새 메시지에 대해 자동 확장 | 꺼짐 |
모델의 분석이 장면의 맛을 버린다면 AI 생각 과정 표시를 끄세요 — 모델은 여전히 추론하고, 당신 눈에만 안 보일 뿐입니다. 자동 확장이 꺼져 있으면 모델이 일하는 동안 대기 표시가 *입력 중…*이 아니라 *생각 중…*으로 나옵니다.
비용
추론 토큰은 평범한 출력 토큰으로, 그 모델 자신의 배수로 과금됩니다. 별도의 추론 요율도, 할증도 없습니다.
달라지는 것은 양입니다. 먼저 생각하는 모델은 토큰을 더 쓰고, 답을 시작하기까지도 더 걸립니다. 얼마나 더인지는 전적으로 모델과 장면에 달렸으니, 켠 직후 몇 번의 답변 동안은 고정된 숫자로 예산을 잡지 말고 크레딧 잔액을 지켜보세요.
관련 문서
- 모델 고르기 — 애초에 어떤 모델로 추론할지
- 모델 — 모든 모델의 기능과 배수
- 사이드 패널과 설정 — 추론 설정 둘이 있는 곳
- 크레딧 — 답변 하나가 어떻게 요금이 되는지