Redditr/LocalLLaMALocalLLaMA
The difference between "medium" and "xhigh" reasoning effort for Qwen3.8-27B is actually insane.
2026년 8월 14일 오후 07:55Error 추천0 댓글
#Qwen3.8#llama.cpp#LLM_Reasoning
요약
Qwen3.8-27B 모델의 reasoning_effort 설정에 따른 성능 차이가 매우 극명하게 나타나고 있습니다. 사용자는 medium 설정과 xhigh 설정 사이의 추론 토큰 생성량 차이가 예상보다 훨씬 크다는 점에 주목하며 이것이 정상적인 동작인지 의문을 제기하고 있습니다.
주요 내용
- Qwen3.8-27B 모델에서 medium 설정은 추론 토큰이 거의 생성되지 않는 반면, xhigh 설정은 수만 개의 토큰을 생성하며 성능 차이가 매우 크게 나타납니다.
- 사용자는 llama.cpp 환경에서 HTML 게임 클론 제작과 같은 복잡한 작업을 테스트하며 설정값에 따른 결과값의 차이를 확인했습니다.
- 이러한 극단적인 추론량 차이가 모델의 의도된 동작 방식인지 아니면 설정 오류인지에 대한 기술적 의문을 제기하고 있습니다.