glm4.7이 답
OpenClaw + Ollama: Skip gemma and qwen - glm4.7 is the local LLM that actually works
·2026.04.10 15:56
핵심 내용
OpenClaw·Ollama 조합에서 glm-4.7이 Qwen·Gemma보다 에이전트 작업에 더 안정적이었다.
자세히 보기
몇 주 동안 여러 로컬 모델을 돌려본 끝에 glm-4.7-flash:latest가 OpenClaw에서 가장 잘 맞는다고 보고한다.
Qwen 3.5 27B는 GPU 사용률만 높고 실제로는 멈추는 경우가 많았고, Gemma 4 26B는 작업을 끝내지 않았는데도 "완료"라고 말하는 문제가 반복됐다.
반면 glm-4.7은 RTX 3090 24GB 환경에서도 36/64 split로 동작했고, 초기 캐시 이후에는 느리지만 계속 작업을 이어가며 타임아웃 없이 진행됐다.
핵심 체감은 다음과 같다.
- quiet execution보다 계속 reasoning을 이어가는 모델이 OpenClaw의 실행 모델과 더 잘 맞음
- 한 번 올라오면 응답이 끊기지 않고 실제 파일 수정까지 이어짐
- 작업 도중에는
/abort,/stop,/cancel이 잘 안 먹는 듯한 체감도 있음
댓글에서는 추가로 native Ollama API를 써야 tool calling이 제대로 되는 경우가 있다는 점, 그리고 timeoutSeconds를 늘려야 한다는 실전 팁이 공유됐다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.