AI Briefing

glm4.7이 답

OpenClaw + Ollama: Skip gemma and qwen - glm4.7 is the local LLM that actually works

·2026.04.10 15:56

핵심 내용

OpenClaw·Ollama 조합에서 glm-4.7이 Qwen·Gemma보다 에이전트 작업에 더 안정적이었다.

자세히 보기

몇 주 동안 여러 로컬 모델을 돌려본 끝에 glm-4.7-flash:latest가 OpenClaw에서 가장 잘 맞는다고 보고한다.

Qwen 3.5 27B는 GPU 사용률만 높고 실제로는 멈추는 경우가 많았고, Gemma 4 26B는 작업을 끝내지 않았는데도 "완료"라고 말하는 문제가 반복됐다.

반면 glm-4.7은 RTX 3090 24GB 환경에서도 36/64 split로 동작했고, 초기 캐시 이후에는 느리지만 계속 작업을 이어가며 타임아웃 없이 진행됐다.

핵심 체감은 다음과 같다.

  • quiet execution보다 계속 reasoning을 이어가는 모델이 OpenClaw의 실행 모델과 더 잘 맞음
  • 한 번 올라오면 응답이 끊기지 않고 실제 파일 수정까지 이어짐
  • 작업 도중에는 /abort, /stop, /cancel이 잘 안 먹는 듯한 체감도 있음

댓글에서는 추가로 native Ollama API를 써야 tool calling이 제대로 되는 경우가 있다는 점, 그리고 timeoutSeconds를 늘려야 한다는 실전 팁이 공유됐다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.