Gemma4, 편집은 1위
I tested Qwen3.6-27B, Qwen3.6-35B-A3B, Qwen3.5-27B and Gemma 4 on the same real architecture-writing task on an RTX 5090
·2026.04.23 09:22
핵심 내용
RTX 5090에서 Gemma4와 Qwen 3.5/3.6를 같은 문서 작성 작업으로 비교했다.
자세히 보기
RTX 5090 로컬 환경에서 Gemma4, Qwen3.6-35B, Qwen3.5-27B, Qwen3.6-27B를 같은 architecture-writing 작업에 돌려 비교했다.
입력은 v1(약 16k tokens), v2(약 4.6k tokens), 합계 약 20.6k tokens였고, 목표는 두 설계를 합쳐 Masterplan.md를 만드는 일이었다.
평가는 세 단계로 진행했다.
- initial draft
- second-pass revision
- final polish
각 단계는 GPT-5.4 agent Manny가 지시·검토해, 단순 1회 프롬프트 비교가 아니라 반복 수정까지 포함한 테스트였다.
평가 항목은 Clarity, Completeness, Discipline, Usefulness였다.
공개된 점수에서는:
- Clarity: Gemma4 9.4, Qwen3.6-27B 8.8, Qwen3.6-35B 8.1, Qwen3.5-27B 7.4
- Completeness: Qwen3.6-35B 9.6, Qwen3.5-27B 9.1, Qwen3.6-27B 8.7
결론적으로 Gemma4는 편집과 구조 정리에 강했고, Qwen3.6-35B는 완성도 측면에서 강점을 보였다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.