AI Briefing

Gemma4, 편집은 1위

I tested Qwen3.6-27B, Qwen3.6-35B-A3B, Qwen3.5-27B and Gemma 4 on the same real architecture-writing task on an RTX 5090

·2026.04.23 09:22

핵심 내용

RTX 5090에서 Gemma4와 Qwen 3.5/3.6를 같은 문서 작성 작업으로 비교했다.

자세히 보기

RTX 5090 로컬 환경에서 Gemma4, Qwen3.6-35B, Qwen3.5-27B, Qwen3.6-27B를 같은 architecture-writing 작업에 돌려 비교했다.

입력은 v1(약 16k tokens), v2(약 4.6k tokens), 합계 약 20.6k tokens였고, 목표는 두 설계를 합쳐 Masterplan.md를 만드는 일이었다.

평가는 세 단계로 진행했다.

  • initial draft
  • second-pass revision
  • final polish

각 단계는 GPT-5.4 agent Manny가 지시·검토해, 단순 1회 프롬프트 비교가 아니라 반복 수정까지 포함한 테스트였다.

평가 항목은 Clarity, Completeness, Discipline, Usefulness였다.

공개된 점수에서는:

  • Clarity: Gemma4 9.4, Qwen3.6-27B 8.8, Qwen3.6-35B 8.1, Qwen3.5-27B 7.4
  • Completeness: Qwen3.6-35B 9.6, Qwen3.5-27B 9.1, Qwen3.6-27B 8.7

결론적으로 Gemma4는 편집과 구조 정리에 강했고, Qwen3.6-35B는 완성도 측면에서 강점을 보였다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.