추천Qwen3.8-Max: 코딩과 협업의 새로운 기준
Qwen이 2.4T 파라미터의 Qwen3.8-Max를 공개하고 오픈 웨이트 출시를 예고했다.
Qwen이 최신 Max급 모델인 Qwen3.8-Max를 공개했다. Qwen 3.5의 아키텍처를 기반으로 총 2.4T 파라미터와 95B 활성 파라미터를 사용하며, 코딩·업무·연구·장기 작업 전반의 성능과 안정적인 엔드투엔드 작업 수행 능력을 강화했다. 모델은 현재 QwenCloud API로 이용할 수 있고, 오픈 웨이트는 다음 주 공개될 예정이다.
이번 평가의 핵심은 단순한 코드 생성이 아니라, 사람이 개입하지 않은 상태에서 실제 프로젝트를 처음부터 끝까지 완성하는 능력이다. Qwen3.8-Max는 고정된 계획을 따르는 대신 피드백 루프를 통해 작업 방식을 스스로 개선하는 방식으로 테스트됐다.
10일 이상 진행된 자율 코딩 실험에서는 oh-my-cli 프로젝트를 처음부터 구축하고, 요구사항 수집부터 이슈 생성·할당, 코드 작성, 테스트, 미리보기, 로그 분석, 오류 수정까지 자동화한 자기진화형 하니스를 만들었다.
- GitHub Issues를 기반으로 한 이슈 상태 머신과 디스패처, 모니터, 워치독을 결합해 작업을 관리했다.
- 각 변경 뒤 Build, Unit Test, E2E, Desktop Lifecycle 검증을 수행하고 이상 발생 시 관련 이슈와 PR로 되돌려 재검증했다.
- 커뮤니티 및 사용자 피드백을 실행 가능한 작업으로 변환해
/goal,/resume, Dynamic Workflow, Session Replay, Desktop 등의 기능을 지속적으로 개선했다.
2026년 7월 30일 기준 약 16일간 완전 자율적으로 운영된 저장소에는 265개 커밋, 127개 PR, 151개 이슈가 누적됐다.
또 다른 실험에서는 연구 논문 **「Unified Data Selection for LLM Reasoning」**을 바탕으로 데이터 처리, 학습, 평가 파이프라인을 모두 처음부터 재현한 뒤 성능 개선까지 시도했다. 약 125시간 동안 7,600줄의 코드를 작성하고 1,100회 이상의 작업과 33회의 GPU 학습을 수행했으며, 논문의 전체 파이프라인을 재구축하는 데 약 37시간을 투입했다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.