Tencent는 8월 28일 새로운 오픈소스 모델 Hy4 Preview를 공개했습니다. 주요 목표는 일반 대화보다 소프트웨어 엔지니어링, 연구, 금융 분석 등 장시간 전문 작업입니다. reuters.com

모델은 Mixture-of-Experts(MoE) 구조로 전체 파라미터가 약 770B지만, 각 텍스트 요청에서는 약 49B만 활성화됩니다. Tencent는 향후 자사 코딩 도구 CodeBuddy와 업무용 AI WorkBuddy 등에 통합할 계획입니다. reuters.com

Tencent는 preview 단계의 한계도 직접 인정했습니다. 어려운 문제에서 필요 이상으로 오래 추론하거나, 자신의 결과를 지나치게 재검증하는 현상이 있다고 밝혔습니다. reuters.com

왜 중요한가

최근 중국 오픈웨이트 모델의 방향이 꽤 명확합니다.

예전에는:

“서구 frontier 모델에 가까운 챗 모델”

이 목표였다면 최근 Qwen·Kimi·Z.ai·Tencent 계열은:

Coding + Tools + Research + Long-running Agent

를 정면으로 겨냥합니다.

특히 MoE 구조에서 770B total / 49B active는 중요한 경제적 방향입니다. 거대한 지식 용량을 확보하되 모든 토큰에 전체 모델을 실행하지 않아 추론비를 낮추려는 전략입니다.

산업·시장 영향

오픈웨이트 모델 경쟁에서 다음 병목은 모델 weights보다 serving software와 agent harness가 될 가능성이 큽니다.

같은 모델이라도 vLLM/SGLang, quantization, batching, context 관리, tool loop에 따라 실제 작업 비용이 크게 달라지기 때문입니다.

중국 업체들이 지속적으로 상업 이용 가능한 강한 오픈 모델을 내놓으면 미국 frontier API 업체에도 가격 압력이 계속 가해질 가능성이 높습니다.

실무 시사점

이런 모델은 benchmark보다 실제 workload로 보는 것이 좋습니다.

특히 코딩 모델이라면:

완료율 / 평균 tool-call 수 / 재시도 / latency / 작업당 비용

을 GPT·Claude와 직접 비교하는 방식입니다.

Hy4는 아직 preview이므로 production보다는 평가셋에 추가해볼 후보에 가깝습니다.

Reuters — Tencent Hy4 발표