알리바바가 새롭게 출시한 Qwen3-235B-A22B-2507 모델이 주목을 받고 있습니다.
이번 모델은 경쟁사인 Moonshot의 Kimi-2 모델을 앞서는 성과를 보였습니다.
알리바바는 2023년 4월 Tongyi Qianwen LLM 챗봇을 시작으로 Qwen 시리즈를 지속적으로 발전시켜왔습니다.
이 모델들의 가장 큰 장점은 뛰어난 성능과 함께 오픈소스로 라이선스를 제공한다는 점입니다.
기업들은 이 모델을 다운로드하여 커스터마이징하고, 상업적 목적으로도 자유롭게 활용할 수 있습니다.
새로 업데이트된 모델은 Qwen3-235B-A22B-2507와 FP8버전이 있습니다.
FP8은 8비트 부동소수점을 의미하며, 모델의 수치 연산을 압축하여 성능에 눈에 띄는 영향을 주지 않으면서도 더 적은 메모리와 처리 능력을 사용하는 형식입니다.
이는 더 작고 저렴한 하드웨어에서 또는 클라우드에서 더 효율적으로 Qwen3의 기능을 가진 모델을 실행할 수 있음을 의미합니다.
팀들은 대규모 멀티-GPU 클러스터가 필요 없이 단일 노드 GPU 인스턴스나 로컬 개발 머신으로 Qwen3의 기능을 확장할 수 있습니다.
또한 인프라 리소스가 제한적이고 총 소유 비용이 중요한 프라이빗 파인튜닝과 온프레미스 배포에 대한 진입 장벽을 낮춥니다.
Qwen3-235B-A22B-2507도 개선되었습니다.
출처 : Qwen
일반 지식 평가인 MMLU-Pro에서 75.2점에서 83.0점으로 상승했고, 사실 정확성을 측정하는 GPQA와 SuperGPQA에서는 15-20 퍼센트포인트 향상되었습니다.
특히 추론 작업과 코드 생성 능력에서는 이전 버전 대비 두 배 이상의 성능 향상을 보여주었고,
코드 생성은 LiveCodeBench 점수가 32.9에서 51.8로 증가했습니다.
또한 알리바바는 이번 업데이트에서 기존의 하이브리드 추론 방식을 포기하고, 대신 지시 모델과 추론 모델을 별도로 개발하겠다고 발표했습니다.
기존에는 사용자가 상황에 따라 추론 모드를 켜거나 끌 수 있었지만, 이것이 설계 복잡성과 일관성 문제를 야기했습니다.
앞으로는 각각의 목적에 최적화된 별도 모델을 제공하여 더 높은 품질을 보장하겠다는 계획입니다.
그리고 알리바바는 향후 업데이트를 위한 기반을 마련하고 있습니다.
별도의 추론 전용 모델 개발이 진행 중이며, Qwen3-Coder-480B-A35B-Instruct 모델을 위한 URL문자열이 공개되었습니다.
참고로 spring-ai에서 해당기능을 사용했구요. 현재는 이걸 n8n과 병행사용할까를 고려중입니다.
열심히라고 표현하기엔.. 이미 오픈소스 진영에선 실무적으로는 1위 기업이죠... 저만치 여유롭게 앞서가는 중...