출처 : 메타
Meta가 에이전트 및 코딩 작업 전반에서 성능을 향상시킨 Muse Spark 1.3을 출시했습니다.
Muse Spark 1.3은 오늘부터 Muse Code와 Meta Model API에 순차적으로 적용됩니다.
기존의 추론 모드는 즉시 사용할 수 있으며, 최대 추론(max reasoning) 모드는 추가 안전성 테스트를 마치는 대로 제공될 예정입니다.
Muse Spark 1.3은 사용자와 더 능동적으로 협력하도록 훈련됐습니다.
프롬프트가 모호할 때는 명확한 질문을 던지고, 문제에 부딪히면 사용자에게 도움을 요청하며, 중대한 조치를 취하기 전에는 확인을 거칩니다.
장기 작업을 수행할 때는 사용자의 선호에 맞춰 잦은 업데이트를 제공하거나 백그라운드에서 조용히 작업을 이어가는 등 속도를 조절합니다.
복잡하고 긴 지시사항을 따르는 능력도 이전 Muse Spark 모델들보다 안정적으로 개선됐습니다.
여러 단계로 구성된 작업에서 제약 조건을 빠뜨리거나 요청된 워크플로우를 벗어나는 일 없이 세부 요구사항을 더 잘 유지합니다.
멀티태스킹 성능도 향상돼, 사용자가 이전 요청을 이어가거나 중간에 새로운 요청을 끼워 넣더라도, 여러 작업이 뒤섞인 단일 스레드 안에서 각 프롬프트를 올바른 작업에 더 정확히 연결합니다.
모델 스스로의 능력과 한계에 대한 인식도 개선됐습니다.
결과를 조작(할루시네이션)하는 대신, 자신이 할 수 있는 것과 할 수 없는 것, 아는 것과 모르는 것, 장애물에 부딪힌 시점을 더 정확히 인지하도록 훈련됐습니다.
코딩 분야에서는 더 장기적인 작업을 학습해 일반적인 엔지니어링 워크플로우에서 사용성이 향상됐습니다.
Muse Spark 1.2와 비교하면 불필요한 턴을 줄이고 장황함을 덜어내 더 깔끔한 코딩 스타일을 갖췄습니다.
Meta 엔지니어들의 비교 평가에 따르면 도구 호출은 약 20%, 토큰 사용량은 약 25% 줄어들어 훨씬 빠르고 효율적인 것으로 나타났습니다.
안전성 측면에서도 에이전트 및 코딩 기능과 밀접한 영역에서 개선이 이뤄졌습니다.
Muse Spark 1.3은 적대적 입력과 프롬프트 인젝션에 대한 저항력이 강화되어 더욱 강력한 대응력을 보이며, 복잡한 에이전트 작업에서 모델은 되돌릴 수 없는 행동을 더 정확하게 판단하고 그에 따라 진행합니다.