알리바바, AI폰용 풀스택 솔루션 'Qwen Intelligence' 공개…시스템급 Agent Harness 내장
알리바바가 9월 22일 윈치 콘퍼런스에서 AI 스마트폰용 풀스택 솔루션 'Qwen Intelligence'를 공개했다. 자체 하드웨어를 생산하는 방식이 아니라, 스마트폰 제조사에 모델과 플랫폼, 시나리오 솔루션을 한 묶음으로 제공하는 AI 기반층 역할을 하겠다는 구상이다.
구조의 중심에는 시스템 수준의 'Agent Harness' 아키텍처가 있다. 여기에는 세 개의 에이전트가 내장되며, 그중 Mobile Planner Agent가 휴대폰의 '두뇌' 역할을 맡는다. 제목에서 강조된 대로 '모델 × Harness' 조합을 통해 계획(planning) 에이전트의 성공률 90%를 달성했다는 것이 발표 측의 주장이다. 다만 원문이 짧게 잘려 있어 나머지 두 에이전트의 구체적 역할과 플랫폼 구성은 확인되지 않는다.
배경에는 'AI 폰'이라는 개념이 여러 해째 이야기되면서도 실제로는 제조사마다 모델을 개별적으로 얹는 수준에 머물렀다는 맥락이 있다. 알리바바는 하드웨어를 직접 만들지 않고 기반층을 공급하는 쪽을 택함으로써, 자사 모델을 여러 제조사의 단말에 깔리는 형태로 확장하려는 것으로 읽힌다.
개발자 관점에서 눈에 띄는 지점은 성능을 모델 단일 요소가 아니라 모델과 이를 감싸는 실행 구조의 곱으로 본다는 접근이다. 다단계 계획 수립처럼 실패 지점이 많은 작업에서 어떤 실행 골격을 씌우느냐가 결과를 좌우한다는 문제의식은, 온디바이스 에이전트를 설계할 때 참고할 만하다.
주의할 점도 있다. 90%라는 수치는 회사 측 발표 기준이며, 어떤 벤치마크와 조건에서 측정됐는지는 원문에 제시되지 않았다. 세 에이전트 체계의 나머지 구성과 실제 제조사 도입 사례 역시 이번 원문만으로는 확인할 수 없다.
관련 글
- 코딩 에이전트 성능, 모델보다 '하네스'가 더 좌우할까코딩 에이전트의 성능 차이에서 모델 자체와 이를 감싸는 실행 골격(하네스)이 각각 얼마나 기여하는지를 따져보는 'HarnessTax' 논의가 개발자 커뮤니티에서 화제다. 같은 모델이라도 하네스에 따라 결과가 갈릴 수 있어 벤치마크 해석과 도구 선택 기준을 다시 보게 만든다.
- 콰이쇼우, 복잡한 커머스 Agent 운영법 공개…QCon 상하이서 'Harness Loop' 사례 발표콰이쇼우 전자상거래 AI 기반 팀장이 QCon 상하이 2026에서 복잡한 커머스 Agent 운영 경험을 발표한다. 검색·추천부터 사후 서비스까지 여러 도메인을 넘나드는 Agent를 실행 궤적 기반으로 지속 개선하는 Harness Loop 방법론이 핵심이다.
- 차이나오 AI 에이전트는 코딩 기여율 90%에도 전달 속도 10%만 개선했다알리바바 계열 물류 기업 차이나오가 AI 코딩 에이전트로 요구사항 전달 전 과정을 맡긴 사례가 공개됐다. 코드 기여율은 90%를 넘겼지만 실제 요구사항 전달 속도 개선은 10%에 그쳤다는 두 수치의 간극이 핵심이다.
- Qwen Office, 기업용 에이전트에 승부수… 컨텍스트 인프라와 녹음 카드 QwenNote A2 공개알리바바 Qwen Office가 9월 22일 Apsara Conference에서 기업용 에이전트 인프라 'Enterprise Context'와 명함 크기 AI 하드웨어 'QwenNote A2'를 발표했다. 모델 성능은 더 이상 병목이 아니며, 기업이 자체적으로 보유한 컨텍스트를 얼마나 잘 연결하고 압축해 에이전트에 넘기느냐가 실사용 성패를 가른다는 판단이다.