Reflection이 501B 오픈웨이트 Beam으로 중국 오픈 모델에 맞선다

TechCrunch4일 전조회 3

미국 브루클린에 자리한 스타트업 Reflection AI가 자사의 첫 프런티어 오픈웨이트 모델 Beam을 공식 공개했다. 텍스트 전용 전문가 혼합(MoE) 모델로, 추론과 코딩, 에이전트 작업에서 중국 오픈 모델들과 어깨를 나란히 하면서 연산 비용은 크게 낮췄다는 것이 회사의 주장이다.

규모부터 보면 전체 파라미터 5010억 개, 이 중 실제로 활성화되는 파라미터는 230억 개다. 23조8000억 토큰으로 사전학습됐고 컨텍스트 창은 100만 토큰까지 열린다. 회사가 비교 대상으로 삼은 Z.ai의 GLM-5.2는 전체 약 7440억 개, 활성 400억 개 규모다. 전체 파라미터는 GLM-5.2보다 작지만 활성 파라미터를 훨씬 줄여 서빙 부담을 낮춘 셈이다.

학습 방식의 핵심은 고연산 강화학습이다. Reflection은 Beam이 경쟁 모델 대비 토큰 비용과 추론 시점 연산을 '일부만' 쓰면서도 고급 추론 벤치마크에서 GLM-5.2와 대등한 점수를 내고, 현재 나와 있는 서구 오픈 모델들은 앞선다고 설명한다. 추론 연산은 3~4배 적게 든다는 게 회사 측 수치다. 기업과 공공 부문, 개발자를 겨냥한 '일꾼 모델'을 표방한다.

이 모델이 나온 배경에는 오픈웨이트 시장의 주도권 구도가 있다. DeepSeek, Qwen, Z.ai 같은 중국 진영 모델이 실질적인 기준점이 된 상황에서 서구의 대안을 만들려는 경쟁이 벌어지고 있고, Reflection은 그 한복판에 서려는 회사다. 2024년 구글 딥마인드 출신 연구자 두 명이 세웠으며 엔비디아, 세쿼이아캐피탈, 라이트스피드벤처파트너스 등에서 약 47억 달러를 조달했다. 직전 라운드 기준 프리머니 밸류에이션은 250억 달러다. 올여름에는 SpaceX, Nebius와 합쳐 70억 달러가 넘는 계약을 맺고 2029년까지 엔비디아 GB300 칩 접근권을 확보했다.

경쟁 상대로는 클로즈드 랩인 Anthropic과 OpenAI, 중국의 인기 오픈 모델, 그리고 Mistral·Meta·Cohere 같은 서구 진영이 모두 포함된다. 가장 직접적인 미국 내 라이벌로는 미라 무라티의 Thinking Machines Lab이 7월에 내놓은 오픈 모델 Inkling이 꼽힌다. 양쪽이 결과를 공개한 코딩 테스트 네 개에서 Beam이 앞선다고 Reflection은 밝혔지만, Inkling이 멀티모달인 반면 Beam은 텍스트만 다룬다는 차이가 있다.

사업 방향은 기업과 주권 국가다. 기관이 자체 데이터로 Reflection 모델을 학습시켜 로컬 맞춤형 AI 시스템을 구축하게 하는 'AI 팩토리' 개념을 밀고 있다. 엔비디아 젠슨 황 CEO가 오래 강조해 온 구상과 맞물리며, GPU 수요를 키우는 그림이기도 하다. 헤지펀드와 트레이딩 회사들이 이런 시스템 구축에 관심을 보인다고 전해졌고, 국내에서는 신세계그룹과 주권 AI 팩토리 파트너십 개념을 시험하고 있다.

개발자 입장에서 당장 확인할 것은 배포 계획이다. Reflection은 이번 달 안에 Beam의 가중치와 전체 기술 상세를 공개하고, 하이퍼스케일러와 네오클라우드를 통해 유통하며 주요 오픈소스 라이브러리 통합도 출시 시점에 맞춘다고 예고했다. 활성 230억 MoE에 100만 토큰 컨텍스트라는 조합은 자체 호스팅을 검토할 때 메모리 요구량과 서빙 비용을 어떻게 설계할지가 관건이 된다는 뜻이다.

다만 성능 수치는 아직 독립적으로 검증되지 않았다. 벤치마크 비교 역시 회사가 직접 제시한 결과라는 점을 감안해야 한다. TechCrunch가 추가 정보를 요청했을 때 Reflection은 답변을 내놓지 않았다.