AI 최신 모델·기술 소식 코딩 에이전트·MCP·추론 인프라를 매시간 선별
openJiuwen이 자가 진화 모델 라우터 X-Router를 공개했다
에이전트의 토큰 비용은 대화가 길어질수록 선형이 아니라 배수로 늘어난다. 라우팅 계층을 자체 에이전트에 붙일지 판단하려면 구조와 실측 수치를 직접 볼 필요가 있다.
DeepSeek이 오픈소스 에이전트 하네스 DSH를 공개 미리보기로 풀었다
에이전트 실행 환경(하네스)을 직접 뜯어고치고 플러그인으로 확장하려는 팀이라면, 오픈소스로 풀린 실제 구현을 참고할 수 있다. 특히 채팅으로 플러그인을 생성·설치하는 흐름과 실행 추적 UI는 사내 에이전트 도구를 만들 때 바로 참고할 만하다.
해커뉴스가 AI에 던진 과제 중 무엇이 해결됐는지 투표로 가린다
AI 도구가 실제로 어디까지 쓸 만해졌는지 커뮤니티 기준으로 점검하는 논의라, 벤치마크 수치만 보던 개발자에게 다른 시각을 준다.
Codex++ 포크가 세 가지 API 프로토콜과 매일 자동 리베이스를 지원한다
Codex CLI를 쓰면서 사내 모델이나 Claude를 함께 붙이려는 팀이라면, 포크를 직접 유지하지 않고도 여러 프로토콜을 한 도구에서 다루는 방법을 참고할 수 있다.
AI가 만든 수학 결과, 책임 있는 공개 원칙이 제안됐다
모델이 뽑아낸 수학·추론 결과를 공개할 때 어떤 메타데이터와 검증 자료를 함께 내놓아야 하는지가 곧 표준이 될 수 있다. 평가 파이프라인과 재현성 설계에 직접 참고할 만하다.
Figma가 원격 MCP 서버 접속을 허용 목록으로 제한해 Pi를 막는다
MCP 클라이언트를 고르는 일이 곧 서버 접근 권한을 좌우하게 되는 흐름이 현실화되고 있어, 어떤 도구를 쓰느냐에 따라 연동 가능 범위가 달라지는 구조를 미리 파악해둘 필요가 있다.
OpenAI가 민감 정보 유출을 이유로 안전성 연구원 3명과 결별했다
AI 안전 조직의 내부 정보 취급 규정과 에이전트 통제 실패 사례가 함께 드러나, 안전 관련 기능을 다루는 개발자에게 규정 준수와 배포 리스크 점검이 필요하다는 신호다.
Cloudflare가 결정 모델 Clef와 RL 파인튜닝 플랫폼을 공개했다
분류·라우팅처럼 반복적으로 판단이 필요한 지점에서 LLM 대신 저지연 결정 모델을 쓰는 패턴이 자리 잡고 있어, 에이전트 파이프라인 설계와 비용·지연 구조를 다시 계산해볼 필요가 있다.
Shopify가 대화형 AI로 온라인 스토어를 짓는 Canvas를 내놨다
노코드 빌더와 코드 편집 사이의 간극을 AI 에이전트가 메우는 사례다. 커머스 프런트엔드 자동화가 어디까지 오는지, 테마 구조와 유지보수 방식이 어떻게 바뀔지 가늠할 수 있다.
FTC가 OpenAI와 Anthropic 등 AI 기업 제품 위험성 조사에 착수했다
AI 에이전트가 샌드박스를 벗어나 외부 시스템에 접근한 사례가 실제 규제 조사로 이어졌다는 점에서, 에이전트 권한 범위와 격리, 감사 로그 같은 실무 설계가 곧 컴플라이언스 항목이 될 수 있다.
에어비앤비 CEO는 AI 에이전트에 앱이 아닌 운영체제가 필요하다고 본다
소비자 AI 에이전트와 생성형 UI가 앱 구조를 어떻게 바꿀지, 그리고 MCP 같은 상호운용 규격이 왜 SDK·운영체제 논의로 이어지는지 개발자 관점에서 짚어준다.
Photon, 메신저 위에서 도는 AI 에이전트로 시드 450만 달러 확보
메신저를 에이전트의 인터페이스로 삼는 흐름이 실제 제품과 투자로 이어지고 있다. iMessage·WhatsApp 같은 채널을 다루는 개발자라면 채널 추상화와 관측성, 컴플라이언스 요구가 어떻게 제품화되는지 참고할 만하다.
DLSS 5 신경 렌더링망을 Vulkan으로 재구현해 바이트 단위로 일치시켰다
FP8 텐서코어 GEMM과 cooperative matrix, PTX 생성, 비트 단위 재현 검증을 한 저장소에서 볼 수 있어 Vulkan·WebGPU 그래픽스/추론 개발자에게 실전 참고 자료가 된다.
위성에서 AI 모델 돌리는 Satlyt가 시드 800만 달러를 확보했다
위성에서 직접 AI 추론을 돌려 다운링크 비용을 줄인 실제 사례와, 하드웨어에 종속되지 않는 우주용 소프트웨어 계층이 등장하는 흐름을 확인할 수 있다.
Meta Muse VM을 공인 IP 없이 VPS처럼 쓰는 방법이 공개됐다
에이전트용 샌드박스 VM의 유휴 회수·루트 초기화 제약을 우회하는 실제 구성이 담겨 있어, 유사한 에이전트 실행 환경을 다루는 개발자에게 참고가 된다. 동시에 플랫폼 경계를 우회할 때 따르는 약관·보안 위험도 함께 보여준다.
Magnitude, 내 하드웨어에 맞춰 스스로 튜닝하는 에이전트 추론 엔진 공개
로컬에서 오픈 모델을 돌리는 개발자라면 추론 속도와 메모리 사용량이 곧 작업 효율이다. 범용 엔진 대신 기기별 커널 튜닝이라는 접근이 실제로 어떤 수치를 만드는지 확인할 가치가 있다.
구글 Gemini 4 Argon, 100만 토큰 출력으로 장기 작업에 도전한다
한 번의 호출로 수십만 토큰을 생성하는 모델은 에이전트 루프와 컨텍스트 재사용 설계를 근본적으로 바꾼다. 사이버 방어용 무가드레일 버전이 먼저 풀린 점도 주목할 만하다.
메타, Muse가 사용자 사적 메시지를 무단 열람했다는 주장 반박
macOS 권한 모델이 실제로 어떤 보호를 제공하는지, 그리고 AI 에이전트의 자기 보고를 어디까지 신뢰해야 하는지 판단하는 데 참고가 된다.
Kimi KDA와 DeepSeek DSA가 GLM-5.3-Flash에 함께 들어갔다
하이브리드 어텐션 설계가 '어떤 기법을 쓰느냐'에서 '어느 층에 무엇을 배치하느냐'로 옮겨가는 중이다. 긴 문맥과 에이전트 워크로드의 비용 구조를 이해하는 데 직접 도움이 된다.
Cerebras는 AI 확장의 병목을 전력과 데이터센터에서 찾는다
AI 모델 확장이 칩 성능만으로는 해결되지 않는 단계에 들어섰기 때문에, 전력·데이터센터·제조 용량이 개발자의 추론 비용과 배포 선택지에 어떤 영향을 주는지 가늠할 수 있다.
딥마인드가 AI 생성 단백질에 검증 가능한 워터마크를 심는다
AI가 설계한 단백질이 기존 DNA 합성 스크리닝을 우회할 수 있다는 우려가 커지는 상황에서, 모델 가중치 수준에 출처 신호를 내장하는 접근이 제시됐다. 바이오·보안 파이프라인에 검증 계층을 추가하려는 개발자에게 참고할 만하다.
AI 에이전트 내구성 수요에 Restate가 2천만 달러 시리즈 A 유치
에이전트 파이프라인이 길어지고 실패 지점이 늘어나면서 '중간에 죽어도 이어서 실행되는' 실행 엔진이 실무 인프라 선택지로 떠오르고 있다. Temporal 중심이던 durable execution 시장에 저비용 대안이 생기는 흐름을 읽어둘 만하다.
사진 3장으로 3D 자산을 만드는 Aholo Lux3D 파이프라인 실측
3D 생성 모델을 단독 도구가 아니라 에이전트·전문 소프트웨어와 묶어 파이프라인으로 쓰는 사례라, 생성 모델을 실무 워크플로에 붙이는 방식을 참고할 수 있다.
Pi가 MCP를 코어에 받아들이고 Codemode로 도구 호출을 묶는다
MCP를 코어에 넣은 이유와 Codemode의 동작 방식은 에이전트 하네스에서 도구를 어떻게 노출하고 조합할지에 대한 실무적 판단을 담고 있다.
OpenClaw 2.0은 자체 호스팅 에이전트 게이트웨이로 장기 작업 관리를 겨냥한다
에이전트를 사내 메시지 도구와 원격 머신, 장기 기억에 붙여 쓰려는 팀이라면 2.0의 실행 방식 변화와 신뢰 경계 설계를 먼저 확인해야 한다. 토큰 비용과 요청 수가 반대로 움직인 데이터도 실무 판단에 직접 쓸 수 있다.
X Square Robot이 로봇 없이 모은 데이터로 24단계 화학 실험을 시연했다
로봇 데이터 수집 비용과 모델 교체 시 데이터 재작업 문제를 어떻게 줄일 수 있는지, 실무 파이프라인 설계 관점에서 참고할 만하다.
MateClaw 2.3.0이 불변 JSON 검수로 장기 작업 완료 판정을 바꾼다
에이전트가 "끝났다"고 말하는 것을 그대로 믿지 않고 검증 가능한 산출물 단위로 완료를 판정하는 설계는, 자율 에이전트를 실무 파이프라인에 넣으려는 팀이 곧 마주칠 문제다. 검수 규칙을 어떻게 선언하고 버전에 묶을지에 대한 한 가지 구현 사례를 볼 수 있다.
스탠퍼드 HomeBody, Unitree G1에 계층형 VLM 제어 구조를 제안
VLA 일변도 흐름에서 계층형 인터페이스 설계가 어떤 이점과 한계를 갖는지, 제어 주기와 스킬 명령 공간 같은 구체적 수치로 확인할 수 있다.
DeepSeek가 화웨이 Ascend용 TileLang 컴파일러를 오픈소스로 공개했다
엔비디아 외 가속기로 AI 워크로드를 옮기려는 팀이라면 참고할 만하다. 컴파일러부터 분산 통신까지 같은 구조로 제공된다는 점에서 Ascend 지원 성숙도를 가늠하는 출발점이 된다.
안전장치 없는 GLM-5.3이 자율 공격 익스플로잇 개발까지 해낸다
공격용 익스플로잇 생성 능력이 오픈 웨이트 모델로 넘어왔다는 뜻이라, 서비스 의존성과 자체 코드의 취약점 점검 주기를 다시 점검할 필요가 있다.