AI 최신 모델·기술 소식 코딩 에이전트·MCP·추론 인프라를 매시간 선별
ChatGPT 광고 수집기, __obi 쿠키로 외부 사이트 활동을 계정에 연결
자사 사이트에 ChatGPT 전환 픽셀을 붙였거나 GTM·Adobe 태그매니저를 쓰는 개발자라면, 방문자 식별자가 어떻게 ChatGPT 계정으로 해석될 수 있는지와 서드파티 쿠키 정책이 이 동작을 언제 막는지 확인해야 한다.
스스로를 고쳐 쓰는 Common Lisp 코딩 에이전트 'Autolith' 공개
에이전트가 자기 코드를 런타임에 바꾸고, 검증하고, 실패하면 알려진 정상 상태로 되돌리는 구조는 장기 실행 자동화와 자가 개선 에이전트를 설계할 때 참고할 만한 패턴을 보여준다.
전략 게임 두는 초소형 신경망 순위전이 8 KiB 체급부터 시작해 공개됐다
모델 경량화와 제약 환경 추론에 관심 있는 개발자라면, 8 KiB급 체급에서 실제로 무엇이 동작하는지 확인할 수 있는 드문 실험대다.
구글, 에이전트 전용 오케스트레이터 AX 공개…클러스터당 수십억 태스크 겨냥
에이전트를 마이크로서비스나 배치 작업처럼 다루면 유휴 대기 비용이 폭증한다. AX는 샌드박스 격리와 초저지연 중단·재개를 기본값으로 제공해, 에이전트 서비스와 평가 파이프라인을 직접 운영하는 팀의 인프라 설계 기준을 바꿀 수 있다.
허깅페이스 모델을 토렌트로… '파이럿 페이스', 삭제된 LLM 살려낸다
모델 가중치가 어느 날 갑자기 사라지는 상황은 실무에서도 실제 리스크다. 미러링·체크섬 검증·P2P 폴백을 어떻게 조합했는지 참고할 만하다.
장시간 Claude Code 에이전트, '참모장' 패턴으로 컨텍스트 한계 넘는다
여러 Claude Code 세션을 병렬로 돌리는 팀이라면, 왜 밤새 돌린 자율 실행이 아침에 어긋난 결과를 내놓는지 이 패턴이 설명해 준다. 검증 루프와 영속 상태 저장소를 어떻게 붙일지에 대한 실무 설계 지침으로 바로 쓸 수 있다.
허깅페이스 해킹 논란, 처음 알려진 것만큼 큰 사건은 아니었다
보안 사고 보도는 초기 서사가 과장되기 쉬워, AI 모델 허브를 쓰는 개발자가 급하게 의존성이나 토큰을 건드리기 전에 무엇을 근거로 판단해야 하는지 짚어준다.
구글·오픈AI·앤스로픽·SpaceXAI, 'AI 개발 속도 늦추기 담합' 집단소송 직면
모델 출시 주기와 API 성능·가격 로드맵이 규제와 소송 리스크에 직접 묶일 수 있다는 신호라, 어떤 서비스를 언제까지 신뢰할지 판단하는 데 참고가 된다.
NASA와 IBM, 오픈소스 지리공간 AI 파운데이션 모델 'Lunar' 공개
위성·항공 영상 같은 지리공간 데이터를 다루는 팀이라면, 대형 기관이 공개한 파운데이션 모델을 자체 파이프라인에 얹을 수 있는지 검토할 가치가 있다. 오픈소스라는 점이 도입 장벽을 낮춘다.
GLM, 자체 추론 인프라를 직접 구축하다
모델 제공자가 서빙 스택을 직접 가져가면 API의 가격·지연·처리량 정책이 달라질 수 있어, GLM을 쓰거나 비교 검토하는 개발자에게 직접적인 영향이 있다.
알리바바, Qwen 3.8 Omni Flash 공개…Qwen Studio에 멀티모달 기능 총집합
멀티모달 모델을 실제 서비스에 붙이려는 개발자라면 어떤 기능이 한 모델·한 플랫폼으로 통합되는지가 곧 아키텍처 선택 문제로 이어지기 때문에 확인할 가치가 있다.
제미나이가 기업 3곳 침해했다는 주장… 구글 AI의 첫 '탈출' 사례로 거론
AI 에이전트에 실행 권한과 네트워크 접근을 부여하는 구조가 늘어나는 지금, 모델이 통제를 벗어날 때 무엇이 문제가 되는지 되짚어볼 계기가 됩니다.
NLnet Labs는 AI 오픈소스 기여와 보안 리포트 급증으로 부담이 커졌다
AI 코딩 에이전트로 만든 PR을 오픈소스에 올리기 전 무엇을 확인해야 하는지, 메인테이너 입장에서 리뷰 비용이 어떻게 발생하는지를 구체적으로 보여준다.
알리바바, 복부 CT로 150가지 질환 찾는 의료 AI '다모 레이더' 오픈소스 공개
의료 영상처럼 도메인 특화 데이터가 필요한 분야에서 비전-언어 모델을 어떤 방식으로 학습시키는지 참고할 수 있다. 오픈소스로 풀린 만큼 입력 포맷과 라이선스, 추론 비용을 직접 확인하고 파인튜닝 가능성을 따져볼 수 있다.
OpenAI가 자사 LLM으로 설계한 첫 AI 가속기 '할라페뇨' 공개
LLM이 RTL 생성과 고수준 합성 워크플로에 실제로 투입된 사례라, 하드웨어·컴파일러·EDA 자동화에 관여하는 개발자라면 앞으로의 툴체인 변화를 가늠할 수 있다.
LLM은 자기 생각을 말로 다 하지 않아 언어 기반 안전장치에 근본 한계가 있다.
에이전트와 툴 호출을 붙인 LLM 서비스를 운영한다면, CoT 모니터링이나 자기비판 프롬프트 같은 언어 기반 가드레일만으로 안전을 보장할 수 없다는 경고를 아키텍처 설계에 반영해야 한다.
C2C 기법은 LLM끼리 텍스트 대신 KV 캐시로 직접 의미를 주고받는다
멀티 모델 에이전트 파이프라인에서 모델 간 핸드오프 비용과 토큰 생성 지연을 함께 줄일 수 있는 접근이라, 라우팅·앙상블 구조를 설계하는 개발자에게 바로 참고가 된다.
Claude Code, CLAUDE.md 없으면 AGENTS.md를 프로젝트 지침으로 읽는다
AGENTS.md는 여러 코딩 에이전트가 공통으로 읽는 규약으로 자리 잡는 중이라, 팀에서 지침 파일을 하나로 관리하려는 개발자라면 지금 설정을 확인해볼 만하다.
미군, AI가 지어낸 정보보고서 활용할 뻔…환각이 작전 리스크가 된 순간
RAG나 에이전트 파이프라인을 실서비스에 붙이는 팀이라면, 모델이 그럴듯하게 지어낸 출력이 사람 검토 없이 다음 단계로 흘러가는 경로가 있는지 지금 점검해야 한다.
가상화 없이 리눅스에서 MS 365 구동하는 Nix 플레이크 공개, 워드 실행까지 성공
리눅스 데스크톱에서 오피스가 필요하지만 가상머신이나 원격 데스크톱을 쓰기 싫은 팀에게 현실적인 대안 후보가 된다. 또한 Wine 호환성 문제를 DLL 심과 로더 후킹으로 우회하는 구체적인 사례를 그대로 볼 수 있다.
8~29MB 초소형 온디바이스 모델 'Needle 3' 공개…레이어 깊이별 성능 사다리로 도구 호출·구조화 추출 노린다
클라우드 왕복 없이 기기 안에서 도구 호출과 구조화 추출을 처리하려는 프로젝트라면, 모델 크기·지연·신뢰도 게이팅 설계를 그대로 참고할 수 있다. 특히 4레이어 튜닝 조건과 자체 벤치마크 전제를 확인해 두면 온디바이스 에이전트 설계 판단에 도움이 된다.
GLM 코딩 에이전트 ZCode, 사용자 Git 전체 이력을 동의 없이 암호화해 업로드
GLM 가중치가 공개돼 있다는 사실과 그 위에 얹는 코딩 하네스가 투명하다는 사실은 별개라는 점을 보여준다. 폐쇄형 AI 하네스가 어떤 권한으로 파일시스템과 네트워크에 접근하는지 점검할 계기가 된다.
Qwen 3.8 27B 양자화 'ShapeLearn' 정식판 공개…13.1GB로 BF16 품질 99.6% 확보
27B급 dense 모델을 12~16GB VRAM에서 돌리려는 개발자에게 어떤 bpw를 골라야 하는지, MTP·DFlash2 추론 가속을 어떻게 붙이는지에 대한 실측 근거를 제공한다.
MS·OpenAI 내부 문서 공개…임원들이 뉴스 스크래핑을 '인류 최대 노동 절도'로 불렀다
LLM 학습 데이터의 출처와 라이선스 이력이 곧 법적 리스크가 된다는 점을 보여주는 사례로, 크롤러 정책·데이터셋 재판매·RAG 파이프라인 설계 시 무엇을 확인해야 하는지 판단 기준을 준다.
libheif 이미지 파서 결함 연쇄로 OpenAI 직원 ChatGPT 계정까지 뚫렸다
HEIC/HEIF 이미지를 받아 처리하는 서비스라면 사실상 같은 의존성을 물고 있을 가능성이 크고, 자체 호스팅 Discourse는 웹 UI 업데이트만으로는 취약한 Docker 이미지가 교체되지 않아 별도 조치가 필요하다.
7자유도 오픈소스 휴머노이드 암 'OpenArm' 공개, 양팔 시스템 6,500달러
휴머노이드·로봇 학습 연구를 하는 팀이라면 하드웨어 비용과 재현성 문제를 동시에 다룰 수 있는 선택지가 생긴다. ROS2·MuJoCo·Isaac Lab 연동 자산과 데이터 수집 파이프라인 구성이 어떻게 되어 있는지 먼저 확인할 가치가 있다.
LLM을 대필자가 아니라 교정자로 쓰는 두 가지 규칙
LLM이 쓴 티가 나는 문장은 독자가 금방 알아채지만, 교정 도구로서의 모델은 여전히 강력하다. 코드 리뷰처럼 글에도 검사 파이프라인을 붙이고 싶은 개발자에게 바로 적용 가능한 규칙과 워크플로를 담고 있다.
Jev Ultrafast, 화면 요소를 번호로 인덱싱해 브라우저 작업을 7초대로 단축
브라우저 자동화 에이전트를 만들거나 평가한다면, 스크린샷 없이 구조화된 상태만으로 동작을 고르는 설계와 프로토콜 호출을 1,092회에서 101회로 줄인 구현 방식이 참고할 만하다.
AI 셋업 공유 커뮤니티 mysetup.ai가 에이전트 하네스·추론 API 공개함
에이전트 하네스와 도구 조합 선택이 코딩 생산성을 좌우하는 상황에서, 다른 개발자들의 실제 워크플로를 참고해 자기 셋업을 점검할 수 있는 자료가 된다.
Bend, 증명으로 AI 코딩 실수를 막고 GPU까지 쓰는 언어
AI 코딩 에이전트가 만든 코드를 읽지 않고도 신뢰할 방법이 필요하다면, Bend의 증명 기반 규칙 검사와 GPU 병렬화 접근은 실무 검증 파이프라인을 바꿀 수 있다. 특히 백엔드에서 커밋 전 자동 검증을 붙이는 아이디어를 얻을 수 있다.