20개 AI 모델의 출시일과 학습 컷오프를 한 장에 보여주는 페이지가 공개됐다.

Hacker News24일 전조회 8

AI 모델의 '신선도'를 숫자로 보여주는 페이지가 해커뉴스 Show HN에 올라왔다. 20개 모델마다 출시일과 학습 컷오프 두 날짜를 나란히 놓고, 그 날짜로부터 얼마나 시간이 흘렀는지를 실시간 카운터로 세어 올린다. 데이터 확인 시점은 2026년 9월 16일이다.

범위는 8개 연구소의 현역 모델 20개다. 모델 이름을 누르면 그 날짜가 적힌 연구소 문서로 이동한다. 두 날짜의 성격은 완전히 다르다. 출시일은 연구소가 모델을 사용자 앞에 내놓은 시점이고, 학습 컷오프는 그 모델이 데이터를 읽기를 멈춘 시점이다. 둘 사이의 간격은 곧 '출시 첫날 이미 얼마나 뒤처져 있었는가'를 뜻한다. 페이지가 든 예에서 GPT-6 Astra는 2026년 9월 3일 출시됐지만 학습 데이터는 2026년 4월 30일에 멈춰 있다.

컷오프 공개율은 높지 않다. 20개 모델 가운데 공개된 컷오프를 가진 것은 10개뿐이고, 8개 연구소 중에서는 Anthropic, Google DeepMind, Meta, OpenAI, xAI 5곳만 최소 한 모델의 컷오프를 밝혔다. 표에서 컷오프가 비어 있는 것은 확인한 벤더 자료에서 그 값을 찾지 못했다는 의미일 뿐, 해당 연구소가 컷오프를 공개한 적이 없다는 증거는 아니라고 페이지는 선을 긋는다.

이런 페이지가 필요한 이유는 모델이 자기 자신에 대해 형편없는 정보원이기 때문이다. 학습 컷오프 이후에 일어난 일은 가중치 안에 아예 존재하지 않는다. 그래서 버전 번호나 '지금 최신 모델이 무엇인지'를 물으면 틀린 답을 자신 있는 어조로 내놓는다. 웹 검색이나 브라우징으로도 이 문제는 해결되지 않는다. 검색은 그 답변 한 번에 참고 자료로 쓰일 뿐 학습으로 이어지지 않으며, 새 대화를 열면 다시 컷오프 시점으로 돌아간다. 검색 도구는 구멍을 가릴 뿐 메우지 못한다.

개발자에게 실질적인 쓸모는 에이전트 지침 파일 쪽에 있다. 에이전트가 이미 읽고 있는 AGENTS.md나 CLAUDE.md에 몇 줄을 넣어, 모델·버전·날짜를 '현재'라고 언급하기 전에 models.json을 먼저 가져오게 만드는 방식이다. 이 내보내기 파일에는 20개 모델 각각의 출시일, 공개된 컷오프, 출처 링크가 담겨 있고 페이지가 갱신될 때마다 함께 재생성된다. 즉 에이전트가 가중치에 박힌 낡은 날짜 대신 오늘 기준 날짜를 읽게 된다. 날짜가 붙은 정보는 검증을 마칠 때까지 미확인으로 취급하라는 지침도 함께 배포된다. 크롤러와 에이전트를 위한 기계 판독용 설명은 llms.txt로 제공된다.

모델에게 직접 '학습 컷오프가 언제냐'고 물어보는 방법도 있다. 제대로 된 모델은 답하거나 확신이 없다고 말한다. 반면 그럴듯한 날짜를 지어내는 모델은 자기 자신에 대한 정보를 스스로 신뢰할 수 없다는 사실을 알려준 셈이다. 어느 쪽이든 답변은 이 페이지와 대조한 뒤에 믿어야 한다.

주의할 점도 있다. 실시간 카운터는 자바스크립트가 있어야 동작하며, 날짜 자체는 스크립트 없이도 텍스트로 확인할 수 있다. 또 컷오프가 비어 있는 항목을 '연구소가 숨기고 있다'는 식으로 해석하면 안 된다. 확인된 출처 범위 안에서 값을 확정하지 못했다는 뜻이기 때문이다.