리눅스 커널 패치 17.25%가 AI 생성 코드, 주간 제출 1,634건
리눅스 커널에 올라오는 패치 가운데 AI가 작성한 코드의 비중이 눈에 띄게 커지고 있다. 9월 들어 커널 패치 전체의 17.25%가 AI가 만든 코드였다는 집계가 나왔다. 커널 개발은 오픈소스 생태계에서도 리뷰 기준이 가장 까다로운 축에 속한다는 점을 감안하면, 이 숫자는 AI 코딩 도구가 실험 단계를 지나 실제 인프라 코드 생산에 들어왔다는 신호로 읽힌다.
구체적인 수치는 이렇다. 한 주 동안 AI가 작성한 커널 제출 건수는 1,634건으로, 주간 기준 최고치를 다시 갈아치웠다. 9월 누적 기준으로는 전체 커널 패치의 17.25%가 AI 생성 코드로 분류됐다. 이 관측은 The Lunduke Journal이 X를 통해 공개한 것으로, 매주 갱신되는 제출 통계를 근거로 삼고 있다.
배경에는 코딩 에이전트와 코드 생성 모델의 빠른 보급이 있다. 커널은 C 기반의 거대한 코드베이스이고, 서브시스템별 메인테이너가 패치를 검토한 뒤 머지하는 구조를 갖는다. AI가 만든 패치도 결국 사람 리뷰어의 검증을 통과해야 하므로, 비중이 늘어난다는 것은 리뷰 파이프라인에 들어오는 입력 자체가 달라지고 있다는 뜻이다.
개발자 입장에서 가장 직접적인 변화는 리뷰 부담이다. 같은 논의에서 한 개발자는 사내 코드를 AI에 넣고 결함을 찾게 하면 지적된 항목의 약 80%가 실제 버그여서 그대로 수정한다고 언급했다. 이런 방식이 자리 잡으면 언젠가는 고칠 진짜 버그가 바닥나는 시점이 온다는 관측도 함께 나왔다.
실무에서는 두 가지가 동시에 움직인다. 하나는 AI가 만든 코드를 걸러내는 리뷰 자동화이고, 다른 하나는 사람이 놓친 결함을 AI로 다시 훑는 검증 자동화다. 변경이 잦고 영향 범위가 넓은 코드베이스일수록 두 방향 모두 결국 리뷰어의 시간을 어디에 배분할지의 문제로 이어진다.
다만 이 수치는 공식 커널 개발 통계가 아니라 한 매체의 집계다. AI가 작성한 코드인지 여부를 제출자가 명시하지 않는 경우가 많아 실제 비중은 집계치보다 높을 수 있다는 주장도 제기됐지만, 이를 뒷받침하는 검증된 데이터는 제시되지 않았다. 앞으로 50%, 80%, 결국 전부가 될 것이라는 전망 역시 추세에 대한 예측일 뿐 확정된 사실이 아니다.
관련 글
- AI가 쏟아내는 코드의 '슬롭', 숫자로 잴 수 있을까Earendil의 Sebastian이 LLM이 생성한 코드의 품질 저하를 정량화하는 지표를 정리했다. SlopCodeBench의 verbosity·erosion 지표는 에이전트 코드가 사람 코드보다 약 2배 verbose하고 침식됐음을 보여준다.
- PS5 리눅스 프로젝트 리드, LLM 바이브 코딩 확산에 결국 손 떼다PS5 리눅스 프로젝트를 이끌던 앤디 응우옌이 LLM 기반 바이브 코딩 확산을 이유로 프로젝트 중단과 씬 은퇴를 선언했다. 그가 마지막으로 남긴 버전은 펌웨어 3.00~7.61을 지원하는 2.5이며, 최신 OS 대응은 사실상 막힌 상태다.
- Bend, 증명으로 AI 코딩 실수를 막고 GPU까지 쓰는 언어Bend는 AI가 생성한 코드의 오류를 수학적 증명으로 차단하고, C에 가까운 단일 코어 성능과 GPU 병렬 실행을 제공하는 새 언어다. LAWS.bend와 증명 검사로 커밋 전에 규칙 위반을 막는 워크플로를 제안하며, 개발자는 에이전트에 Bend 사용을 지시할 수 있다.