알렉스 에베를뢰프 "코딩은 풀리지 않았다", AI는 책임질 수 없어서 위임도 안 된다
- 저자 알렉스 에베를뢰프는 LLM이 코드 생성 비용을 낮췄지만 유지보수, 신뢰성, 보안, 확장성 같은 비기능 요구사항(NFR)이 전체 비용의 대부분이라 코딩은 풀린 문제가 아니라고 주장함
- 코드를 읽지 않아도 되는 제품은 개인용 소프트웨어, POC, 무기화된 AI 세 가지뿐이며 의료, 금융, 자동차, 국방, 발전소, 항공, 제조는 실수의 대가가 돈, 목숨, 법적 책임으로 이어져 저위험 허용도 영역에 속함
- AI는 벌금이나 수감, 해고 같은 결과를 겪을 수 없어 accountable(책임)을 질 수 없고, 책임질 수 없는 대상에 책임을 위임할 수 없다는 논리로 글을 닫음
- 기능 요구사항(코드가 해야 할 일)조차 아직 풀리지 않았고, 출력을 읽지 않는 사람일수록 더 확신하는 단닝-크루거 효과가 작동한다고 지적함
- HN 토론에는 GitHub Copilot을 Rust로 전면 포팅한 사례(TypeScript 43만 줄을 Rust 80만 줄로, 토큰 비용 $12만, 14.5주, 135개 릴리스)가 올라왔지만 테스트 스위트와 기존 앱을 오라클로 삼은 기계적 포팅이라 신규 개발의 증거는 아니라는 반박이 붙음
Hacker News opinions
글쓴이임. 까는 소리 다 들을 각오 하고 왔음. AI 반대가 아니라 형편없는 결과물을 진보라고 밀어붙이는 게 지겨운 것뿐임.
GitHub는 LLM 나오기 전에도 자주 죽었음. 게다가 그때는 폭발적인 성장도 감당해야 했고. 문제 있는 쪽만 세면 당연히 나빠 보이지.
"코딩은 풀렸다"는 투자자 돈이 계속 들어오는 한 영원히 6개월 뒤에 있음. 핵융합 발전이랑 똑같음.
솔직히 왜 안 풀렸다는지 모르겠음. 최신 모델은 논문 던져주면 두 시간 만에 구현하고, 게임 엔진에 기능 추가도 시키면 그냥 함. 사람이 쓴 코드가 그렇게 완벽한 것도 아니고.
코딩은 풀렸고 소프트웨어 엔지니어링이 안 풀린 것임. 스펙과 코드를 분리해서 생각하는 것 자체가 이상한 발상이고.
Opus 5.5는 아직 반영 안 된 이야기임. 장기 계획 수립은 LLM에서 안 풀렸음. 다만 글의 핵심은 책임이라 그건 AI에 못 넘김.
Copilot을 Rust로 전부 포팅했는데 토큰 비용 $12만에 개발자 3주, 14.5주 동안 135개 릴리스, TypeScript 43만 줄이 Rust 80만 줄이 됐음.
그거 대단한 건 맞는데 Copilot 클라우드 에이전트는 공지도 문서도 없이 격주로 뭘 바꿔서 파이프라인이 깨짐. 돈 4~5자리 내는 유료 고객인데 티켓도 답이 없음.
파일 단위 포팅은 로컬 추론만으로 되는 일이라 신규 프로젝트 증거는 못 됨. 복잡도가 올라가면 무너지는 건 여전함.
테스트 스위트나 기존 앱을 오라클로 주면 어떤 AI든 그 동작을 맞출 수 있음. 진짜 놀라운 건 Copilot을 클린룸으로 처음부터 다시 짜서 더 나은 걸 만드는 경우임.
$12만에 43만 줄이면 비싼 편임. 한 줄에 수십 센트고, 런던 시니어 엔지니어 1년 총비용과 맞먹음. 보일러플레이트가 많았을 텐데.
80만 줄로 늘어난 코드를 아무도 이해 못 하는 게 문제임. AI가 메모리 관리 어려운 부분을 unsafe로 우회한다는 얘기도 있고.
AI 때문에 게으르고 무능한 개발자가 더 게으르고 무능해짐. 코드 리뷰는 사실상 죽었고, AI가 코드 짜고 AI가 리뷰하는 구조에서 결정적 결과를 기대하는 게 우스움. 나도 AI 매일 쓰는데 문제는 사람임.
유능해도 마찬가지임. 예전에 하루 100줄 쓰던 사람이 5,000줄을 뱉으면 리뷰가 불가능함.
요즘은 하네스와 셋업에 따라 상당 부분 풀려 있음. 기본 제공만 쓰면 안 풀리지만 잘 갖추면 다름.