테렌스 타오, AI의 무분별한 열린 문제 수확 경고하며 'Math 2.0' 제안

테렌스 타오, AI의 무분별한 열린 문제 수확 경고하며 'Math 2.0' 제안

  • 테렌스 타오가 Math 2.0을 제안하며, AI가 열린 문제를 자율적으로 풀어내는 방식이 전통적 돌파구에서 따라오던 후속 활동을 말라붙게 만든다고 지적함
  • AI 프롬프터는 목표 문제를 푼 뒤에는 분야 자체에 관심이 없고, 결과를 설명하거나 강연할 만큼 AI 출력을 이해하지도 못해 세미나·워크숍·협업이 거의 생기지 않음
  • 이미 해결된 문제는 되돌릴 수 없고 해법의 존재 자체가 다른 경로 탐색을 오염시켜, 열린 문제가 지속 불가능한 속도로 대량 수확되고 있다고 봄
  • 유망한 열린 방향은 스쿠프 우려 때문에 공개되지 않고 있으며, 타오는 Math 1.0이 최우선시한 '최초 해결'의 비중을 낮추고 설명과 커뮤니티 구축, 새 방향 개척을 평가해야 한다고 주장함
  • 교육, 출판, 경력 평가 기준을 Math 2.0 시대에 맞게 수학계가 명시적으로 다시 세워야 하며, AI는 이 방향들에도 기여할 수 있지만 그냥 AI 에이전트에 문제 목록을 던지는 발상으로는 안 된다고 밝힘

Hacker News 의견들

흥미로운 문제를 형식화해서 기존 수학 코퍼스에서 새 질문을 자동 생성할 수 있으면 좋겠는데, 그렇게 되면 인간 역할은 지능을 이해하는 것만 남는 거 아님? 좀 씁쓸함.

그건 그냥 푸는 데 걸리는 시간으로 재면 되지 않아? 5분 넘게 걸리면 그 분야를 잘 이해하지 못한다는 뜻이고 투자할 가치가 있다는 신호임.

결국 취향(taste) 문제임.

UCLA가 탑 저널 논문 제일 많은 후보를 안 뽑게 되는 날이 오면 알려줘. 그보단 PI가 박사 2명에 10만 달러 주던 걸 1명만 뽑고 나머지 5만 달러를 AI에 쓰는 쪽으로 갈 듯.

수학과 채용은 원래 저널 실적 기준이 아니었음. 저널은 너무 느리고, arXiv랑 강연으로 퍼진 한두 개의 굵직한 결과로 평판을 쌓아서 뽑더라.

모델 지능이 정체하면 타오 말이 맞지만 계속 좋아지면 프롬프터가 아무것도 이해할 필요가 없어짐. 그냥 모델한테 증명 설명해달라고 하면 되니까. 지금 격차가 생기는 건 모델이 자기 능력 한계선에서 발견하고 있어서 설명을 못 하는 거임.

그게 무슨 소리임. 타오도 설명 잘하기로 유명한데 내가 몇 달 배워도 못 알아들을 수 있음. AI가 초인적으로 설명해도 인간이 이해한다는 보장은 없음.

이건 타오 얘기가 아니라, 예전에 'AHM이 OpenAI 10월 6일 수학 문서 공개에 낸 성명'도 같이 봐야 함.

조기 비관론자들 말은 이제 안 들어도 됨. LeCun이나 Gary Marcus는 아직도 그러고 있고 Marcus는 기준을 계속 옮기고 있음. 타오는 애초에 비관론자가 아니었고.

문제가 풀려도 더 단순한 증명이나 따름정리를 내는 건 원래 가치가 있었음. 타오는 이쪽으로 초점이 옮겨가야 한다는 거고, 근데 나는 모델이 그런 것도 우리보다 잘하게 될 거라고 봄.

가치는 있는데 그 기여만큼 보상이 안 따라옴. 논문 심사도 똑같고.

모델이 코드를 더 우아하게 짜는 것 같진 않음. 오히려 더 바로크한 구조를 제안하더라. 정확성은 RL로 최적화할 수 있어도 느낌을 최적화하기는 훨씬 어려움.

이건 그냥 작년부터 테크 업계에서 하던 얘기랑 같은데. 수학을 아무 분야로 바꿔도 말이 됨.

그렇게 단순하진 않음. 분야를 세 갈래로 나누면, 마라톤 선수처럼 인간 경험이 전부라고 버티는 쪽, 수학처럼 내부가 갈라져 있는 쪽, 결과만 우선해서 돈 되는 만큼 뽑아내는 쪽임. 수학은 예술에 가까워서 시장 압력에서 잘 격리돼 있으니 1번을 택할 명분이 충분함.

균형 잡힌 시각이고 걱정도 타당함. AI가 수학을 바꾸는 건 인정하지만 증명만 던져놓고 검증과 정제, 확장은 남이 하라는 건 분야 발전에 도움이 안 됨. 벤치마크 숫자에만 관심이 쏠려 있음.

너무 근시안적임. 몇 년 전엔 모델이 이것도 못 했는데, 결과를 탐구하고 다듬는 게 모델 능력 밖이라거나 앞으로도 그럴 증거는 없음.

그냥 다른 챗봇한테 검증시키면 안 되나? 코딩할 때 하는 것처럼.

몇천 명 수학자가 자기들 방식대로 당하는 거임. 머신러닝과 LLM을 만든 게 엄청난 수학 재능을 가진 사람들이었고, 그걸로 말하고 쓰고 가르쳐서 먹고사는 수억 명이 불안해졌으니까. 그래도 다들 괜찮아질 거라고 봄.

AI가 새 추측을 잘 만들어낼 수도 있고, 그러면 수학자 일부는 응용수학이나 다른 과학 쪽으로 옮겨갈지도 모름.

해커뉴스
엔비디아, 미국 오픈 모델 스타트업 Reflection AI 인수 협상 중DuckDB 2.0 알파, S3 읽기가 2배에서 3배 빨라져 쿼리 수정 없이 적용됨샌프란시스코 개발 시뮬레이션 게임 Discretionary Review, 도시가 개발을 말리는 2015년 설정Knuth 책 첫 문단 첫 단어의 오류를 찾아 받은 리워드 체크, 20년 만의 후기MXC 1.0 정식 출시, 정책으로 AI 에이전트의 실행 범위를 제한천장 전구에 프로젝터와 컴퓨터 비전을 넣은 Lightbulb Computer 설계 프로토타입집값은 오르고 재산세는 내려야 한다는 모순, 미국 재산세 개혁의 함정저수준 코더가 LLM 시대에 느끼는 상실감과 개발자 일의 변화1996년 주말 프로젝트 2D 차량 물리가 GTA 차량 시스템의 뿌리가 된 과정과 30주년 웹 재현판Rust 코드를 읽기 쉬운 C로 바꾸는 Eurydice, 고신뢰 소프트웨어와 Rust 컴파일러 없는 환경 겨냥프리온 질환 후보 약물 siRNA, 사람 대상 1상 임상 등록 시작Jane Street 인턴, 자기회귀 디퓨전으로 주식 호가 이벤트 생성 실험macOS 26 Tahoe, 오픈그룹 UNIX 인증 메인 목록에서 빠져Cloudflare 무료 티어에서 돌리는 개인 AI 에이전트 Talorys, 자체 호스팅 정의를 두고 HN 논쟁Lean 자동 형식화의 신뢰성 논쟁: AI가 만든 증명이 원 논문과 맞는가WSL 3.0.2, 커널 6.18로 올라와 메모리 대역폭 61% 향상되나 빌드 시간은 4%만 줄어Bitwarden, 앱스토어 배포본을 상업 라이선스 빌드로 전환하며 오픈소스 논란 확산벽 너머 몰래카메라를 내장 메모리의 전자기 방사로 찾아내는 ESauron, 20m 밖에서도 탐지덴마크 CPR 등록부 해킹, 침투 지점은 '123456' 비밀번호였음Telegram Desktop 링크 한 번 클릭으로 사용자 파일이 유출되고 계정까지 탈취될 수 있던 취약점캐리어 설정을 디코딩해 비교하는 carrier-explode 2.0 공개, 아이폰 픽셀 갤럭시 펌웨어 대상TypeSafe AI, $870M 투자 유치하고 기업가치 $7.5B 인정받아REA, 코딩 에이전트에 리버스 엔지니어링 도구를 붙여 프로그램 동작을 설명하게 하는 오픈소스 프로젝트경찰 추적용 Flock 카메라를 만든 유튜버, 경찰 방문을 받았다고 주장Oxide, $445M 시리즈 D 유치하고 첫 소득세 납부AAA 게임 관행을 비튼 지뢰찾기 패러디가 해커뉴스 화제Cloudflare, Deno 팀 영입하고 Deno 런타임은 1년 뒤 개발 종료Rust로 포팅한 Quake, 브라우저에서 바로 실행되는 Show HN 프로젝트StepFun의 1M 컨텍스트 MoE 모델 Step 5 Preview가 OpenRouter에 등장함, 활성 파라미터는 27B임530만 년 전 고래 사체가 쌓인 심해 공동묘지, 인도양 해저서 발견Mitchell Hashimoto가 터미널 프로그램 상태 알림용 OSC 7501 명세를 공개함리눅스용 이더넷 오디오 인터페이스 ETH-68, 왕복 지연 3.620ms로 RME 카드와 맞먹음Bevy 0.20 출시, Solari 렌더러 개선과 WESL 셰이더 공식 채택24V로 구동하는 유연한 LED 필라멘트 네온 티셔츠, Show HN에 올라옴오르쿠트 창업자가 orkut.com에서 서명 청원을 열고 실제 사람 중심 SNS 재건을 호소함AI 음원을 봇으로 재생시켜 로열티를 빼먹은 미국 남성 징역 18개월 선고$5 VPS로 뭘 24시간 돌릴지 묻는 HN 글, 답은 대부분 홈서버임DuckLake 저장소, DuckDB v2.0-cyanoptera로 버전 올리고 Postgres 재시도 로직 병합ADHD를 생체리듬 장애로 보고 수면 시간 조절 치료를 제안하는 리뷰AI 시대 프로그래머 진로, htmx 저자 Carson Gross는 직접 코드를 써봐야 읽는 능력이 생긴다고 주장테라노스 사무실을 브라우저에 재현한 Extend 마케팅 사이트가 HN에 오름일러스트레이터에게 집 그림을 맡겨 만든 Home Assistant 대시보드, HN에서 화제부모님 커피머신이 10일간 1TB 트래픽을 쏟아내 아들이 분리함DeepSeek 4.1 Flash, 프런티어 모델과 구분 안 될 만큼 싸고 성능 좋다는 사용 후기오픈AI 연간 환산 매출, 앞서 알려진 $70B에서 $50B로 정정16.9 MB 음성 인식 모델 Whistle 공개, CPU에서 첫 토큰 11.1 ms, Whisper base보다 작음4시간 배터리 저장장치, 분석 대상 43개 시장 전부에서 가스터빈보다 저렴OpenAI, 수학 결과 3건 철회하고 Lean 형식화 현황 공개함DVD 메뉴의 기술 구조와 16:9 시대의 설계 변화Zotero 20주년 글, 5년 걸린 느린 설계가 오래 가는 소프트웨어를 만들었다는 주장Claude Opus 5.5가 프롬프트 한 번으로 Invisible Cities 3D 시각화를 1시간 25분 만에 완성함HN 작성자, 10년째 탄자니아 시골 학생 학비를 개인 돈으로 지원 중트럼프 행정부, 마이크로소프트를 영주권 프로그램에서 정지시키고 사기 혐의 제기브라우저에서 도는 아날로그 컴퓨터 시뮬레이터, 적분기 5개와 포텐쇼미터로 지수 감쇠 재현OpenAI, 부호 오류 하나로 수학 논문 3편 철회하고 14편 수정LLM으로 TypeScript 컴파일러·체커·LSP를 Rust로 옮긴 ts-rust, 토큰 $400,000 주장에 실제 지출은 $24,000Swift로 만든 최소 커널, QEMU virt에서 부팅1993년 PC 데모를 x86 리컴파일로 브라우저에서 네이티브 실행, 사이클 타이밍까지 대조 검증2006년 UK 인디 차트 47위 밴드 Salvage, 15년 추적 끝에 프로듀서 크레딧에서 찾아냄요트에서 오프그리드로 사는 Hundred Rabbits, Donsol 10주년 재출시하고 일회용 패드 암호화 문서 공개OpenAI, UGC 증명 포함 372개 수학 결과 하루에 공개... '인간은 아직 아무것도 이해 못 해'테렌스 타오, AI의 무분별한 열린 문제 수확 경고하며 'Math 2.0' 제안39개 적분 답변 남긴 정체불명 수학자 Cleo, 소프트웨어 개발자 레셰트니코프로 드러나194살 거북 조너선의 게놈 해독, 노화 경로 대부분에서 고유 변이 확인구글 딥마인드 SynthID Detector 공개, 구글·엔비디아·오픈AI·카카오 생성물 워터마크 검출로절린드 프랭클린은 나선을 놓치지 않았다, 사진 49 분석이 왓슨의 주장을 반박빅토리아 엘리트는 왜 성공했나: 라틴어 80% 수업, 파티, 네트워킹TigerBeetle의 'push ifs up, fors down' 관용구 정리한 블로그, HN에서 벤치마크 없다는 비판 받아1770년대 1/16인치 자에서 1850년대 백만분의 1인치 측정기까지, 기계가 정밀도를 배운 과정구글, 코딩 없이 텍스트로 게임 만드는 실험 플랫폼 Playground 공개네 살 아들의 'wood tape' 쇼핑 목록과 설계도, 전권을 맡긴 아빠의 홈디포 나들이God of War PSP 두 작품, WebAssembly로 재컴파일돼 브라우저에서 실행Docker가 공개한 Go 에이전트 하네스 docker-agent, HN에서 브랜드 혼동과 샌드박스 문서 부재 지적소프트웨어 블로깅 안티패턴 정리: 두서없는 도입부부터 읽기 어려운 폰트까지arXiv 논문: OpenAI 나비에-스토크스 증명, Lean 검증은 통과했지만 자연어 원본과 다른 명제를 증명함아폴로 비행 소프트웨어를 이끈 마거릿 해밀턴, 90세로 별세Microsoft와 Meta, 사내 Claude 사용 줄이고 자체 코딩 도구로 돌린다의존성 없는 TypeScript 모듈 191개로 웹페이지에 애니메이션 ASCII 아트 넣는 ascii.rest 공개Show HN: Bigwords.page, URL 조각에 메시지를 담아 아무 화면이나 전광판으로 만드는 정적 웹앱OpenAI, 주간 12억 사용자 ChatGPT에 GPT‑6와 Intelligent UI 공개샌디에이고 피자집, Visa·Mastercard와 대형은행에 $100B 수수료 담합 소송 제기Anthropic이 Claude Haiku 5.5를 공개, Haiku 4.5보다 평균 75% 저렴하고 GDPval 점수는 735에서 1620으로 상승전보체 한 줄로 LLM 출력 토큰 40-49% 절감, 복원 정확도는 평문과 동등위키백과 이미지로 만든 걸어다니는 3D 미술관, 해커뉴스 Show HN에 공개Show HN: 폰 카메라로 플레이트 솔빙해 망원경을 조준하는 AstroHelm, 10 arcsecond 정확도 주장구글이 텍스트 프롬프트로 게임을 만드는 실험 플랫폼 Playground를 공개, 미국 18세 이상 Google One 등급별로 제작 권한 개방Rust의 derive는 조용히 #[inline]을 붙인다, uv는 이걸 막아 바이너리를 160KB 줄였다영국 레딩 주택, 지하 15m에 손으로 판 터널 딸려 30만 파운드 경매에GitHub, 15:06~15:16 UTC 전 서비스 장애... git push가 500 오류 반환2026 노벨 화학상, 비대칭 합성의 비선형 효과와 자기촉매 밝힌 카간·소아이 공동 수상C64 키캡 사진으로 복원한 Commodore 64 폰트, 해커뉴스에서 원본 출처와 AI 생성 논쟁Chrome 155, Rust로 다시 짠 디코더로 JPEG XL 지원 시작.gh, .sl, .as 국가도메인 탈취당해 구글 등 대형 서비스에 위조 TLS 인증서 발급random_u64() % n은 균등하지 않다, 저자는 확률 분포를 직접 적는 random_choice()를 권한다Pi 1.0, MCP 지원을 Codemode로 추가: 하네스 샌드박스에서 JS로 도구 호출 조합2달러 ESP32-C3로 13만 도메인 차단, 플래시 1MB·RAM 40KB DNS 싱크홀Mineserver 킥스타터가 남긴 $35,452와 Cringely가 거짓말로 무너뜨린 수십 년 평판캘리포니아 SB 1406 발효, 몬태나 셸컴퍼니 차량 등록 세금 우회 차단State of Devs 2026: 응답자 62%가 경력 중 번아웃, 절반은 고용 불안과 임금 부족, AI 호감은 49% 대 42%로 갈려AWS strands-labs가 2B 결정 모델 Strands Decider 2B 공개, Jev 잇는 결정 모델 대열에 합류

뉴스 알림

새 알림

내 알림

로그인하고 알림을 만들어 보시기 바랍니다.

전체 알림

Dune제욱 님AI제욱 님해커뉴스성현 님