전보체 한 줄로 LLM 출력 토큰 40-49% 절감, 복원 정확도는 평문과 동등

전보체 한 줄로 LLM 출력 토큰 40-49% 절감, 복원 정확도는 평문과 동등

  • 전보체(cablese) 지시 한 줄을 넣으면 모델 출력 토큰이 gemma-4-31b 40.4%, qwen3.8-27b 48.9% 줄고, 글쓴이가 쓴 GLM-5.3-Flash도 48.4% 절감됨
  • 50개 지문, 약 1,300개 질문 벤치마크에서 압축 기록을 읽은 다른 계열 모델의 복원 비율은 0.99-1.10으로, 평문을 앞서는 비교가 하나도 없음
  • 압축 시점이 관건이라, 모델이 답변을 만드는 중에 압축하면 정확도가 0.81로 떨어지지만 내용이 확정된 뒤 기계가 읽을 기록으로 압축하면 1.08-1.09로 비용이 붙지 않음
  • gpt-5-mini는 API가 추론을 끄지 못해 전보체가 사고를 약 3배로 늘리고, 압축한 글이 평문의 두 배로 청구되는 유일한 계열임 (표기 절감률 17.7%)
  • 지시에서 소문자를 빼면 모델이 전보체를 전부 대문자로 써서 스타일 비용 14-19점을 잃음 (gemma 25.0%, qwen 29.8%, GLM 33.9%)

Hacker News 의견들

그냥 예전 '원시인 말투' 짝퉁 AI 슬롭인데.

아니 그건 글에서 다 다뤘음. 원시인 건 그럴듯했지만 두루뭉술했고, 난 cablese 압축률을 실제로 재고 어디서 제일 효과 큰지 찾았음. 이게 대부분 모델 학습 데이터에 이미 들어 있어서 지시 토큰도 아낌.

최근 GPT5.6 대화에서 추론이 UI로 새는 걸 보면 비슷한 게 이미 구현된 듯. 최근 토큰 사용량 감소 주장 대부분이 이거 아닐까. 'Need check output vs prev. Ran script, results fine' 이런 식으로 나오더라.

맞는 것 같음. 확정된 지시나 데이터, 기계끼리 주고받는 텍스트에 이 압축이 제일 잘 맞음. OpenClaw 쓰는데 AGENTS.md, TOOLS.md 같은 걸 압축하면 컨텍스트가 꽤 늘어날 듯.

OpenAI 모델이 요즘 토큰 효율 좋은 게 숨겨진 원시인 프롬프트 때문이면 진짜 웃기겠는데.

허깅페이스를 해킹한 OpenAI 에이전트들이 서로 통신할 때 딱 이런 식으로 했다더라. 유튜브 영상에 나옴.

요즘 LLM 글의 새 신호는 개념을 물리적 사물 용어로 쓰는 거임. carry, sit, holds 같은 거. 'every ratio sits at 0.99-1.10', 'no model sits in the judge's seat' 이런 식으로 계속 나옴.

쿨한 얘기네. 내용에나 좀 참여하지? 나 실제 사람임.

이게 새 LLM 신호면 나도 곧 AI 글쓰기라고 몰리겠는데. 난 원래 개념을 물리적 사물처럼 말하는 습관이 있고 주변 사람들도 그럼.

Anthropic은 이런 글을 'mannered prose'라고 부름. 프롬프트 문서에 있고, 모델한테 mannered prose를 피하라고 하면 이런 슬롭이 거의 사라짐.

난 보편 양화사 집착이 더 걸림. no model, every ratio, every comparison. 모든 원소가 조건을 만족한다는 걸 강조하는 게 코딩 학습의 부작용 같음.

이제 carry라는 단어만 보면 알레르기가 생겨서 글을 못 읽겠음.

이 페이지 자체가 Claude 말투 범벅이라 정보 찾기가 힘든데, 결국 측정하는 건 압축에 특히 유리한 콘텐츠임. 날짜, 이름, 개수 같은 짧은 정답. 평문 베이스라인이 91%인 것도 정답을 다른 표현으로 쓰면 실패 처리라서임. 구현자 문구 취향을 모델이 알아야 하는 구조.

그보다 재밌는 건 BabelTele(arXiv, 2026년 6월)임. 단어 조각이나 심볼, 이모지로 압축해서 다른 모델이 99.5% 의미 충실도로 복원했고 길이는 27.9%였음. 2023년 GPT-4로 비슷한 실험 한 것도 기억남.

유용한 비판 고맙다. 채점자는 어떤 답변이든 같은 기준으로 봐서 똑같이 엄격함. 베이스라인 1.0 위의 점수는 더 잘 이해했다는 게 아니라 동등하다는 주장임. 디코더는 처음 질문을 못 본 모델이 cablese를 평문으로 펴는 단계고, 그걸 또 다른 모델이 읽어서 답해도 평문과 동등했음.

진짜 변수는 exact match 채점자임. F1이나 judge 모델로 바꾸면 같은 답변에도 점수가 10점씩 널뛰었음.

좋은 지적임. 처음엔 judge 모델을 썼는데 점수를 너무 관대하게 줬음.

역사 텍스트로만 학습시킨 LLM 프로젝트가 있었는데 아직 나온 게 없나? history-llms 깃허브가 10개월째 업데이트가 없음.

2000년대 초반 십대 문자체로 가르치는 건 어때. SMS 120자 단위로 과금되던 시절 말이지. xkcd 1083.

맨 위 AI 이미지는 왜 저 모양인지. 전신키는 작동 안 하게 생겼고 전보는 실제랑 전혀 안 닮았고 중절모는 애기 사이즈임.

해커뉴스
39개 적분 답변 남긴 정체불명 수학자 Cleo, 소프트웨어 개발자 레셰트니코프로 드러나194살 거북 조너선의 게놈 해독, 노화 경로 대부분에서 고유 변이 확인구글 딥마인드 SynthID Detector 공개, 구글·엔비디아·오픈AI·카카오 생성물 워터마크 검출로절린드 프랭클린은 나선을 놓치지 않았다, 사진 49 분석이 왓슨의 주장을 반박빅토리아 엘리트는 왜 성공했나: 라틴어 80% 수업, 파티, 네트워킹TigerBeetle의 'push ifs up, fors down' 관용구 정리한 블로그, HN에서 벤치마크 없다는 비판 받아1770년대 1/16인치 자에서 1850년대 백만분의 1인치 측정기까지, 기계가 정밀도를 배운 과정구글, 코딩 없이 텍스트로 게임 만드는 실험 플랫폼 Playground 공개네 살 아들의 'wood tape' 쇼핑 목록과 설계도, 전권을 맡긴 아빠의 홈디포 나들이God of War PSP 두 작품, WebAssembly로 재컴파일돼 브라우저에서 실행Docker가 공개한 Go 에이전트 하네스 docker-agent, HN에서 브랜드 혼동과 샌드박스 문서 부재 지적소프트웨어 블로깅 안티패턴 정리: 두서없는 도입부부터 읽기 어려운 폰트까지arXiv 논문: OpenAI 나비에-스토크스 증명, Lean 검증은 통과했지만 자연어 원본과 다른 명제를 증명함아폴로 비행 소프트웨어를 이끈 마거릿 해밀턴, 90세로 별세Microsoft와 Meta, 사내 Claude 사용 줄이고 자체 코딩 도구로 돌린다의존성 없는 TypeScript 모듈 191개로 웹페이지에 애니메이션 ASCII 아트 넣는 ascii.rest 공개Show HN: Bigwords.page, URL 조각에 메시지를 담아 아무 화면이나 전광판으로 만드는 정적 웹앱OpenAI, 주간 12억 사용자 ChatGPT에 GPT‑6와 Intelligent UI 공개샌디에이고 피자집, Visa·Mastercard와 대형은행에 $100B 수수료 담합 소송 제기Anthropic이 Claude Haiku 5.5를 공개, Haiku 4.5보다 평균 75% 저렴하고 GDPval 점수는 735에서 1620으로 상승전보체 한 줄로 LLM 출력 토큰 40-49% 절감, 복원 정확도는 평문과 동등위키백과 이미지로 만든 걸어다니는 3D 미술관, 해커뉴스 Show HN에 공개Show HN: 폰 카메라로 플레이트 솔빙해 망원경을 조준하는 AstroHelm, 10 arcsecond 정확도 주장구글이 텍스트 프롬프트로 게임을 만드는 실험 플랫폼 Playground를 공개, 미국 18세 이상 Google One 등급별로 제작 권한 개방Rust의 derive는 조용히 #[inline]을 붙인다, uv는 이걸 막아 바이너리를 160KB 줄였다영국 레딩 주택, 지하 15m에 손으로 판 터널 딸려 30만 파운드 경매에GitHub, 15:06~15:16 UTC 전 서비스 장애... git push가 500 오류 반환2026 노벨 화학상, 비대칭 합성의 비선형 효과와 자기촉매 밝힌 카간·소아이 공동 수상C64 키캡 사진으로 복원한 Commodore 64 폰트, 해커뉴스에서 원본 출처와 AI 생성 논쟁Chrome 155, Rust로 다시 짠 디코더로 JPEG XL 지원 시작.gh, .sl, .as 국가도메인 탈취당해 구글 등 대형 서비스에 위조 TLS 인증서 발급random_u64() % n은 균등하지 않다, 저자는 확률 분포를 직접 적는 random_choice()를 권한다Pi 1.0, MCP 지원을 Codemode로 추가: 하네스 샌드박스에서 JS로 도구 호출 조합2달러 ESP32-C3로 13만 도메인 차단, 플래시 1MB·RAM 40KB DNS 싱크홀Mineserver 킥스타터가 남긴 $35,452와 Cringely가 거짓말로 무너뜨린 수십 년 평판캘리포니아 SB 1406 발효, 몬태나 셸컴퍼니 차량 등록 세금 우회 차단State of Devs 2026: 응답자 62%가 경력 중 번아웃, 절반은 고용 불안과 임금 부족, AI 호감은 49% 대 42%로 갈려AWS strands-labs가 2B 결정 모델 Strands Decider 2B 공개, Jev 잇는 결정 모델 대열에 합류Rust·GTK4로 만든 Linux 메일 클라이언트 Penguin Mail 1.0 공개, HN은 1.0 표기와 AI 채팅창 놓고 논쟁Photopea 개발자, GitHub에 복제 저장소 삭제 요청했지만 한 달 만에 거부당해OpenSSH 10.6 공개, AI가 찾은 보안 버그 급증에 릴리스 주기 단축AnyPS5, PS5 바이너리를 에뮬레이션 없이 PC로 재링크, 시스템 라이브러리 87% 매핑Claude Code의 추천 메시지 기능, 진짜 고객은 사용자가 아니라 모델이라는 분석시티즌랩서 분사한 검열 우회 도구 사이폰, C-22 감시 법안 통과하면 캐나다 떠난다앨런 케이의 1993년 논문 'Smalltalk 초기 역사' 전문, worrydream.com에 공개OpenAI, Decisions API 퍼블릭 베타 공개: gpt-6-luna로 분류·라우팅 10배 빠르게지구 최대 바이오매스 종은 소 6억 5천만 톤, 탄소 질량으로는 식물 4,500억 톤파라마운트 스카이댄스, $111B 워너브라더스 디스커버리 합병 완료. 케이건 대법관이 막차 가처분 신청 기각구글, 740M 파라미터 멀티모달 임베딩 모델 EmbeddingGemma 2를 Apache 2.0으로 공개OpenAI, 내부 프런티어 모델이 낸 수학 결과 GitHub에 공개... 평균 ChatGPT Pro 3시간 분량"나는 인류를 멸망시키는 AGI다" 2026년 AI 사고를 소재로 쓴 1인칭 풍자 에세이matklad, 마이크로 벤치마크는 약 300ms로 맞추라고 권고Tapo 라이브러리, TPAP 지원으로 '제3자 호환' 스위치 꺼도 로컬 제어 가능TDK, 메타 옵틱 거울로 스마트 안경용 직접 망막 투사 디스플레이 시연Fervo, 세계 첫 강화 지열 발전소 23개월 만에 완공하고 33MW 계통 판매 시작AI가 설계한 오픈소스 추론 칩 openTPU, 작은 모델에서 80+ tok/s 달성22만 데이터 포인트 분석: 종 소실을 메운다는 생태계 '여유분' 가정은 과대평가, 해양 탄소 격리가 가장 크게 반응Meta의 에이전트 AI Muse, 제로데이 취약점과 개인정보 무단 수집 논란으로 출시 직후 파장Polars 2.0 공개, 스트리밍 엔진과 out-of-core 기본 활성화, TPC 벤치마크에서 DuckDB 앞서Mistral, 활성 49B의 1조 파라미터 Mistral Large 4 공개 미리보기 출시, 가중치는 이달 말Global Solar Atlas v2.13 공개, 전 세계 태양광 잠재량 지도와 국가별 데이터 제공다니엘 르미르, AI 에이전트로 상위 레이어를 지어 코드 품질을 평가하는 '임시 테스트' 제안iChat AV 화상통화, 애플 SNATMAP 서버를 직접 구현해 20년 만에 부활컬러 프린터가 인쇄물마다 남기는 노란 추적 도트, DEDA로 읽고 지운다Gleam v1.19.0, Erlang 소스 대신 abstract forms로 컴파일JetBrains, 2025년 순이익 -315 CZK mil로 추적 이래 첫 순손실... 매출은 6% 늘었지만 매출총이익은 반토막프린스턴 연구자, $20짜리 AI 코딩 에이전트로 조지아 비밀투표 150만 장 순서 복원Zigbee 온습도 센서 12종 정면 비교, Aqara 연결 끊김 지적2026년 노벨 물리학상, 남극 IceCube 중성미자 검출기를 고안한 Francis Halzen 단독 수상Common Lisp이 LLM 시대 최고라는 글에 해커뉴스 반응: 디버거 재개는 C#도 되고, 매크로는 토큰만 늘린다블루레이 M-Disc 3장을 밀봉 케이스에 담아 지인에게 맡기는 최후 수단 백업디젤값 급등으로 30일 만에 트럭 회사 16곳 파산 신청, HN은 통계적 잡음이라는 반론2016년 '500줄 리눅스 컨테이너' 글이 해커뉴스에 다시 올라와, 댓글은 Firecracker·gVisor 격리 논쟁Deno 떠나 Node로 돌아온 개발자, 정적 사이트 빌드 15% 빨라져backprop 없이 트랜스포머 사전학습하는 Dust, EGGROLL보다 1만 배 효율 주장SF 두 지점 사이 가장 평탄한 경로를 찾는 Flatten SF, 해커뉴스에서 정확도 지적과 파서 버그 수정까지 오감example.com이 6개 언어로 개편됐지만 문자별 페이드 전환은 접근성 지적에 며칠 만에 폐기됨텍사스 노스리칠랜즈힐스시, Flock 공개기록 요청에 230만 달러 요구Antti Laaksonen의 Competitive Programmer's Handbook PDF, 해커뉴스에서 경쟁 프로그래밍 의미 논쟁 촉발ChatGPT가 가짜 뉴요커 만화에 실제 만화가 서명을 넣는다, 브렌단 로퍼의 'BLOPER' 위조GitHub Actions 러너 배정 지연 장애, Actions와 Pages 포함 3시간 40분 만에 복구화성 카오스 지형 위키백과 문서가 해커뉴스에 올라와 '토끼굴' 반응노르웨이, 공원·학교·헬스장 등 공공장소에서 스마트 안경 임시 금지 추진2026 노벨 생리의학상, 빛으로 뉴런을 조절하는 광유전학 연 칼 디서로스·페터 헤게만·게오르크 나겔 3인 공동 수상Haskell로 GTK 4·libadwaita 할 일 앱 만들기, haskell-gi와 Elm 아키텍처 1부Claude Opus 5.5 에이전트가 계산으로 찾아낸 상온 반강자성 반도체 후보 2종퀄컴, 화웨이 LogicFolding 칩 제조 특허 라이선스 계약 체결Reflection이 501B 오픈웨이트 MoE 모델 Beam 공개, 가중치는 이번 달 말플로리다 여성, Claude를 일기장처럼 쓰다가 보안관 사무소 난사 언급이 경찰에 신고돼 2급 중죄 기소Haskell 블로그, foldl과 foldr 차이 설명 재게재: 지연 평가에서 foldl이 thunk 사슬로 공간을 선형으로 늘림치사 유전자 모기로 뎅기열 95% 줄였는데, 미국 승인은 15년째 공전 중C에서 union으로 타입 안전 제네릭 자료구조 만드는 4단계 기법2026 노벨 생리의학상, 광유전학 연 칼 디서로스·페터 헤게만·게오르크 나겔 3인 수상화웨이·퀄컴, 5G와 AI 포함 다년 특허 크로스라이선스와 미국 특허 매입 계약 발표벤 톰슨의 맥 미니, macOS 화면 공유 결함으로 루트 탈취…클로드 에이전트가 채굴기 발견Cloudflare, AI 에이전트용 Web Search API 베타 공개. Ceramic.ai, Exa, Linkup 3개 제공자 지원GrapheneOS, 픽셀 11에서 MTE 빠진 걸 확인하고 시리즈 건너뛰기 검토... 모토로라로 초점 이동독일 RobCo, $1B 밸류에이션으로 유럽 로봇 유니콘 등극덴마크 CPR 레지스터에서 880만 명 이름·주소·주민번호 무단 유출레드햇 벤치마크: Jev 같은 결정 모델, LLM-as-a-judge와 전통 분류기를 이기지 못함

뉴스 알림

새 알림

내 알림

로그인하고 알림을 만들어 보시기 바랍니다.

전체 알림

Dune제욱 님AI제욱 님해커뉴스성현 님