Mistral, 활성 49B의 1조 파라미터 Mistral Large 4 공개 미리보기 출시, 가중치는 이달 말
- Mistral이 활성 파라미터 49B인 1조 파라미터 네이티브 멀티모달 Mistral Large 4(별칭 le Chonk) 공개 미리보기를 내놓았고, 가중치는 이달 말 공개 예정임
- 유럽 자체 데이터센터의 NVIDIA Grace Blackwell GPU 3,800개로 처음부터 학습했고, 가중치 공개 전까지 사이버보안 기관과 파트너가 완화 필터를 줄인 같은 모델로 레드팀을 진행 중임
- Artificial Analysis Cyber Index 상위 5위, 취약점 재현 후 패치 테스트에서 82%로 전체 1위, Cybench 40문제 중 93% 해결. Claude Opus 5.5와 GPT-6 Astra는 같은 테스트를 거부해 거의 0점임
- 학습 데이터 상당 부분이 160개 이상 언어로 EU 모든 공식 언어를 포함함. 고객용 Mistral Forge와 같은 학습·커스터마이징·RL 환경을 씀
- HN에서는 벤치마크가 예상보다 좋다는 반응과 함께 약 1년 뒤처짐이라는 평가, DS Flash V4.1에 맞선 50% 할인이라는 관측이 나옴
Hacker News 의견들
이거 좀 큰일인 것 같은데? 벤치마크가 주장대로면 Mistral이 날 조금 틀리게 만들었음. 기분 나쁘진 않다.
DeepSWE에서 GLM 5.3이랑 동급이라고 주장하더라.
중국 회사들이 연구를 다 공개하는데 Mistral이 따라잡는 게 이상한 일은 아니지.
OpenAI랑 Anthropic이 KV 캐시 비용 통제하는 데 확실히 도움이 됐음.
다들 서로 베껴먹는 건 비밀도 아님.
벤치마크가 예상보다 좋음. 증류 없이 여기까지 왔다는 게 놀랍고.
로컬로 돌아가는 중국 오픈 웨이트 모델을 증류 안 했다고 볼 이유가 있나?
DS Flash V4.1이랑 가격 경쟁하려고 50% 할인하는 것 같더라.
비전 벤치마크가 인상적임. astra만큼 좋다면 세계 최고 수준이고, 사이버도 중국 모델보다 앞서니 방어용으로 제격임. Mistral 까는 사람들 많은데 숫자는 괜찮음.
유럽 놀리는 건 뭐 때문에?
Mistral이 SOTA를 앞당긴 적이 있나? 없다면 왜 존재하는 거지? 소버린 AI는 농담이고, GPU 시간 80%를 지난 세대 프리트레이닝 재현에 쓰는 셈임.
미국 트릴리언 달러 회사나 중국 것 말고 유럽이 직접 가진 고품질 오픈 모델이 왜 필요하겠어?
프랑스 군대가 지난 100년간 SOTA를 앞당긴 적 있나? 없으면 왜 존재하지?
사이버보안 같은 건 특히 미국이나 중국 정부 하류에 있고 싶지 않잖아.
OpenRouter의 Space Bunny Alpha가 이건지 합의가 있나?
Space Bunny Alpha는 아마 MiniMax M3.1이라는 게 트위터 루머임. 토크나이저가 비슷하대.
API로 풀리면 기꺼이 지원할 생각임. 로컬 Qwen3.8 27B 잘 쓰고 있지만 구독 속도랑 동시성이 그립다.
여전히 1년 정도 뒤처진 것 같음. vals.ai 인덱스 보면 대략 1년 전 모델 수준임.
AI가 승자독식 폭주 게임이 아니라는 게 흥미롭다. Large 3에서 크게 넘어진 뒤에도 Mistral이 살아 있는 게 반갑고, 유럽의 go-to가 되길 바람.
DeepSeek 같은 회사가 논문으로 설명서를 뿌리는 게 큰 몫임.
경쟁 구도가 웹 검색보다 클라우드 컴퓨팅에 가까운 것 같음.
10년 전엔 예측 못 했을 것 같음. 똑똑한 모델이 나오면 합성 데이터랑 도구가 싸져서 경쟁자도 빨라지니까.