멀티버스, AA 지수 43점의 영어·스페인어 추론 모델 Quasar 438B를 API로 공개
- Multiverse Computing의 Quasar 438B는 Artificial Analysis Intelligence Index v4.1.1에서 43점을 받아 기사 기준 유럽 모델 중 최고점 기록, Claude Opus 5의 63점에는 못 미침
- Quasar 438B는 추론 시간을 포함해 500토큰을 15.3초에 생성하며, 비교 대상 중 Gemini 3.7 Flash만 더 빠르고 지수 점수도 높음
- 긴 문서에서 정보를 추출하고 연결하는 AA-LCR에서 75.0점을 기록해 Grok 4.6 high와 같고 Claude Opus 5의 75.7점보다 0.7점 낮음
- 터미널 환경 에이전트 평가인 Terminal-Bench v2.1에서 69.3점을 기록했으며, Mistral Medium 3.5보다 18.7점 높고 Claude Opus 5의 89.1점보다 낮음
- 모델은 영어와 스페인어를 지원하며, 자체 인프라 구축 없이 시험할 수 있도록 CompactifAI API로 제공됨
Hacker News opinions
Qwen3.8-27B보다도 낮은 점수인데 '유럽 최고' 기준이 꽤 낮다는 생각이 든다. 그래도 다음 세대에서 나아지길 바람
438B급 파라미터를 쓰고도 점수가 이 정도인 건 의외임. 그래도 유럽 안에서 인력과 노하우를 쌓는 출발점은 될 수 있겠지
나는 오픈 웨이트 모델이면 어느 나라에서 나왔는지는 별로 안 따짐
나는 유럽인이라 출처를 따짐. 지정학과 디지털 주권을 무시할 수는 없잖아
오픈 웨이트라도 백도어가 있을 수 있고, 앞으로는 실행에 특수 하드웨어를 요구할 수도 있음. 출처와 신뢰 문제를 피할 수 없다고 봄
나는 모델이 중립적이라는 말에 동의 못 함. 무엇을 답하고 거절할지 사람 평가자가 정하니, 미국 거대 부호나 중국 당 간부의 관점 대신 유럽의 기준을 선택할 여지가 필요함
Qwen3.8 27B가 전혀 상관없는 요청에서 routify-file-proxy-sg.oss-ap-southeast-1.aliyuncs.co로 fetch하려 한 적이 있음. 허용 목록 규칙이 있어서 알아챘는데, 이런 건 발견하기도 어렵더라
문제는 다음 모델임. 중국이 공개 웨이트 배포를 멈추기로 하면 그 모델에 묶이고, 자체적으로 새 모델을 만들 산업도 없으면 끝임
특정 입력 토큰, 시간대, IP, 이름에만 반응하는 스파이용 학습이 들어가도 알아채기 어려울 거임. 오픈 웨이트는 블랙박스라서, 최소한 학습 자료와 만든 쪽을 신뢰할 근거가 필요함
나는 소유권이 더 중요하다고 봄. 이미 민간 서비스가 마음대로 접근을 끊는 걸 봤고, 유럽에서 통제 가능한 비슷한 모델이 Alibaba에 의존하는 것보다 낫지
검색을 대체할 기술이라면 중국처럼 국가가 '진실'을 정하는 곳 한 군데에서만 나오면 안 됨. 주요 지역마다 좋은 모델이 하나씩은 있어야 선택권이 생김
OpenRouter 연동 계획은 없나?
나는 공개 가능한 자료만 쓰고 학계가 정제한 데이터로 학습한 모델을 원함. 기업 데이터 찌꺼기가 섞이는 건 원치 않음
그런 데이터 정제는 작업량이 엄청날 거고, 저작권 자료와 기업 데이터가 빠지면 최신 최고 성능에는 못 갈 가능성이 큼. 필요한 학습 말뭉치 규모가 너무 다르니까
나는 200GB RAM 이하에서 로컬로 돌릴 만한 모델이 중국산만 남는 상황은 원치 않음. Quasar가 API 전용이고 허깅페이스에서 받거나 OpenRouter의 싼 요금제로 쓸 모델보다 못하면 실제 채택은 적을 것 같음
유럽 거주자 개인정보를 건드리는 작업은 적어도 유럽에서 호스팅해야 할 수 있으니, 이건 작은 틈새만은 아님. 정확한 EU AI Act 기준은 더 확인하고 싶음
인도가 LLM 경쟁에서 이렇게 안 보이는 건 아직도 놀라움. 인도 최고 인력은 미국이나 유럽의 높은 연봉과 생활 여건을 택하는 게 더 합리적일 수 있음
인도는 미국으로의 인재 유출이 크고 GPU 연산 자원도 부족함. 유럽과 비슷한 제약을 겪는 셈임