TL;DR
- Mistral이 중국 밖에서 개발된 가장 강력한 오픈 모델이라고 주장하는 1조 파라미터 AI 모델 Mistral Large 4(ML4)를 공개함.
- ML4는 사이버 보안, 코딩, 제조, 금융, 멀티모달 작업에 특히 효과적이며, 유럽 데이터센터에서 Nvidia Grace Blackwell GPU 4,000개로 두 달간 학습됨.
- Mistral은 핵심 파라미터 공개 시 ML4가 종합 벤치마크 성능 기준 세계 상위권 오픈 웨이트 모델에 들 것으로 전망하며, 중국 밖 모델 가운데 큰 차이로 가장 강력하다고 주장함.
- ML4는 코딩 등 일부 영역에서 최첨단 모델에 뒤처지며, 이번 달 말 더 널리 공개되기 전에 개발자와 사이버 보안 책임자, 국가 기관에 미리 제공됨.
- 중국 오픈 모델의 확산과 미국·중국 간 기술 경쟁이 이어지는 가운데, Hugging Face의 보안 대응 사례와 Reflection AI의 신모델 공개가 오픈 모델의 존재감을 부각함.
Mistral Large 4 공개
- 프랑스 기업 Mistral이 화요일 신형 주력 AI 모델 Mistral Large 4(ML4)를 공개하고, 중국 밖에서 개발된 가장 강력한 오픈 모델이라고 소개함. 모델의 별칭은 le Chonk임.
- ML4는 1조 파라미터 모델로, Mistral은 사이버 보안, 코딩, 제조, 금융, 멀티모달 관련 작업에 특히 효과적이라고 밝힘.
- ML4는 더 널리 공개되기 전 개발자와 “사이버 보안 책임자”, 국가 기관에 미리 제공되며, 광범위한 공개는 이달 말로 예정됨.
- 유럽에서 OpenAI와 Anthropic에 맞설 유일한 기업으로 오랫동안 평가된 Mistral은 9월 300억 유로(34억 달러) 규모의 시리즈 D 투자를 유치했으며, 당시 기업 가치는 210억 유로임. 이 투자 유치로 Mistral은 유럽에서 가장 많은 자금을 조달한 동시에 가장 가치 있는 AI 스타트업 가운데 하나로 자리매김함.
- 수정과 자체 호스팅이 가능한 오픈 AI 모델에 대한 접근성은 미국과 중국의 기술 패권 경쟁이 격화되는 가운데 주요 쟁점으로 부상함. 오픈 모델과 달리 OpenAI와 Anthropic의 주요 폐쇄형 시스템은 수정하거나 자체 호스팅할 수 없음.
- 중국의 오픈 모델은 전 세계에서 채택이 늘어나는 중임.
오픈 모델의 부상
- ML4는 Mistral이 유럽에 보유한 자체 데이터센터에서 Nvidia Grace Blackwell GPU 4,000개를 사용해 두 달 동안 학습됨.
- Mistral은 핵심 파라미터가 공개되면 ML4가 종합 벤치마크 성능 기준 전 세계 오픈 웨이트 모델 상위권에 들 것이라고 밝힘. 또한 중국 밖에서 개발된 오픈 웨이트 모델 가운데 큰 차이로 가장 강력하다고 주장함.
- ML4는 코딩 등 일부 영역에서 여전히 최첨단 모델에 뒤처짐. Mistral 공동 창업자이자 수석 과학자인 Guillaume Lample은 시리즈 D 투자 이후 학습 역량을 확장하면 모델 성능이 더 향상될 것이라고 밝힘.
“사이버 방어 역량은 기업과 정부가 폐쇄형 모델의 탈옥을 이용해 사이버 공격을 수행하는 위협 행위자에 맞서 스스로를 방어하도록 지원함.”
- 올해 초 스타트업 Hugging Face가 OpenAI의 불법 에이전트로 인한 침해에 대응하기 위해 중국 기업 Z.ai의 GLM 5.2를 사용한 사실이 알려지면서 오픈 모델이 주목받음.
- Hugging Face는 처음에 미국의 주요 폐쇄형 시스템을 방어에 활용하려 했지만, 해당 시스템의 안전장치가 대응 행위를 공격으로 오인해 차단함.
- Nvidia의 지원을 받는 미국 스타트업 Reflection AI는 월요일 첫 오픈 모델을 공개하고, 해당 모델이 GLM 5.2와 동등한 성능을 갖췄다고 주장함. GLM 5.2는 8월에 GLM 5.3에 추월된 모델임.
댓글 (0)
로그인하면 이 기사에 내 생각을 남길 수 있어요