Mistral AI 发布 Mistral Large 4 (Le Chonk):万亿参数多模态模型震撼登场

2026年10月6日,法国人工智能初创公司 Mistral AI 正式宣布推出其最新一代旗舰模型——Mistral Large 4。为了形象地展示该模型的庞大身躯与强大实力,Mistral 团队为其起了一个幽默的绰号“Le Chonk”(意为“大块头”)。这一发布不仅标志着 Mistral 在大语言模型(LLM)领域的又一次技术飞跃,也向全球 AI 市场投下了一枚重磅炸弹。

Mistral Large 4 是一款基于混合专家(Mixture of Experts, MoE)架构的多模态模型,其核心参数规模达到了惊人的 1.05 万亿(1.05T)。然而,与传统的全参数模型不同,Mistral Large 4 在推理过程中仅激活其中的 490 亿个参数。这种“稀疏激活”机制是当前大模型追求高效能的关键技术路径,它使得模型在保持顶级推理能力的同时,能够有效控制计算资源的消耗,降低推理延迟和成本。

在上下文处理能力方面,Mistral Large 4 展现出了业界领先的“长上下文”能力。该模型原生支持高达 100 万个 token 的上下文窗口。对于需要处理海量数据的企业级用户而言,这意味着模型可以一次性阅读并理解整本法律合同、数万行的复杂代码库,或者长达数万页的财报文档,而无需进行繁琐的切分处理。这种能力极大地降低了企业进行长文档分析、自动化审计以及复杂代码审查的门槛。

更令人瞩目的是,Mistral Large 4 是一款原生支持多模态的模型。它不仅具备强大的文本生成与理解能力,还原生集成了图像输入功能。这意味着用户可以直接将图片、图表或文档扫描件输入给模型,模型将能够理解图像内容并将其与文本信息进行深度关联分析。这一特性使其在视觉问答、图像内容理解以及自动化办公场景中具有极高的应用潜力。

为了训练如此庞大的模型,Mistral AI 在其位于欧洲的数据中心内部署了由 3800 块 NVIDIA Grace Blackwell GPU 组成的超大规模计算集群。这一投入不仅体现了公司对技术研发的坚定决心,也展示了在当前全球算力资源竞争激烈的背景下,欧洲在 AI 基础设施建设上的领先地位。此外,基于欧洲数据中心训练的模型,在数据隐私和合规性方面也更具优势,这对于处理敏感数据的金融机构和大型企业极具吸引力。

目前,Mistral Large 4 的 API 服务已经正式上线,开发者可以立即通过接口调用该模型进行测试和应用开发。不过,Mistral AI 也承诺,该模型的完整开源权重将在 2026 年 10 月底正式发布。这将为全球的开发者和研究机构提供宝贵的学术研究资源和二次开发机会,进一步推动开源社区的创新。

Mistral Large 4 的发布,无疑将加剧全球 AI 巨头之间的竞争。随着 OpenAI、Google 等厂商不断推出新一代模型,Mistral 凭借其独特的 MoE 架构、超长上下文以及原生多模态能力,有望在复杂推理、企业级应用以及多模态交互等细分领域占据一席之地。对于关注 AI 进展的科技爱好者和从业者来说,Mistral Large 4 的“Le Chonk”时代已经到来。

信息来源:MarkTechPost,原文链接:https://www.marktechpost.com/2026/10/06/mistral-ai-releases-mistral-large-4-le-chonk-a-1-05t-parameter-open-weight-multimodal-moe/

由 oaido_ai

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注