【AI前沿】Mistral AI 开源形式化验证大模型 Leanstral 1.5

2026-07-07

Leanstral 1.5 – Mistral AI 开源的形式化验证大模型AI工具7小时前发布AI小集03Leanstral 1.5是什么Leanstral 1.5 是 Mistral AI 开源的形式化验证大模型,专为 Lean 4 自动定理证明优化。模型采用 119B 参数 MoE 架构,支持 256k 超长上下文与图文输入。模型在 miniF2F、PutnamBench 等数学证明基准上达到 SOTA 性能,能推动 AI 形式化数学验证与代码正确性证明的自动化。Leanstral 1.5的主要功能自动定理证明:基于 Lean 4 语言自动生成完整的形式化数学证明,覆盖代数、几何、数论等高难度领域。形式化验证:对软件代码与数学命题进行严格逻辑验证,确保每一步推导符合 Lean 4 的类型系统与公理体系。图文联合推理:支持在证明过程中解析并理解数学图表、公式截图等多模态输入,辅助复杂几何与符号推导。长文档证明生成:凭借 256k 上下文窗口,可处理整本教材或长篇论文级别的证明任务,保持跨章节逻辑一致性。Agent 式交互证明:用代码 Agent 模式自主调用 Lean 4 编译器、检索数学库并迭代修正错误,实现端到端自动化。微信关注回复“开源”,加入AI开源项目交流群Leanstral 1.5的技术原理稀疏混合专家架构(MoE):总参数量 119B,每 token 仅激活 6.5B 参数,在保持推理效率的同时实现大模型容量。Lean 4 专用语料训练:在大量形式化数学库(如 mathlib4)、竞赛题(IMO、Putnam)及人工标注证明路径上进行后训练。强化学习微调:通过证明成功与否的明确反馈信号,结合 RL 优化策略网络,提升复杂定理的搜索与构造能力。多模态编码器融合:集成视觉编码器,将 LaTeX 公式图片、几何图表转化为与文本统一的嵌入表示,实现跨模态联合推理。长上下文位置编码:采用支持 256k tokens 的扩展位置编码方案,保证超长证明链条中的依赖关系不丢失。如何使用Leanstral 1.5访问 HuggingFace 下载权重:前往 https://huggingface.co/mistralai/Leanstral-1.5-119B-A6B 获取开源模型文件与配置文件。配置 Lean 4 运行环境:本地安装 Lean 4 编译器及 mathlib4 依赖库,确保模型生成的代码可被正确解析与验证。加载模型并接入证明接口:使用 Transformers 或 vLLM 加载模型权重,通过 API 或本地脚本将自然语言命题转化为 Lean 4 代码。启动自动证明 Agent:调用模型生成证明策略,模型会自动迭代编译、报错修正与库检索,直至获得proof complete或达到尝试上限。在线快速体验:登录 Mistral AI Console(https://console.mistral.ai/),选择labs-leanstral-1-5端点直接输入命题进行验证。Leanstral 1.5的核心优势推理成本极低:MoE 架构下每 token 激活 6.5B 参数,相比同性能 Dense 模型大幅降低 GPU 显存与算力消耗。数学基准全面领先:在 miniF2F 达到 100% 饱和、PutnamBench 解出 587/672 题、FATE-H 达 87%,均为当前 SOTA。原生支持 Lean 4:针对形式化验证领域深度优化,生成的代码可直接通过 Lean 编译器检查,避免通用模型常见的语法错误。超长上下文支持:256k 上下文使其能处理整本书籍或大型软件规范的形式化验证,远超同类竞品的窗口限制。Leanstral 1.5的项目地址项目官网:https://mistral.ai/news/leanstral-1-5/HuggingFace模型库:https://huggingface.co/mistralai/Leanstral-1.5-119B-A6BLeanstral 1.5的同类竞品对比对比维度Leanstral 1.5DeepSeek-Prover-V2开发方Mistral AIDeepSeek开源协议Apache 2.0(完全开源)MIT(开源)架构119B MoE(每 token 6.5B)671B MoE(每 token 37B)专用语言Lean 4Lean 4miniF2F 性能100% 饱和高分但未公开饱和上下文长度256k tokens128k tokens多模态支持支持图文输入主要支持文本推理成本每 token 激活参数少,成本低激活参数量大,成本较高Leanstral 1.5的应用场景数学研究辅助:帮助数学家快速验证猜想、生成引理证明草稿,加速代数几何、数论等领域的探索。竞赛培训与解题:自动解答 IMO、Putnam 等高水平数学竞赛题,并提供可机器验证的完整形式化解答过程。软件正确性验证:为航空航天、金融系统等关键软件生成形式化规约与验证证明,替代部分人工审计工作。教育领域自动批改:在高等教育中自动验证学生提交的 Lean 4 证明作业,给出精确到每一步的反馈。AI 安全对齐验证:用于验证复杂 AI 系统的逻辑一致性、策略安全性,通过形式化方法确保关键决策无漏洞。# AI工具# AI项目和框架©版权声明本站文章版权归AI工具集所有,未经允许禁止任何形式的转载。上一篇Elements Claw - 阿里达摩院推出的超导材料发现 AI 智能体下一篇Fun-ASR-Realtime - 阿里千问推出的流式实时语音识别模型相关文章PaperTT – AI论文写作平台,能生成结构完整、排版规范的论文范文AI小集3Imglarger – 在线AI图像处理工具,支持无损放大8倍图像尺寸AI小集2Akkio – AI广告分析平台,优化广告投放定制媒体策略AI小集2TopView – 在线AI视频剪辑工具,一站式制作高质量营销视频AI小集3MCPHub – 一站式MCP服务器聚合平台AI小集5Chonkie – RAG文本分块库,基于Token、单词、句子和语义的多种分块方法AI小集4暂无评论再想想发表评论暂无评论…热门工具豆包LibTV秒哒AiPPT秘塔AI搜索TRAE编程堆友Agent美图设计室绘蛙AISekoupdream办公小浣熊最新收录西米AITDreamSkildArtStreamLake虾345Digen AI最新文章ChatGPT Plus 和 Claude Pro 会员代充值 – 支持支付宝54分钟前一点妙笔 – AI公文写作工具,一键生成合规材料55分钟前Hy3 – 腾讯混元开源的混合专家模型1小时前Fun-ASR-Realtime – 阿里千问推出的流式实时语音识别模型1小时前Elements Claw – 阿里达摩院推出的超导材料发现 AI 智能体7小时前FuckClaude – 开源的浏览器环境自测工具,是否会被CC标记7小时前ComAct – 上海AI Lab等推出软件自动化操作的研究范式1天前EdgeBench – 字节跳动推出的 AI 学习能力基准测试框架1天前Page Agent – 阿里开源的 JavaScript GUI 智能体库1天前Vidu S1 – 生数科技推出的实时交互视频基础模型2天前Ego Lite – 专为AI Agent设计的浏览器,实现人与AI协同工作2天前Chichi-pui – AI图像生成与分享平台,专注日系风格2天前AReaL 2.0 – 蚂蚁等开源的Agent在线强化学习基础架构2天前video-use – Browser Use 团队开源的 AI 视频剪辑 Agent3天前跃迁维度 – 一站式国产 AI 模型 API 聚合平台3天前