Mistral 发布 Mistral Large 4 预览版 Le chonk
Mistral 发布 Mistral Large 4 预览版,这是一个 1 万亿参数、490 亿激活参数的模型,在自家 3,800 块 NVIDIA Grace Blackwell GPU 集群上训练,目前通过其 API 提供。
Mistral 发布 Mistral Large 4 预览版,这是一个 1 万亿参数、490 亿激活参数的模型,在自家 3,800 块 NVIDIA Grace Blackwell GPU 集群上训练,目前通过其 API 提供。
法国 AI 实验室 Mistral AI 发布大模型 Mistral Large 4(ML4),这是一个 1 万亿参数的多模态模型,因参数量被昵称为 Le Chonk。
基于 Falcon-H1-Arabic 的方言专用模型 Falcon-Emirati-7B 发布,专注理解与生成阿联酋阿拉伯语,涵盖词汇、语气与文化语境。
Reflection 发布 Beam,一个面向编码、智能体与科研任务的纯文本 MoE 模型,总参数 501B、激活 23B,从零训练,Apache 2.0 全量权重预计本月放出。
推荐理由:Reflection 从隐身状态交出首个开源权重模型,读者可据此判断美国开源阵营与 DeepSeek、GLM 等中国模型的相对位置。
Reflection AI 发布首款前沿开源权重模型 Beam,称其在高级推理基准上与中国领先开源模型持平,且推理算力消耗低 3-4 倍。Beam 是 5010 亿参数、230 亿激活参数的文本 MoE 模型,预训练使用 23.8 万亿 token,上下文窗口 100 万 token,公司称其性能与 Z.ai 的 GLM-5.2 相当并优于当前西方领先开源模型。
Ai2 开源 AstaBrief 8B,一个把研究问题和检索到的文献片段转成带引用报告的小模型,基于 Qwen3-8B 训练,已作为 Asta 的 Fast 模式上线,同时开放模型权重和训练数据。
推荐理由:原文给出了从 Qwen3-8B 出发的 SFT 加 DPO 训练配方与数据过滤经验,可迁移到其他垂直领域小模型。
NVIDIA 发布开源表格基础模型 Kumo Tabular,给定带标签的表格行即可在单次前向中预测新行标签,支持分类与回归,无需训练、调参和特征工程。模型提供 28M 到 215M 三种规模,仅用人工合成表格预训练,采用 OpenMDW-1.1 许可可商用,并在 TabArena、BeyondArena、TALENT 和 ScoringBench 四个基准上排名第一。
推荐理由:原文给出模型规模、单次前向预测方式和四个基准排名,可据此判断表格基础模型对现有建模流程的替代空间。
Google DeepMind 与 Google Research 发布 WeatherNext 3,称其为目前最先进的全球天气模型,可基于实时卫星数据每小时生成一次预报,地表变量分辨率达 5 公里,整体比 WeatherNext 2 清晰约五倍。
推荐理由:官方给出分辨率、更新频率与降水精度提升幅度,可据此判断 AI 天气预报在 Google 产品中的落地程度。
微软研究院推出 GigaPath-Flash 和 GigaTIME-Flash,用蒸馏自十亿参数 GigaPath 编码器的 22M 参数 ViT-S 骨干替代原模型,在 PANDA 前列腺分级和 EBRAINS 脑肿瘤分型基准上以约 50 倍更少算力达到原 GigaPath 3% 以内的性能。
微软研究院发布深度学习交换关联泛函 Skala 1.1,训练数据量为此前公开版本的 2.5 倍,在 GMTKN55 基准 55 个类别中 32 项排名第一,加权平均误差 2.8 kcal/mol。Skala 现已在 CP2K 中可用,并正集成进 Psi4、FHI-aims、ORCA 和 VASP,同时推出持续追踪各版本计算性能的 living benchmark。