博通为OpenAI定制芯片研发寻求逾500亿美元融资
知情人士称,博通近几周一直在为与OpenAI共同开发的定制AI芯片寻求超过500亿美元融资,阿波罗和黑石等机构已就参与融资展开洽谈,谈判仍处早期阶段,融资规模可能调整。
推荐理由:融资规模与芯片代号首次披露,可了解OpenAI自研芯片项目的资金安排与推进节奏。
方向与市场
训练侧的门道:数据集构建、合成数据、预训练与后训练方法、算力与训练成本。
14 条精选近 30 天 13 条共收录 41 条
知情人士称,博通近几周一直在为与OpenAI共同开发的定制AI芯片寻求超过500亿美元融资,阿波罗和黑石等机构已就参与融资展开洽谈,谈判仍处早期阶段,融资规模可能调整。
推荐理由:融资规模与芯片代号首次披露,可了解OpenAI自研芯片项目的资金安排与推进节奏。
微软研究院开源 Agent Lightning v1.0,一个约 3500 行代码的轻量智能体强化学习框架,提出 Harnessed Agentic RL 范式,让部署时使用的 agent harness 直接参与训练,无需在训练框架内重新实现智能体。
推荐理由:微软研究院开源 Agent Lightning v1.0,读者可了解无需重写 harness 的智能体 RL 训练范式与 3500 行实现。
英伟达团队从 Nemotron 3 出发,用 SFT、RL 和生成-验证-精炼推理流程,让模型在 IOI 2026 拿到 535.4/600、在 IMO 2026 拿到 30/42,均超过官方金牌线。
推荐理由:原文公开了从 Nemotron 3 微调到 IOI、IMO 金牌级成绩的完整配方与数据集,可复用到其他高难领域。
Google Research 发布研究,用 Google Earth AI 的 Population Dynamics Foundation Model(PDFM)作为概念验证,展示自监督预训练的“地点”表征可作为即插即用输入接入现有流行病学模型,无需任务特定微调。
推荐理由:Google 用五个公共卫生案例验证地理空间基础模型嵌入可直接接入现有流行病学流程,读者可了解其验证范围与量化增益。
国金证券发布计算机行业研报,认为大模型能力突破、成本降低与开放权重模型加速迭代推动2026年AI应用百花齐放,重点看好铲子股/卖水人、Infra、定制化重的IT交付、与业务流程深度结合的行业软件四类方向。
推荐理由:国金证券以四类方向梳理AI应用长期跟踪逻辑,并用海外与国内厂商财报数据交叉印证需求。
国金证券发布计算机行业研报,指出大模型风险正从内容生成扩展到能调用工具、访问外部系统并修改现实状态的智能体。AISI数据显示前沿模型完成初级网络安全任务的成功率由2023年末低于9%升至2025年的50%,METR测得2023年后前沿模型在50%成功率下的任务时长翻倍周期约130.8天。
推荐理由:研报用AISI与METR数据说明智能体风险已从内容生成扩展到工具调用,并给出训练、评估、运行三阶段的防御框架。
Reflection 发布 Beam,一个面向编码、智能体与科研任务的纯文本 MoE 模型,总参数 501B、激活 23B,从零训练,Apache 2.0 全量权重预计本月放出。
推荐理由:Reflection 从隐身状态交出首个开源权重模型,读者可据此判断美国开源阵营与 DeepSeek、GLM 等中国模型的相对位置。
Ai2 开源 AstaBrief 8B,一个把研究问题和检索到的文献片段转成带引用报告的小模型,基于 Qwen3-8B 训练,已作为 Asta 的 Fast 模式上线,同时开放模型权重和训练数据。
推荐理由:原文给出了从 Qwen3-8B 出发的 SFT 加 DPO 训练配方与数据过滤经验,可迁移到其他垂直领域小模型。
Google DeepMind 发布 SynthID Bio,将 SynthID 水印技术引入合成生物学,把不可感知的签名直接嵌入生物代码,使水印不仅能在数字模型上验证,也能在合成出的实体蛋白质上验证,同时保持其生物功能。
推荐理由:SynthID 水印技术首次延伸到合成生物学,读者可了解 AI 生成蛋白质如何在保持功能的同时被标记与验证。
NVIDIA 发布开源表格基础模型 Kumo Tabular,给定带标签的表格行即可在单次前向中预测新行标签,支持分类与回归,无需训练、调参和特征工程。模型提供 28M 到 215M 三种规模,仅用人工合成表格预训练,采用 OpenMDW-1.1 许可可商用,并在 TabArena、BeyondArena、TALENT 和 ScoringBench 四个基准上排名第一。
推荐理由:原文给出模型规模、单次前向预测方式和四个基准排名,可据此判断表格基础模型对现有建模流程的替代空间。
微软研究院发布 Quine,一个面向生物学复杂性的 AI 研究系统,由跨序列、结构、功能、细胞状态和成像等多模态数据联合训练的生物学世界模型,以及连接模型、科学工具、文献与研究者的交互式 harness 组成。
推荐理由:微软研究院公开 Quine 的多模态生物世界模型与实验闭环,并给出胰腺癌化合物筛选的湿实验验证结果。
NVIDIA 联合 Google DeepMind、EMBL-EBI 等机构,通过 AlphaFold Database 开放了 2800 多种病毒的蛋白复合物预测 3D 结构,任何科学家均可免费获取。
推荐理由:NVIDIA 与 Google DeepMind 等联合开放 2800 多种病毒的蛋白复合物结构预测,读者可了解这一开放数据集的规模与用途。
Google DeepMind 发布 AlphaGenome Atlas,一个包含人类基因组 90 亿个单核苷酸变异效应预测的平台,规模达 1PB,是 AlphaFold Database 的 30 倍以上,今日起通过网站门户、AlphaGenome API 和 Google Antigravity 中的 skill 向学术研究免费开放。
推荐理由:AlphaGenome Atlas 把全基因组变异预测做成可检索资源,读者可了解其数据规模与在罕见病研究中的实际用法。
Google DeepMind 与 Google Research 发布 WeatherNext 3,称其为目前最先进的全球天气模型,可基于实时卫星数据每小时生成一次预报,地表变量分辨率达 5 公里,整体比 WeatherNext 2 清晰约五倍。
推荐理由:官方给出分辨率、更新频率与降水精度提升幅度,可据此判断 AI 天气预报在 Google 产品中的落地程度。