跳到正文
  1. Latent Space80

    Anthropic 发布 Claude Haiku 5.5,定价对齐 GPT-6 Luna

    Anthropic 发布 Claude Haiku 5.5,官方称其为迄今最便宜、最快、能力最强的小模型,平均运行成本比 Haiku 4.5 低约 75%,定价与 OpenAI 的 GPT-6 Luna 持平。

    推荐理由:汇总了 Haiku 5.5 的定价、第三方评测与 token 消耗数据,可据此判断小模型在智能体工作流中的成本位置。

  2. Simon Willison78

    Anthropic 发布 Claude Haiku 5.5,定价对齐 GPT-6 Luna

    Anthropic 发布快速低成本模型 Claude Haiku 5.5,定价为 $0.10/$0.50,与上月发布的 OpenAI GPT-6 Luna 完全一致,超过 100,000 tokens 后涨至 $0.50/$2.50,而 Luna 在 272,000 tokens 后仅涨至 $0.20/$0.75。

    推荐理由:作者实测了 Haiku 5.5 的定价、分词器与推理档位,并对比 GPT-6 Luna,可据此判断不同用量下的成本差异。

  3. Hugging Face Blog62

    Liquid AI 开源 d1-3B 与 d1-omni-600M 端侧决策模型

    Liquid AI 发布 d1 决策模型家族的两款开源模型 d1-3B 和 d1-omni-600M(实验性),均基于其 LFM 构建,不生成 token 而是在单次前向传播中给出答案。

    推荐理由:Liquid AI 开源两款决策模型,给出决策质量、端侧延迟与多模态输入的具体数据,可据此判断边缘场景的可用性。

  1. Mistral AI82

    Mistral 发布 Mistral Large 4 公开预览,1 万亿参数原生多模态

    Mistral AI 发布 Mistral Large 4 公开预览,这是一个 1 万亿参数、49B 激活参数的原生多模态模型,可在 Mistral Studio 试用预览 API,权重将于本月底发布。

    推荐理由:官方给出 1 万亿参数、49B 激活的开放权重模型在编码、智能体与网络安全上的具体评测数字,可据此判断开放权重模型当前的能力边界。

  2. The Decoder77

    Reflection 发布首个开源权重模型 Beam,主打低算力编码与智能体任务

    AI 公司 Reflection 发布首个免费开放模型 Beam,面向编码、逻辑推理和智能体任务,采用 MoE 架构,每 token 激活 5010 亿总参数中的 230 亿。

    推荐理由:Beam 以 MoE 架构和超大规模 RL 训练换取低算力成本,读者可据此判断开源模型在编码与智能体任务上的性价比路线。

  1. Latent Space78

    Google DeepMind 发布 Gemini 4 Argon,支持 100 万 token 输出

    Google DeepMind 发布 Gemini 4 Argon,面向编码、企业知识工作与网络防御,首发仅限政府用户和 Fairwind 计划中的可信网络防御者,开发者与企业访问时间未定。

    推荐理由:汇总了 Gemini 4 Argon 的基准、定价与可用范围,并列出评测机构与观察者的质疑,便于对照官方口径。

  2. Google DeepMind82

    Google DeepMind 发布 Gemini 4 Argon 前沿模型

    Google DeepMind 发布新前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向受信任的网络安全防御方开放,随后逐步扩展到开发者、企业和消费者。

    推荐理由:官方披露了 Argon 在编码、企业知识与网络安全防御上的能力与定价,可据此判断前沿模型的分阶段开放路径。

已经到底了