跳到正文
10月6日周二
  1. TechCrunch · AI60

    TikTok 推出 AI 购物助手与一键结账

    TikTok 周一宣布推出 AI 购物助手和新的应用内结账功能,用户可直接从品牌购买商品。该购物助手是对话式 AI 智能体,能理解上下文并记住用户偏好,提供商品详情、物流、尺码、库存等实时购物指引;一键结账则让用户从 For You 信息流直接下单。

  2. The Decoder61

    Reka AI 发布 19B 全能模型 Rho-1,单模型处理文本图像视频与机器人控制

    Reka AI 发布研究预览版 Rho-1,这是一个 190 亿参数的全能模型,可在单一神经网络中处理并生成文本、图像、视频和机器人控制动作。与多数将任务分派给专用模型的系统不同,Rho-1 把所有模态作为 token 放在同一个共享上下文窗口中运行,无需工具调用或外部模型。

  3. TechCrunch · AI22

    Hot Girl Hotline:面向 AI 时代的“Dear Abby”情感建议应用

    两姐妹创立 Hot Girl Hotline,为年轻女性提供基于行为科学的 AI 情感与约会建议,定位是“可信赖的朋友或姐姐”而非 AI 陪伴产品。对话常采用苏格拉底式提问引导用户自己得出结论,触发风险信号时会转介 988 危机热线,并会主动结束对话、推动用户去现实世界行动。

  4. AWS Machine Learning Blog36

    Amazon SageMaker AI 推出 aws-ai-ml 技能,为 Kiro、Claude Code、Codex 等编码智能体提供生成式 AI 推理优化能力

    Amazon SageMaker AI 通过 Agent Toolkit for AWS 推出 aws-ai-ml 技能,让 Kiro、Claude Code、Codex 等支持 MCP 的编码智能体获得推理优化与基准测试能力,可对端点做基准测试、推荐部署配置、对比性能并生成可执行的 SageMaker Python SDK v3 代码。

  5. The Decoder58

    昆尼皮亚克民调:多数美国人希望放缓或暂停 AI 开发

    昆尼皮亚克大学民调显示,47% 的美国受访者希望放缓 AI 开发速度,30% 希望在有安全验证前完全暂停,仅 5% 希望加快。86% 支持目前正在讨论的 AI 企业独立安全标准,即使这会拖慢进展;73% 担心 AI 最终威胁人类生存,74% 对 AI 公司领导者几乎或完全不信任。该调查于 9 月 24 日至 27 日访问 1,202 名美国成年人,误差范围为正负 3.5 个百分点。

  6. 东方财富研报·宏观30

    宏观预测报告:调结构继续,经济总量短期内震荡前行

    宏观预测报告认为,内需增长动力不足,GDP增速或小幅下降,高基数叠加工作日减少使工业增速小幅放缓。消费额增速继续低位前行,投资增速在“反内卷”去产能下或继续低位,而出口、进口增速受低基数与高技术产品需求支撑或继续高位。CPI难有大幅上行,PPI继续上行,信贷同比少增、M2增速回落,人民币震荡前行。

10月5日周一
  1. TechCrunch · AI62

    OpenAI 推出图像生成结果旁的视觉广告

    OpenAI 在 ChatGPT 广告产品线中加入视觉展示广告,广告将出现在用户要求生成的图像旁边,本月晚些时候先在美国上线,面向一组初始测试广告主。广告会明确标注,且不会影响 ChatGPT 给出的回答。OpenAI 同时扩展广告衡量工具与合作伙伴生态,并与 DoubleVerify、Integral Ad Science 开展品牌适配评估试点。

  2. Ars Technica · AI62

    AI 眼镜遭遇首次重大政府监管收紧

    澳大利亚正考虑在部分公共场所禁用智能眼镜,多国法庭也已发布相关禁令,挪威政府则表示不打算提出全面禁令,认为在不存在未经同意拍摄他人风险的情况下可适当使用。挪威称该禁令提案是“高度优先事项”,草案法律将很快提交议会。

  3. MIT Technology Review · AI12

    预测分析如何迈入智能体 AI 时代

    企业 AI 的竞争焦点已从预测模型能否超越统计预测,转向让预测系统自主决策而不偏离业务意图。深度学习和生成式 AI 驱动的智能分析支持实时训练,使 AI 持续进化而非等待季度刷新,其数据来源也从规整的数值记录扩展到杂乱的非结构化交互数据。Everest Group 合伙人 Vishal Gupta 认为,"分析"一词正让位于 AI。

  4. NVIDIA Blog22

    NVIDIA Inception 初创公司如何用 AI 补齐乳腺癌诊疗缺口

    NVIDIA Inception 计划中的多家初创公司正用 AI 覆盖乳腺癌筛查、风险评估与治疗规划全流程。iSono Health 的 FDA 认证 ATUSA 可穿戴 3D 超声系统约两分钟完成单侧乳房扫描,灵敏度比手持 2D 超声高 28%;Whiterabbit.ai 的 WRDensity 已用于数十万患者;Ataraxis AI 则用病理切片预测治疗反应与复发风险。

  5. MIT Technology Review · AI29

    人们一边痛恨 AI,一边为何又离不开它?

    全球对 AI 的态度正呈现矛盾:Pew 调查显示更多美国成年人认为 AI 对个人和社会影响负面,斯坦福报告称全球超半数人对 AI 产品感到紧张,5 月 Gallup 民调中 71% 美国成年人反对在本地新建 AI 数据中心。但使用量仍在飙升,ChatGPT 5 月月活达 10 亿,Gemini 7 月达 9.5 亿,Pew 称半数美国成年人已使用聊天机器人。

  6. Simon Willison22

    Qwen3.8 27B 用英文单词做加法的基准测试

    Simon Willison 在 DGX Spark 上测试本地 Qwen3.8-27B-Q4_K_M.gguf 能否仅用英文单词表达整数加法结果,禁用推理时 5,070 个用例的数值准确率为 23.57%,格式合规率 96.17%,但准确率从一至三位数的 97.04% 降至十至十三位数的 6.44%。启用推理后,169 个配对用例中答对 167 个。

10月4日周日
  1. Simon Willison34

    Simon Willison:按量付费服务需要默认硬性预算上限,AWS 已推出支出限额

    Simon Willison 呼吁按量付费 API 和服务默认设置硬性预算上限,即达到每月 $X 后直接切断并返回错误,而非仅发警告邮件。他指出 AWS 已在 9 月 16 日推出月度支出限额功能,项目达到限额后当月暂停,但该新体验目前仅向有限客户开放;Google Cloud 则在 7 月推出了 Spend Caps。

  2. Hugging Face Blog62

    微软与 Hugging Face 发布 ThinkingBox:按数据库终态给 AI 智能体打分

    微软 Copilot Studio 团队与 Hugging Face 联合发布 ThinkingBox,通过隔离的 MCP 工具会话运行智能体,再根据其留下的后端终态和副作用打分,而非看模型生成的文字。

    推荐理由:微软与 Hugging Face 联合发布的智能体评测基准,用数据库终态而非模型自述来判定任务成败,并给出可复现的 OpenEnv 运行方式。

  3. Simon Willison8

    Simon Willison 发布九月赞助者专属通讯

    Simon Willison 已发送九月赞助者专属月度通讯,内容涵盖更多 Fable 级模型、一场价格战、3D 图形与 Blender 及像素艺术、LLM 进军数学领域、更多意外网络攻击、vulnapocalypse 波及 Datasette、他当前使用的工具、本月软件发布以及 2026 年 LLM 进展回顾。订阅费用为 $10/月,可提前一个月看到免费版内容。