跳到正文
10月9日周五
  1. TechCrunch · AI39

    a16z 合伙人 Olivia Moore 谈消费级 AI 现状:ChatGPT 仍遥遥领先,Suno、ElevenLabs 展现持久力

    a16z 合伙人 Olivia Moore 发布消费级 AI 应用 Top 100 报告,ChatGPT 仍是最大玩家,Suno 和 ElevenLabs 等小玩家展现出持久力。报告指出社交、约会、市场、零售、旅游、金融、健康等六个消费类别在 Top 100 中完全没有 AI 应用入局。她认为消费级 AI 仍处早期,机会在于订阅和 API 之外的收入来源,以及更多基于开源模型构建的消费产品。

10月8日周四
10月7日周三
  1. Microsoft Research22

    Microsoft 研究播客:AI 评测的意外失败能教会我们什么

    Microsoft 研究合伙人研究经理 Jennifer Neville 在 Microsoft Research Podcast 中与首席应用科学家 Chad Atalla 对谈,探讨评测如何推动当前 AI 系统突破性能边界,以及模型在传统 benchmark 之外测试时出现的"意外失败"。她同时分享了使用当前 AI 系统的实用建议,并强调当结果偏离预期时深入审视数据的重要性。

10月5日周一
  1. MIT Technology Review · AI12

    从预测到自主决策:预测分析如何迈入智能体 AI 时代

    企业 AI 的竞争前沿已从预测精度转向自主决策,核心挑战是让预测系统在不偏离业务意图的前提下自主行动。深度学习与生成式 AI 驱动的智能分析支持实时训练,使 AI 持续演进而非等待季度刷新,其数据来源也从规整的数值记录扩展到非结构化交互数据。Everest Group 合伙人 Vishal Gupta 称,"分析"一词正让位于 AI。

9月18日周五
  1. GitHub Blog · AI & ML22

    GitHub Podcast 拆解五大 AI 热梗:该不该读 AI 代码、RAG 已死、Skills 杀死 MCP?

    GitHub Podcast 最新一期拆解了五个 AI 开发热梗:AI 生成的代码仍需阅读和负责,但审查力度应随风险分级;Skills 与 MCP 解决不同问题,前者是打包的团队经验,后者是智能体连接工具与数据的标准,二者可组合使用;RAG 并未消亡,检索能为模型提供训练数据外的上下文,减少 token 浪费并降低答案不完整的概率。

7月7日周二
  1. Berkeley AI Research32

    智能免费之后怎么办?面向智能体、由智能体构建的数据系统

    UC Berkeley 的 Aditya G. Parameswaran 等人提出,随着推理成本从 2023 年初 GPT-4 级约 $30/百万 token 降至如今不到 $1、部分低于 $0.10,数据系统需应对三大新挑战:为智能体服务、由智能体运行、由智能体合成。其中智能体查询会产生大量重复子计划,文本到 SQL 基准中仅 10-20% 子计划不同,80-90% 属重复工作。