Amazon 等公司不再对数据中心交易保密,这足以建立信任吗?
Amazon 宣布在与地方政府谈判数据中心交易时不再使用保密协议,此前微软今年早些时候已采取类似举措。保密做法此前加剧了社区对 AI 基础设施的反对,从纽约到旧金山已出现数百项拟议和已生效的暂停令。本期 TechCrunch Equity 播客还讨论了个人 AI 初创公司为何把信任当作真正的产品。
Amazon 宣布在与地方政府谈判数据中心交易时不再使用保密协议,此前微软今年早些时候已采取类似举措。保密做法此前加剧了社区对 AI 基础设施的反对,从纽约到旧金山已出现数百项拟议和已生效的暂停令。本期 TechCrunch Equity 播客还讨论了个人 AI 初创公司为何把信任当作真正的产品。
Amazon 宣布在与地方政府谈判数据中心交易时不再使用保密协议,此前 Microsoft 今年早些时候已采取类似举措。与此同时,一批初创公司押注消费者愿意让 AI 智能体访问自己的收件箱、文件和信用卡,前提是网站愿意放行。TechCrunch Equity 播客讨论了放弃保密协议是否会改变数据中心交易方式,以及信任为何可能是个人 AI 初创公司真正的产品。
苏格兰爱丁堡的 Danu Robotics 正将其回收分拣机器人 H.E.R.O. 推向市场,该机器人用夹爪而非吸盘抓取物品,并借助 AI 持续改进软件。公司已获得 50 万美元签约合同和 500 万美元 late-seed 融资,销售管道中有超 200 家客户。
MIT CSAIL 展出的 Unitree 人形机器人售价约 5 万美元,参观者会本能地像对人一样与它握手寒暄。MIT 的 Sherry Turkle 与 Pat Pataranutaporn 指出,约 70% 的人对 AI 保持礼貌,这种拟人化倾向可能让人更信任聊天机器人,甚至将其置于真人之上。Turkle 认为 AI 用于面试辅导等特定场景无妨,但一旦越界便存在风险。
a16z 合伙人 Olivia Moore 发布消费级 AI 应用 Top 100 报告,ChatGPT 仍是最大玩家,Suno 和 ElevenLabs 等小玩家展现出持久力。报告指出社交、约会、市场、零售、旅游、金融、健康等六个消费类别在 Top 100 中完全没有 AI 应用入局。她认为消费级 AI 仍处早期,机会在于订阅和 API 之外的收入来源,以及更多基于开源模型构建的消费产品。
Amazon Bedrock 上线 OpenAI 的 GPT-6 Astra、Sol、Luna 系列模型,其中 GPT-6 Astra 支持最高 100 万 input tokens,Ultrafast 版本 API 推理速度最高提升 6 倍、达 300 tokens/秒。
Postman 在 Amazon Bedrock 上构建 Agent Mode,以 AI 原生方式覆盖 API 测试、文档、发现与实现,服务 4000 万开发者。
密码学家 Matthew Green 称,有 1% 的概率我们生活在公钥加密不可能实现的 Minicrypt 世界,另有 15% 的概率会实质性失去对现有公钥加密算法的信心。他指出,AI 制造意外发现的速度与人类更新标准的速度相差数个数量级,只有提前做好准备才能从这类冲击中恢复。
特朗普签署行政令,要求尽可能停用「AI」一词,改称「Super Intelligence」,并将美国 AI 标准与创新中心(CAISI)更名为 CAISSI。马斯克、贝索斯、黄仁勋、Sam Altman 等表态附和,但 OpenAI 不会改名。该词原指超越人类思维的超级智能,并非 AI 统称,且国会与现行法律仍使用「artificial intelligence」。
Instinct 是一家仅靠邀请制、无营销、几乎无官网起步的 AI 智能体创业公司,在 Muse 和 Dots 相继推出后仍保持竞争力,并于 9 月底获得 100 亿美元估值。
Simon Willison 用 ChatGPT 桌面版 Codex 标签页的语音对话模式,在做饭的半小时里几乎全程靠说话为博客开发出 Newsletters 页面,所用模型为 GPT-6 Astra High。
OpenAI 解雇了三名安全研究员,其中 Tomek Korbak 和 Mikita Balesni 曾参与 Hugging Face 黑客事件调查,Korbak 还是 OpenAI 对接外部安全实验室 METR 的主要技术联系人。
OpenAI 在 X 上发文,坚持解雇三名 AI 安全研究员 Jasmine Wang、Tomek Korbak 和 Mikita Balesni 的决定,称内部调查发现他们违反处理敏感信息的明确政策,构成重大信任破坏,并强调解雇与他们就 AI 安全发声无关。
Anthropic 的 Claude Science 首次绘制出完整的紫外波段全天图。该项目由 Claude Science 协调多个 AI 智能体,从多个太空任务下载数据、进行校准并合并,再用 inpainting 技术补全缺失区域,测试中预测值与实际测量平均偏差约 10%。
MIT Technology Review 刊文指出,AI 的拒绝能力已成为 AI 安全的核心机制,但这一机制并不可靠。Anthropic 2021 年提出大语言模型应“有用、诚实且无害”,如今模型经大量拒绝训练与 AI 互训,仍可能被绕过,有用户正试图用最先进 AI 研发生物病原体和自主无人机蜂群。文章还警告,拒绝机制会迫使企业划定“该服从与该拒绝”的界线,而这条线也可能被政府用来压制合法言论。
OpenAI 披露并封禁了一个俄罗斯和一个伊朗影响行动所使用的 ChatGPT 账号,两者都用虚假身份向正规媒体植入内容,而非仅做社交媒体宣传。
Sophos 使用 OpenAI 的 Daybreak 将网络威胁调查时间缩短 96%,并自动化处理 52% 的 MDR 案例,同时保留人工监督。
Asana 借助 Codex 中的 GPT-6 Astra,在测试中让浏览器智能体的模型成本降低 76 倍、速度提升 5 倍,从而为客户提供更强的模型。
Simon Willison 发布 ttok 1.0,将默认 tokenizer 从 GPT-4 切换为 GPT-5/GPT-6。
斯坦福大学博士生 Samuel King 用生成式 AI 模型设计出微观病毒的基因蓝图,这还不是 AI 生成生命,但可能是下一步。MIT Technology Review 资深 AI 记者 James O'Donnell 将于 10 月 16 日直播对话 King,谈其工作及入选 Innovators Under 35。
Simon Willison 的 token 计数 CLI 工具 ttok 发布 0.4 版,修复了 Click 警告、更新了 CI,并新增 --list-models 命令用于列出可用模型。该工具基于 OpenAI 开源的 tiktoken 库,支持通过 uvx 直接运行,例如 `cat file.txt | uvx ttok`。
Latent Space 的 AINews 汇总了 10 月 7 日至 8 日的 AI 动态。Tomek Korbak、Mikita Balesni 和 Jasmine Wang 称上周被 OpenAI 解雇,并发表致管理层公开信,称原因是把安全置于公司短期利益之上;OpenAI 方面表示三人不当处理了机密信息。
Anthropic 推出名为 OSS Scanner 的免费服务,为选择加入的开源项目提供由自家最强模型(包括 Claude Mythos)定期生成的安全扫描报告。
NVIDIA 开发者正用 GPT-6 Astra、Claude Fable 5 等前沿模型驱动 Omniverse 库,通过自然语言指令搭建仿真应用。案例包括仓库人形机器人模拟器、基于旧金山 Market Street 的自动驾驶测试环境 Zero to Alpamayo、数字孪生传感器校验,以及 Unitree G1 人形机器人跨栏实验——100 次仿真中成功 64 次。
Carson Gross 认为,编程本质上是用计算机解决问题、并在解决问题时控制复杂度这两件事。他难以想象未来这两项能力会变得比今天更不值钱,因此即便 AI 工具出现,编程仍将是可行的职业。
加州州立体育委员会向举办人机对战赛的初创公司 Rek 发出停止令,该比赛于 9 月 18 日让人类 Frankie LaPenna 对阵 Rek 旗下由人通过远程 VR 系统操控的人形机器人。委员会称该比赛"未经批准",要求 Rek 及其 CEO Cix Liv 在加州停止举办、推广或宣传任何涉及人类的拳击或综合格斗赛事。Rek 计划于周五举行下一场比赛,由两台携带武器的机器人互斗。
Anthropic 为 Claude 推出两项 beta 功能:Dashboards 可连接 BigQuery、Databricks、Snowflake、Salesforce 等数据源。
Anthropic 一年多来首次更新 Claude 使用政策,新增禁止对 Claude 进行持续且不必要的辱骂或残忍行为,违规者可能被警告、限流、限制、暂停或终止访问。公司称该条款不适用于常见的用户不满、反驳、黑暗创作主题或模型测试研究,仅针对极端情况。政策同时把虚假账号和误导性政治内容纳入宣传禁令,将武器禁令扩展到软件和无人机武器化,并更明确禁止未经同意的监控。
Incarna 借助 Amazon Bedrock AgentCore payments,让智能体通过 x402 按次向 BlockRun 支付模型推理费用,将接入 x402 支付支持的工作量从数月缩短到数天,并已上线端到端按次付费推理流程。
Periodic Labs 联合创始人 Liam Fedus 与 Ekin Dogus Cubuk 在播客中提出“合成超级智能”(synthesis superintelligence),主张 AI 科学发现不能只靠更多互联网数据训练,而要让模型在真实物理实验中学习。
Amazon SageMaker HyperPod 发布多租户参考架构,让多个团队共享同一 EKS GPU 集群并保持隔离与公平。
Oracle 在招聘、工程和运营场景中,用 ChatGPT Work 和 Codex 把专家知识转化为快速、可复用的工作流,将原本需要数天的工作缩短到几分钟。
《Gears of War: E-Day》已于 10 月 6 日全球发售后上线 GeForce NOW,Ultimate 会员可以 GeForce RTX 5080 级性能云端游玩,并支持 NVIDIA DLSS 和 NVIDIA Reflex。
LegalOn 将 Codex 每日预估成本降低 65%,同时保持开发速度。其做法是把 Astra、Sol 和 Luna 匹配到不同任务,并对预算进行策略性管理。
Pollo AI 借助 GPT-5.6、GPT-6 Astra 和 GPT-Image-2.5,帮助创作者将创意转化为精细图像和电影级视频广告。
Nvidia 推出面向物理 AI 的全栈安全解决方案,已有机器人公司采用,目标是让 Robotaxi 和人形机器人更安全。
MIT Technology Review 与 Aventine 合作的文章指出,尽管马斯克称 Tesla Optimus 未来可能以低至 2 万美元的价格自动化几乎所有人类劳动,并预测 2027 年底前向公众发售,但许多机器人研究者对此持怀疑态度。
AVEVA 首席技术官 Arti Garg 提出,工业 AI 正从预测分析转向基础模型、physical AI 与 agentic AI,但因其直接作用于物理系统,必须把安全与可靠性置于部署核心。
Anthropic 发布 Claude Haiku 5.5,这是 Haiku 系列约一年来的首次更新,定价与 OpenAI 的 GPT-6 Luna 相同,官方称其平均运行成本比 Haiku 4.5 低约 75%。
推荐理由:汇总了 Haiku 5.5 的定价、第三方评测与 token 消耗数据,可据此判断低价小模型在智能体工作流中的实际成本。
微软在两年来的首场线下活动中发布 Surface Laptop Ultra,这是其首款搭载 Nvidia RTX Spark SoC 的设备,起售价 $2,599,配备 5120 核或 6144 核 Blackwell GPU、最高 128GB LPDDR5x 统一内存,10 月 16 日发货并已开启预售。