跳到正文
今天10月4日周日1 条
  1. Simon Willison46

    AI 智能体时代为何需要默认硬性预算上限

    编码AI智能体大幅降低了构建付费应用的门槛,但意外收到数千美元账单的风险也随之增加;Simon Willison 认为“软上限+警告邮件”不足以防范风险,硬性预算上限应成为按量付费服务的默认配置。AWS 已于 9 月 16 日推出月度支出限制功能,项目达到上限后当月暂停;Google Cloud 也在 7 月上线了 Spend Caps,允许对特定服务设置月度财务上限。

10月2日周五
  1. MIT Technology Review · AI37

    企业 AI 正在从工具向操作系统演进,流程优先企业开始领先

    全球 AI 投资预计 2026 年达 2.5 万亿美元,同比增长 44%,但大多数企业仍未能通过 AI 实现收入增长或根本性运营变革,核心障碍是结构性而非技术性的。流程优先企业将流程重设计置于模型选择之前,通过可组合架构实现实时数据连接,避免信息孤岛。报告指出数据准备度而非数据量才是 AI 可组合的关键,主权可控的数据基础架构将成为企业 AI 规模化的基础设施。

  2. The Verge · AI46

    AI 幻觉正让服务行业从业者应对顾客的离谱请求

    餐厅服务员、调酒师、河流巡护员等服务业从业者反映,顾客对 ChatGPT / Claude 生成内容的信任度已超越对专业人士的信赖,有顾客坚持 AI 宣称的过敏原信息与餐厅实际菜品不符,有顾客依据不存在的酒款下单,亦有游客遵循 AI 生成的露营路线导致日程无法执行。Meta 即将推出的 Muse 智能体被担忧将进一步加剧此类现象,客服人员需应对来自 AI 代理的不合理请求与临时变更。

9月28日周一
9月23日周三
  1. Simon Willison10

    llm 0.36 发布

    Simon Willison 发布 llm 命令行工具 0.36 版本更新。llm 是一个用于通过命令行与多种大语言模型交互的工具,支持调用不同 LLM 提供商。Simon Willison 同时提供每月 LLM 发展摘要的付费邮件订阅服务。

9月22日周二
  1. MIT Technology Review · AI44

    这场夏季AI宣传热潮背后的真相:批评与警示

    Anthropic、OpenAI 等公司近期密集发布夸大宣传:Claude Mythos 被称比安全专家更擅长发现漏洞,OpenAI 模型 Astra 声称解决了十年未解的数学难题,但数学专家随后指出结果并非如宣传所言,甚至涉及研究不当行为和安全疏忽。这波宣传伴随大量媒体报道,却缺乏领域专家验证;批评者指出企业将产品包装为“超级智能”以规避责任,呼吁政策制定者和公众保持怀疑。

8月20日周四
  1. OpenAI News32

    OpenAI 推出 Intelligence Age 博客,探讨 AI 如何变革性重塑权力、治理、经济和个人自由

    OpenAI 推出 Intelligence Age 博客,聚焦 AI 对权力、治理、经济和个人自由的变革性影响。该博客将深入探讨 AI 如何系统地重塑社会各个层面,为公众和研究者提供前瞻性洞见。作为 OpenAI 的全新沟通平台,Intelligence Age 旨在促进对 AI 发展的深层思考和开放讨论。

4月8日周三
3月5日周四