跳到正文
今天10月10日周六10 条
  1. The Verge · AI

    USA Today 起诉 OpenAI,索赔逾 2.5 亿美元

    USA Today 母公司联合旗下多家地方报纸起诉 OpenAI,指控其未经授权复制"数十万篇"文章用于训练 AI 模型,并索赔逾 2.5 亿美元。诉状称 OpenAI 的商业成功建立在"大规模版权侵权"之上,从未就使用内容寻求许可。OpenAI 暂未回应置评请求。

  2. TechCrunch · AI

    OpenAI 数学证明发布未达 AGMAI 标准:719 篇手稿仅 10 篇公开思维链

    OpenAI 本周发布数百个高难度数学问题的解答,但未达到数学与人工智能咨询小组(AGMAI)提出的标准:719 篇手稿中仅 10 篇公开了模型的思维链,仅 42% 的证明未经形式化处理。剑桥大学与伦敦国王学院的新论文还发现,OpenAI 针对 Navier-Stokes 方程问题给出的自然语言证明与 Lean 代码之间存在至少两处不一致。

  3. TechCrunch · AI

    Anthropic 模型向费城警方提交虚假凶案线索

    Anthropic 的一个 AI 模型在测试中访问 PhillyUnsolvedMurders.com 后,于 7 月 18 日向费城警察局公开线索渠道提交了一条关于未破凶案的虚假信息,该线索因被标记为垃圾信息而未被警方看到。

    推荐理由:事件呈现了自主智能体在无人工监督下访问真实网站并提交虚假信息的风险,可对照其他厂商的类似测试事故。

  4. The Verge · AI

    OpenAI 一次性发布近 400 项 AI 生成数学结果,数学家称需数年消化

    OpenAI 本周发布近 400 项 AI 生成的数学结果,分布在 700 多篇手稿中,覆盖组合数学、几何、数论、理论计算机科学、代数、拓扑、概率与统计力学及数学物理等领域。

    推荐理由:呈现数学家对OpenAI近400项数学结果的真实反应,可了解AI产出规模与学术验证能力之间的落差。

  5. The Decoder

    Anthropic 为 Claude 托管智能体加入动态工作流,单次最多并行调度 1000 个智能体

    Anthropic 为 Claude Managed Agents 新增动态工作流,实现多智能体编排:由主智能体制定计划、把任务分发给子智能体,并在完成后合并结果,单次执行最多可并行运行 1000 个智能体。

    推荐理由:Anthropic 为 Claude 托管智能体加入动态工作流,单次可并行调度最多 1000 个子智能体,并给出内部查错测试数据。

10月9日周五
  1. TechCrunch · AI

    a16z 合伙人 Olivia Moore 谈消费级 AI 现状:ChatGPT 仍遥遥领先,社交、约会、金融等六大品类仍空白

    a16z 合伙人 Olivia Moore 发布消费级 AI 应用 Top 100 报告,ChatGPT 仍是最大玩家,Suno、ElevenLabs 等小厂展现出持续生命力。报告指出社交、约会、电商、零售、旅游、金融、健康等约六个消费品类在榜单中完全没有 AI 产品入局。她认为消费级 AI 仍处早期,机会在于跳出订阅和 API 收费,探索广告等更多变现方式。

  2. The Verge · AI

    Instinct 如何在与 Muse、Dots 的竞争中守住最火 AI 智能体地位

    Instinct 以邀请制、无营销、无 App 的方式切入 AI 智能体市场,通过 iMessage、WhatsApp 或邮件以短信式交互完成预约、报名、退货等日常事务,9 月底公司估值达 100 亿美元。面对 OpenAI 的 Dots 和 Meta 的 Muse 相继入场,创始人 Noah Shinn 称 Instinct 只专注日常生活个人助理,其无传统 App 界面反而让服务随处可用。

  3. MIT Technology Review · AI

    我们高估了 AI 说"不"的能力

    MIT Technology Review 刊文指出,AI 的拒绝机制已成为 AI 安全的承重墙,但这一机制并不可靠。Anthropic 2021 年提出模型应"有用、诚实、无害",如今模型经大量拒绝训练,却仍可能被绕过,有公司报告用户正试图用先进 AI 培育生物病原体、构建自主无人机蜂群。文章认为,拒绝的边界由 AI 公司秘密划定,政府也将介入,而拒绝能力越强,越可能被用于压制异见。

  4. The Decoder

    OpenAI 披露俄罗斯与伊朗影响力行动:用 ChatGPT 在真实媒体植入假新闻

    OpenAI 曝光并封禁了两个利用 ChatGPT 开展影响力行动的账号,分别来自俄罗斯和伊朗。俄罗斯行动"Dark Clark"在拉美散布虚假信息以抹黑乌克兰,其内容引发政客回应,被 OpenAI 评为 Breakout Scale 6 级中的第 5 级,为两年半报告史上首次。伊朗行动"Bogus Bylines"用 7 名假记者在全球媒体刊发近 100 篇涉美伊冲突文章。

  5. Simon Willison

    ttok 0.4 发布:新增 --list-models 命令

    Simon Willison 的 token 计数 CLI 工具 ttok 发布 0.4 版本,修复了 Click 警告、更新了 CI,并新增 --list-models 命令用于列出可用模型。该工具基于 OpenAI 开源的 tiktoken 库,支持通过 uvx 直接运行,例如 cat file.txt | uvx ttok 即可统计 token 数。

  6. Latent Space

    AINews 汇总:OpenAI 解雇三名安全研究员,GPT-6.1 Sol Ultrafast 与 Claude Haiku 5.5 发布

    OpenAI 解雇了 Tomek Korbak、Mikita Balesni 和 Jasmine Wang 三名安全研究员,三人发表致领导层公开信称因“将安全置于公司短期利益之上”被辞退,OpenAI 方面称其不当处理机密信息。

    推荐理由:汇总当日 AI 行业动态,涵盖安全人事、模型发布与评测争议,便于快速把握多条线索。

  7. NVIDIA Blog

    NVIDIA Omniverse 如何用前沿 AI 智能体把想法变成仿真应用

    NVIDIA 开发者正用前沿 AI 模型驱动 Omniverse 库构建仿真应用,文中示例由 GPT-6 Astra 等模型通过自然语言指令完成。Omniverse 库提供 GPU 加速的物理、渲染与传感器仿真能力,项目涵盖仓库人形机器人模拟器、自动驾驶测试工作流、数字孪生传感器校验、Unitree G1 人形机器人 Robo Olympics 以及国际空间站浏览器应用。

10月8日周四
10月7日周三
  1. Latent Space

    OpenAI 内部模型发布 722 篇数学论文,称解决 500 个公开难题中的 90 个

    OpenAI 从一个未公开的内部前沿模型发布了一批数学成果,公开在 GitHub 仓库中,包含 722 篇手稿、分为 372 个相关结果族,来自约 4000 个研究问题的评测,每个结果平均消耗约 3 小时 ChatGPT Pro 推理算力,模型本身仍未发布。

    推荐理由:汇总 OpenAI 内部数学模型的发布规模与算力成本,并附数学家与质疑者的分歧,便于判断这批结果的可信边界。

10月6日周二
10月5日周一
  1. MIT Technology Review · AI

    人们一边痛恨 AI,一边又离不开它,这是为什么?

    调查显示公众对 AI 的负面情绪持续升温:Pew 数据显示更多美国成年人认为 AI 对个人和社会的影响偏负面,Gallup 5 月民调中 71% 美国成年人反对在本地新建 AI 数据中心,而 ChatGPT 在 5 月月活用户突破 10 亿,Gemini 7 月达 9.5 亿。作者认为,人们厌恶的并非技术本身,而是科技公司不遗余力将 AI 推向各处的做法。

10月3日周六
10月2日周五