AINews 汇总:OpenAI 解雇三名安全研究员,GPT-6.1 Sol Ultrafast 与 Claude Haiku 5.5 发布
OpenAI 解雇了 Tomek Korbak、Mikita Balesni 和 Jasmine Wang 三名安全研究员,三人发表致领导层公开信称因“将安全置于公司短期利益之上”被辞退,OpenAI 方面称其不当处理机密信息。
推荐理由:汇总当日 AI 行业动态,涵盖安全人事、模型发布与评测争议,便于快速把握多条线索。
OpenAI 解雇了 Tomek Korbak、Mikita Balesni 和 Jasmine Wang 三名安全研究员,三人发表致领导层公开信称因“将安全置于公司短期利益之上”被辞退,OpenAI 方面称其不当处理机密信息。
推荐理由:汇总当日 AI 行业动态,涵盖安全人事、模型发布与评测争议,便于快速把握多条线索。
NVIDIA 正大力投入物理 AI,其全栈安全解决方案已被机器人公司采用,目标是让 robotaxi 和人形机器人更安全。
Anthropic 发布约一年来首个 Haiku 层级更新 Claude Haiku 5.5,定价与 OpenAI 的 GPT-6 Luna 持平,官方称其平均运行成本比 Haiku 4.5 低约 75%。
推荐理由:汇总了 Claude Haiku 5.5 的定价、第三方评测与 token 消耗数据,可对照 GPT-6 Luna 等小模型的实际成本差异。
NVIDIA 与微软在旧金山 Windows AI 与 Surface 活动上宣布为 AI 智能体共同设计 Windows PC 的软硬件,微软公布 OS 级基础设施 Microsoft Execution Containers(MXC)正式可用,让智能体在系统管控下安全持久地在后台运行。
推荐理由:英伟达与微软把智能体运行环境下沉到 Windows 与本地硬件,读者可据此判断端侧 AI 的软硬件分工走向。
GitHub 与 Microsoft Applied Sciences 联合构建微调分类器,将推送保护扩展到非结构化密钥,可在不到 2 毫秒内评估整组候选密钥,有望让可拦截的密钥数量增加一倍以上。
OpenAI 从一个未公开的内部前沿模型发布了一批数学成果,公开在 GitHub 仓库中,包含 722 篇手稿、分为 372 个相关结果族,来自约 4000 个研究问题的评测,每个结果平均消耗约 3 小时 ChatGPT Pro 推理算力,模型本身仍未发布。
推荐理由:汇总 OpenAI 内部数学模型的发布规模与算力成本,并附数学家与质疑者的分歧,便于判断这批结果的可信边界。
Reflection 发布 Beam,一个面向编程、智能体与科研任务的纯文本 MoE 模型,总参数 501B、激活 23B,从零训练,完整权重将以 Apache 2.0 协议在本月放出。
推荐理由:汇总了 Reflection Beam 开源权重发布及同期多个模型与训练方法的进展,便于横向比较美国开源模型与前沿水平的差距。
NVIDIA 宣布本月起由 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 等厂商推出 64GB 统一内存版 DGX Spark,预装 DGX OS 与 NVIDIA AI 软件栈,可本地运行最高 1000 亿参数模型。
推荐理由:NVIDIA 官方公布 DGX Spark 64GB 配置与双机集群方案,读者可据此了解本地 AI 推理的硬件门槛与扩展方式。
GPT-6 Astra Ultrafast 已在 OpenAI API 上线,并向符合条件的 ChatGPT Work 和 Codex 用户开放,运行于 NVIDIA Blackwell GPU 之上。
推荐理由:OpenAI 与 NVIDIA 联合披露 GPT-6 Astra Ultrafast 的推理加速细节,可了解模型部署后持续优化性能的路径。
微软研究院发布针对物理 AI 机器人推理卸载的系统性研究,指出把推理从机载 GPU 卸载到边缘或云端 GPU 可提升任务成功率、支持更大模型并延长续航。
推荐理由:微软把机器人推理从机载 GPU 卸载到边缘与云端,并给出任务成功率与续航的量化对比,可据此理解物理 AI 的算力部署取舍。