Oracle 如何用 ChatGPT 和 Codex 把数天工作压缩到几分钟
Oracle 在招聘、工程和运营场景中,用 ChatGPT Work 和 Codex 把专家知识转化为快速、可复用的工作流,将原本需要数天的工作缩短到几分钟。
Oracle 在招聘、工程和运营场景中,用 ChatGPT Work 和 Codex 把专家知识转化为快速、可复用的工作流,将原本需要数天的工作缩短到几分钟。
Pollo AI 借助 GPT-5.6、GPT-6 Astra 和 GPT-Image-2.5,帮助创作者将创意转化为精细图像和电影级视频广告。
LegalOn 将 Codex 每日预估成本降低 65%,同时保持开发速度。其做法是按任务匹配 Astra、Sol 和 Luna,并对预算进行策略性管理。
NVIDIA 正大力投入物理 AI,其全栈安全解决方案已被机器人公司采用,目标是让 robotaxi 和人形机器人更安全。
MIT Technology Review 与 Aventine 合作的文章指出,尽管马斯克称 Tesla Optimus 未来能以每台低至 2 万美元自动化几乎所有人类劳动、并预测 2027 年底前向公众发售,但许多机器人研究者对此持怀疑态度。
AVEVA 首席技术专家 Arti Garg 提出,工业 AI 正从预测分析走向基础模型、physical AI 与 agentic AI,但因其直接作用于物理系统,安全与可靠性成为部署核心。AVEVA 的责任 AI 框架强调安全、效率与人类监督,主张 AI 应增强而非取代关键决策中的人。Garg 还参与 IEEE 工作组,制定覆盖电力、能源、水资源与碳的 AI 环境影响测量标准。
Anthropic 发布约一年来首个 Haiku 层级更新 Claude Haiku 5.5,定价与 OpenAI 的 GPT-6 Luna 持平,官方称其平均运行成本比 Haiku 4.5 低约 75%。
推荐理由:汇总了 Claude Haiku 5.5 的定价、第三方评测与 token 消耗数据,可对照 GPT-6 Luna 等小模型的实际成本差异。
微软在两年来的首场线下活动中发布 Surface Laptop Ultra,起售价 $2,599,搭载 Nvidia RTX Spark SoC,可选 5120 核或 6144 核 Blackwell GPU 及最高 128GB LPDDR5x 统一内存,10 月 16 日发货并已开启预售。
OpenAI 捣毁了两起借助 AI 开展的影响力行动,这些行动利用假记者和一家智库传播地缘政治信息。
开发者 Brandon Thomas 用 Anthropic 的 Claude Opus 5.5 以 Rust 打造 Adobe 七款软件的"洁净室替代品",覆盖 Photoshop、Illustrator、Premiere、Lightroom、After Effects、InDesign 和 Acrobat Pro,并提供 WebAssembly 浏览器版本。
AWS 宣布 Claude Haiku 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上线。
推荐理由:介绍 Claude Haiku 5.5 在 Amazon Bedrock 上线及其与 Opus 5.5 的分工,可了解该模型在成本与子智能体场景中的定位。
NVIDIA 与微软在旧金山 Windows AI 与 Surface 活动上宣布为 AI 智能体共同设计 Windows PC 的软硬件,微软公布 OS 级基础设施 Microsoft Execution Containers(MXC)正式可用,让智能体在系统管控下安全持久地在后台运行。
推荐理由:英伟达与微软把智能体运行环境下沉到 Windows 与本地硬件,读者可据此判断端侧 AI 的软硬件分工走向。
Amazon Quick 与 Amazon Bedrock Knowledge Bases 新增实时 ACL 校验层,在查询时直接向 Google Drive、SharePoint 等权威源核实权限,与原有的预检索过滤组成两阶段方案。
一名男子因利用 1 万个机器人账号和 AI 生成的歌曲刷流媒体播放量、冒充 Taylor Swift 等艺人,窃取 800 万美元音乐流媒体版税,被判处 18 个月监禁。
GitHub 与 Microsoft Applied Sciences 联合构建微调分类器,将推送保护扩展到非结构化密钥,可在不到 2 毫秒内评估整组候选密钥,有望让可拦截的密钥数量增加一倍以上。
微软研究院开源 Agent Lightning v1.0,这是一个约 3500 行代码的轻量级智能体强化学习框架,提出 Harnessed Agentic RL 范式,让部署时使用的同一 agent harness 直接参与训练,无需在训练框架内重新实现智能体。
推荐理由:微软开源轻量级智能体 RL 框架,用真实 harness 训练并给出 SWE-bench 提升数据,可了解训练与部署一致性的新范式。
AWS 提出 Agentic Value Model,用于替代以"节省工时×人力成本"为核心的 RPA 时代 ROI 模型,从时间节省、异常处理、决策质量、变更韧性与维护经济性四个维度衡量 agentic automation 的价值。
Qlik 基于 Amazon Bedrock 打造 Qlik Answers,为全球超 4 万名客户提供可溯源的企业级问答,自 2026 年 2 月正式可用以来,其 Discovery Agent 已为客户发现超 10 万条洞察。
Mistral 表示,Le Chonk 在保持开放权重的同时,能够与顶级闭源模型相抗衡。
Kubernetes 创始人 Craig McLuckie 和 Joe Beda 通过 Stacklok 推出开源云原生 harness Mecatl,将智能体循环与客户端、模型提供商、状态存储和执行环境解耦。
OpenAI 为 ChatGPT for Teens 推出 College Planner,帮助学生管理大学申请,同时上线新的 flashcards 和 quizzes 功能,并组建青少年 AI 委员会(teen AI council)。
Radisson Hotel Group 与 Accenture 合作,基于 OpenAI 技术打造了一款 ChatGPT 插件,帮助旅客在规划行程时查找、比较和预订酒店。
OpenAI 从一个未公开的内部前沿模型发布了一批数学成果,公开在 GitHub 仓库中,包含 722 篇手稿、分为 372 个相关结果族,来自约 4000 个研究问题的评测,每个结果平均消耗约 3 小时 ChatGPT Pro 推理算力,模型本身仍未发布。
推荐理由:汇总 OpenAI 内部数学模型的发布规模与算力成本,并附数学家与质疑者的分歧,便于判断这批结果的可信边界。
微软 partner research manager Jennifer Neville 在 Microsoft Research Podcast 中讨论了评测对推动 AI 系统性能边界的作用,以及模型在超出传统 benchmark 测试时出现的"意外失败"。她指出,当结果偏离预期时应仔细审视数据,并分享了使用当前 AI 系统的实用建议。
NVIDIA 最新《State of AI in Telecommunications》报告显示,89% 受访者认为开源模型与软件对公司 AI 战略重要。NVIDIA 发布 300 亿参数的 Nemotron 3 Large Telco Model(LTM),由 AdaptKey 基于开源电信数据集微调,并公开完整微调流程。
Reflection 发布 Beam,一个面向编程、智能体与科研任务的纯文本 MoE 模型,总参数 501B、激活 23B,从零训练,完整权重将以 Apache 2.0 协议在本月放出。
推荐理由:汇总了 Reflection Beam 开源权重发布及同期多个模型与训练方法的进展,便于横向比较美国开源模型与前沿水平的差距。
GitHub 推出开放基准 ReviewBench,用于离线评测 AI 代码审查智能体,基于 1.039 亿个 GitHub pull request 的语言、仓库规模与变更分布构建,包含 19 种语言的 219 个公开 pull request。
MIT Technology Review 对 300 名数据与 AI 高管的调研显示,企业平均仅约 34% 的 agentic AI 项目能进入生产环境,知识、上下文缺失与遗留数据系统是主要失败点。
企业 AI 的竞争焦点已从预测模型能否超越统计预测,转向如何让预测系统在不偏离业务意图的前提下自主行动。深度学习与生成式 AI 驱动的智能分析支持实时训练,使 AI 持续演进而无需等待季度刷新,其数据来源也从规整的数值记录扩展到非结构化交互数据。Everest Group 合伙人 Vishal Gupta 认为,"分析"一词正在让位于 AI。
NVIDIA Inception 计划中的多家初创公司正用 AI 覆盖乳腺癌筛查、风险评估与治疗规划环节。iSono Health 的 FDA 认证 ATUSA 可穿戴 3D 超声系统约两分钟完成单侧乳房扫描,称灵敏度比手持 2D 超声高 28%;Whiterabbit.ai 的 WRDensity 已用于数十万患者;Ataraxis AI 则用病理切片预测治疗反应与复发风险。
调查显示公众对 AI 的负面情绪持续升温:Pew 数据显示更多美国成年人认为 AI 对个人和社会的影响偏负面,Gallup 5 月民调中 71% 美国成年人反对在本地新建 AI 数据中心,而 ChatGPT 在 5 月月活用户突破 10 亿,Gemini 7 月达 9.5 亿。作者认为,人们厌恶的并非技术本身,而是科技公司不遗余力将 AI 推向各处的做法。
MIT Technology Review 的 EmTech Future 2026 活动探讨 AI 与生物学、基础设施、制造业和科学的交叉融合,Google Research 负责人 Yossi Matias 分享了 AI 如何重塑这些领域。
OpenAI 发布 GPT-6.1 Sol,定价 $2/$10 per million input/output tokens,比 Astra 的 $10/$50 大幅降低,在 DeepSWE v1.1 上超 GPT-6 Sol 6.4 分。
GitHub 提出 AI 时代开发者需要强化三项技能:学会指挥 AI 智能体而非仅使用它、不轻信 AI 的第一次回答、用 AI 节省的时间去解决更大的问题。文中以 GitHub Copilot 内置的 Rubber Duck agent 为例,说明它用第二个模型对计划、代码和测试进行批判性审查,从而发现首个模型遗漏的问题。
NVIDIA 宣布本月起由 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 等厂商推出 64GB 统一内存版 DGX Spark,预装 DGX OS 与 NVIDIA AI 软件栈,可本地运行最高 1000 亿参数模型。
推荐理由:NVIDIA 官方公布 DGX Spark 64GB 配置与双机集群方案,读者可据此了解本地 AI 推理的硬件门槛与扩展方式。
GPT-6 Astra Ultrafast 已在 OpenAI API 上线,并向符合条件的 ChatGPT Work 和 Codex 用户开放,运行于 NVIDIA Blackwell GPU 之上。
推荐理由:OpenAI 与 NVIDIA 联合披露 GPT-6 Astra Ultrafast 的推理加速细节,可了解模型部署后持续优化性能的路径。
美联储理事 Waller 宣布,美联储理事会发布的部分数据将接入 FRED 及其工具。FRED 目前收录超 85 万条数据序列,2025 年独立用户达 1800 万,流量正以每年 150% 增长,约一半访问来自 AI 智能体。FRED 已推出基于 MCP 的 FRED MCP Connector,让用户用自选 AI 智能体检索数据。
微软研究院开发了一套端到端机器学习流水线,利用 L1 拉格朗日点的太阳风观测数据,为美国本土 66,935 座变电站生成 30-60 分钟前的空间天气风险预测。系统结合 AE 与 Dst 指数预测、当地纬度、地质电导率和电网数据,在 2020-2026 年评估期内检测到近 80% 的重大空间天气事件,其中 Dst 预测器在 62.2% 的高活跃时段优于 Burton 方程。
美联储理事 Waller 在 Sibos 演讲中聚焦 AI 在支付领域的应用,指出 LLM 可提升制裁筛查与反洗钱准确率、大幅减少误报,并有望优化跨境支付路由与外汇兑换。他提出智能体商务存在"智能体辅助"与"智能体委托"两种模式,前者由买家决策并付款,后者由 AI 智能体自主购物支付,需更完善的信任机制与护栏。
微软研究院发布 Quine,一个面向生物学复杂性的 AI 研究系统,由生物世界模型与连接模型、科学工具、文献和实验的交互式 harness 两部分组成。该系统与 Broad Institute 合作用于胰腺导管腺癌研究,按驱动肿瘤细胞状态转换的潜力对数千种化合物排序,湿实验验证中排名最高的化合物产生了最大的预期状态转换,从缩小搜索空间到选出候选化合物只用了一个周末。
推荐理由:微软研究院公开 Quine 生物世界模型的设计思路与胰腺癌化合物筛选实测结果,可了解多模态世界模型在科研闭环中的落地方式。