跳到正文
  1. 东方财富·7x24

    新思科技与亚马逊达成多年期定制芯片战略IP协议

    新思科技与亚马逊签署一项为期多年、金额超过10亿美元的协议,利用新思科技硅IP和AI驱动的工程软件解决方案,加速亚马逊定制芯片和AWS基础设施的开发。新思科技将借助AWS服务加速产品开发,并与亚马逊合作针对Trainium和Graviton优化其软件。

    推荐理由:协议金额与涉及的自研芯片型号,为观察云厂商定制芯片与EDA工具链的绑定关系提供具体案例。

  2. 金十数据·快讯

    TrendForce:2031 年 VCSEL 需求有望达 6.5 亿颗,2025–2031 年复合增速 38%

    TrendForce 在最新《2027 红外感测与光通讯市场趋势》报告中预测,受数据中心内部 Scale-Up 网络流量上升带动,VCSEL NPO 需求增长,到 2031 年 VCSEL 市场需求有望达 6.5 亿颗,2025–2031 年复合年增长率 38%。

    推荐理由:TrendForce 给出 VCSEL 到 2031 年 650 亿颗、2025–2031 年 38% CAGR 的预测,可了解数据中心光互连上游器件的需求节奏。

  3. 东方财富·7x24

    AI数据中心用电激增,密西西比州电力企业向亚马逊发出断电预警

    知情人士透露,密西西比州电力企业Entergy今年早些时候向亚马逊发出警示,称在用电高峰时段为保障其他用户供电,将不得不切断亚马逊在密西西比数据中心的电网供电。当地电力公司极少对大型客户采取断电措施,这一此前未曾报道的警示反映出AI云厂商激增的用电需求正迫使电力企业采取前所未有的手段平衡各类用户用电。

    推荐理由:电力企业向数据中心发出断电警示,呈现AI算力扩张与区域供电能力之间的现实约束。

  4. TechCrunch · AI

    Goodfire 推出内部激活监控,拦截失控 AI 智能体成本大幅降低

    Goodfire 发布面向 AI 智能体的监控方案,通过读取模型内部激活信号而非重新审阅输出,来发现失控行为,该方案已向 Baseten 客户开放。在 Kimi K3 测试中,监控约 100 万次交互成本约 185 美元,而用较便宜的 AI 模型逐步检查需 5420 美元、顶级模型约 20 万美元;探针捕获了 93% 的恶意黑客会话,并将 5.5% 的无害会话送交二次审查。

    推荐理由:介绍了一种在模型内部激活层做监控的智能体安全方案,并给出成本与检出率数据,便于比较现有监控路线。

  5. TechCrunch · AI

    Google 将智能体 AI 引入 Gemini,先从企业场景落地

    Google 在 Google Cloud 活动上宣布为 Gemini 推出统一智能体,可回答问题并代用户完成任务,初期面向企业、后续再推向消费者。

    推荐理由:Google 把 Gemini 从对话助手推向可执行任务的智能体,先服务企业,读者可了解其模型选择、系统连接与审计设计。

  6. 金十数据·快讯

    ASML 将在韩国替换零件价格上调 10%

    ASML 将把在韩国供应的替换零件价格上调 10%,自明年 1 月起生效,涵盖 EUV 和 DUV 光刻机的全部零件。ASML 总部上月早些时候通过韩国分公司向三星电子和 SK 海力士传达了这一意向,最终涨价在与两家公司完成采购层面谈判后确认。

    推荐理由:涨价覆盖 EUV 与 DUV 全部替换零件,读者可据此观察存储厂商的设备维护成本变化。

  7. The Decoder

    Anthropic 为 Claude 托管智能体加入动态工作流,单次最多并行调度 1000 个智能体

    Anthropic 为 Claude Managed Agents 新增动态工作流,实现多智能体编排:由主智能体制定计划、把任务分发给子智能体,并在完成后合并结果,单次执行最多可并行运行 1000 个智能体。

    推荐理由:Anthropic 为 Claude 托管智能体加入动态工作流,单次可并行调度最多 1000 个子智能体,并给出内部查错测试数据。

  8. The Decoder

    Anthropic 推出免费开源项目 AI 漏洞扫描器

    Anthropic 启动 Cyber Mission 长期计划,保护关键基础设施和开源软件免受网络攻击。其中关键基础设施防御计划(CIDP)向电网、供水系统和交通网络运营方开放 Claude 模型、工程师和威胁分析,CrowdStrike、Palo Alto Networks、Deloitte 和 Rockwell Automation 为创始合作伙伴。

    推荐理由:Anthropic 把 Claude 能力投向开源漏洞扫描与关键基础设施防护,可观察 AI 安全工具的实际落地方式。

  1. 韩联社英文

    SK 集团会长承诺尽快在韩国西南部建设新芯片集群

    SK 集团会长崔泰源表示,将尽快在韩国西南部建设新的半导体集群,以满足不断增长的全球芯片需求。他在访问光州空军基地时称,一旦条件具备就尽快动工,但具体开工时间尚未确定。该集群规模约为首尔以南龙仁在建集群的三分之二,光州空军基地于 7 月被选为项目选址,政府目标是在 2030 年开始规模化量产。

    推荐理由:SK 集团会长就西南部芯片集群给出加速表态,读者可了解其选址、规模与投产时间表。

  2. The Verge · AI

    Anthropic 推出免费开源项目安全扫描服务 OSS Scanner

    Anthropic 推出名为 OSS Scanner 的免费服务,为选择加入的开源项目提供由自家最强模型(包括 Claude Mythos)生成的周期性安全扫描报告。

    推荐理由:Anthropic 免费扫描开源项目漏洞,但报告全由模型生成、无人工复核,读者可据此判断这类自动化安全工具的能力边界。

  3. The Decoder

    Anthropic 为 Claude 推出仪表盘与动画讲解视频两项 beta 功能

    Anthropic 为 Claude 推出两项 beta 功能:Dashboards 可连接 BigQuery、Databricks、Snowflake、Salesforce 等数据源。

    推荐理由:Anthropic 为 Claude 新增仪表盘与动画视频两项 beta 能力,并披露文档工具的使用规模,可观察其产品线扩张节奏。

  1. AWS Machine Learning Blog

    Claude Haiku 5.5 在 AWS 上线 Amazon Bedrock 与 Claude Platform

    AWS 宣布 Claude Haiku 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上线。

    推荐理由:介绍 Claude Haiku 5.5 在 Amazon Bedrock 上线及其与 Opus 5.5 的分工,可了解该模型在成本与子智能体场景中的定位。

  2. NVIDIA Blog

    NVIDIA 与微软发布 RTX Spark 及 Windows 智能体运行基础设施

    NVIDIA 与微软在旧金山 Windows AI 与 Surface 活动上宣布为 AI 智能体共同设计 Windows PC 的软硬件,微软公布 OS 级基础设施 Microsoft Execution Containers(MXC)正式可用,让智能体在系统管控下安全持久地在后台运行。

    推荐理由:英伟达与微软把智能体运行环境下沉到 Windows 与本地硬件,读者可据此判断端侧 AI 的软硬件分工走向。

  3. Microsoft Research

    微软开源 Agent Lightning v1.0:约 3500 行的轻量级智能体 RL 框架

    微软研究院开源 Agent Lightning v1.0,这是一个约 3500 行代码的轻量级智能体强化学习框架,提出 Harnessed Agentic RL 范式,让部署时使用的同一 agent harness 直接参与训练,无需在训练框架内重新实现智能体。

    推荐理由:微软开源轻量级智能体 RL 框架,用真实 harness 训练并给出 SWE-bench 提升数据,可了解训练与部署一致性的新范式。

  1. Latent Space

    Reflection 发布 Beam:501B 总参数 23B 激活的开源 MoE 模型

    Reflection 发布 Beam,一个面向编程、智能体与科研任务的纯文本 MoE 模型,总参数 501B、激活 23B,从零训练,完整权重将以 Apache 2.0 协议在本月放出。

    推荐理由:汇总了 Reflection Beam 开源权重发布及同期多个模型与训练方法的进展,便于横向比较美国开源模型与前沿水平的差距。

  1. NVIDIA Blog

    NVIDIA 推出 DGX Spark 64GB 配置,支持双机集群扩展本地 AI

    NVIDIA 宣布本月起由 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 等厂商推出 64GB 统一内存版 DGX Spark,预装 DGX OS 与 NVIDIA AI 软件栈,可本地运行最高 1000 亿参数模型。

    推荐理由:NVIDIA 官方公布 DGX Spark 64GB 配置与双机集群方案,读者可据此了解本地 AI 推理的硬件门槛与扩展方式。

  1. Microsoft Research

    微软研究院发布 Quine:面向生物学复杂性的 AI 研究系统

    微软研究院发布 Quine,一个面向生物学复杂性的 AI 研究系统,由生物世界模型与连接模型、科学工具、文献和实验的交互式 harness 两部分组成。该系统与 Broad Institute 合作用于胰腺导管腺癌研究,按驱动肿瘤细胞状态转换的潜力对数千种化合物排序,湿实验验证中排名最高的化合物产生了最大的预期状态转换,从缩小搜索空间到选出候选化合物只用了一个周末。

    推荐理由:微软研究院公开 Quine 生物世界模型的设计思路与胰腺癌化合物筛选实测结果,可了解多模态世界模型在科研闭环中的落地方式。

  1. Microsoft Research

    微软研究:将物理 AI 推理卸载到边缘与云端可提升机器人表现与续航

    微软研究院发布针对物理 AI 机器人推理卸载的系统性研究,指出把推理从机载 GPU 卸载到边缘或云端 GPU 可提升任务成功率、支持更大模型并延长续航。

    推荐理由:微软把机器人推理从机载 GPU 卸载到边缘与云端,并给出任务成功率与续航的量化对比,可据此理解物理 AI 的算力部署取舍。

  1. Microsoft Research

    微软研究院发布逆合成模型 RetroChimera 并开源权重

    微软研究院在 Nature 发表逆合成模型 RetroChimera,并开源其实现与权重(MIT 许可),同时可通过 Microsoft Foundry 访问。

    推荐理由:RetroChimera 把两种互补模型用学习式重排序集成,读者可了解逆合成预测在罕见反应与专家盲测中的表现。

已经到底了