Periodic Labs 的 Liam Fedus 与 Ekin Dogus Cubuk 谈"合成超级智能":从半导体到超导体
Periodic Labs 联合创始人 Liam Fedus 与 Ekin Dogus Cubuk 在 Latent Space 播客中提出"合成超级智能"(synthesis superintelligence)愿景:以物理实验为环境的强化学习、AI 材料表征与高通量自主实验室,让模型学习做科学的全过程而非只看已发表结果。
Periodic Labs 联合创始人 Liam Fedus 与 Ekin Dogus Cubuk 在 Latent Space 播客中提出"合成超级智能"(synthesis superintelligence)愿景:以物理实验为环境的强化学习、AI 材料表征与高通量自主实验室,让模型学习做科学的全过程而非只看已发表结果。
MIT Technology Review 与 Aventine 合作的文章指出,尽管马斯克称 Tesla Optimus 未来能以每台低至 2 万美元自动化几乎所有人类劳动、并预测 2027 年底前向公众发售,但许多机器人研究者对此持怀疑态度。
AVEVA 首席技术专家 Arti Garg 提出,工业 AI 正从预测分析走向基础模型、physical AI 与 agentic AI,但因其直接作用于物理系统,安全与可靠性成为部署核心。AVEVA 的责任 AI 框架强调安全、效率与人类监督,主张 AI 应增强而非取代关键决策中的人。Garg 还参与 IEEE 工作组,制定覆盖电力、能源、水资源与碳的 AI 环境影响测量标准。
欧央行执委 Piero Cipollone 表示数字欧元预计 2029 年推出,将作为现金的补充而非替代,对个人免费。试点项目已于今年夏季启动,明年开始首批测试,不到 12 个月内完成首笔支付;5 月收到的近 60 份试点申请中已选定 36 家参与机构,包括多家意大利银行。小型商户接受数字支付的成本有望减半,意大利 Satispay 和 Bancomat 已参与相关工作。
韩国外交部表示,通过通关程序未确认有任何商用石油产品出口至俄罗斯,2025年至2026年8月的官方贸易统计中也没有柴油、航空燃油或汽油对俄出口记录。韩国目前禁止向俄罗斯出口战略物资,并对1402项可能用于军事用途的非战略物资逐案审批。此番回应源于《卫报》报道称7至8月有超17.6万吨石油产品从韩国港口运往俄罗斯远东。
AWS 提出 Agentic Value Model,用于替代以"节省工时×人力成本"为核心的 RPA 时代 ROI 模型,从时间节省、异常处理、决策质量、变更韧性与维护经济性四个维度衡量 agentic automation 的价值。
EIA 预测今冬美国家庭能源支出因燃料价格走势分化而冷热不均:取暖油支出将同比增21%,电价支出增4%,而天然气和丙烷支出分别降9%和3%。全球馏分油产量下降推高国际价格,预计取暖油价格今冬平均上涨34%,美国馏分油库存四季度将低于五年均值约11%。
微软 partner research manager Jennifer Neville 在 Microsoft Research Podcast 中讨论了评测对推动 AI 系统性能边界的作用,以及模型在超出传统 benchmark 测试时出现的"意外失败"。她指出,当结果偏离预期时应仔细审视数据,并分享了使用当前 AI 系统的实用建议。
美联储副主席 Bowman 在社区银行研究会议上阐述银行监管框架现代化工作,包括将社区银行杠杆率更新至法定 8% 水平、取消 Novel Activities Supervision Program,并推动按通胀和经济增速更新固定美元资产门槛、每五年调整一次。
欧央行监事会副主席 Frank Elderson 在维也纳 FMA 监管会议上表示,有效监管与简化监管并不冲突,二者相辅相成。欧央行要求银行及时、持久地整改所有监管发现,对低严重度发现只需银行确认已采取合规行动,无需提交额外文件;对长期未整改的高严重度发现,将启用包括资本要求、业务限制或定期罚款在内的升级工具。
欧央行执委 Philip R. Lane 表示,AI 是全球经济当前最大的议题,带动了今年世界贸易走强,尤其是半导体芯片等领域的贸易,欧洲企业也在一定程度上参与了 AI 供应链。他指出,美国 AI 投资激增推高了长期债务和长期收益率,欧央行正从劳动力市场、银行业、投资等多个方向研究 AI 对经济的影响,而非设立单一工作组。
Reflection 发布 Beam,一个面向编程、智能体与科研任务的纯文本 MoE 模型,总参数 501B、激活 23B,从零训练,完整权重将以 Apache 2.0 协议在本月放出。
推荐理由:汇总了 Reflection Beam 开源权重发布及同期多个模型与训练方法的进展,便于横向比较美国开源模型与前沿水平的差距。
GitHub 推出开放基准 ReviewBench,用于离线评测 AI 代码审查智能体,基于 1.039 亿个 GitHub pull request 的语言、仓库规模与变更分布构建,包含 19 种语言的 219 个公开 pull request。
MIT Technology Review 对 300 名数据与 AI 高管的调研显示,企业平均仅约 34% 的 agentic AI 项目能进入生产环境,知识、上下文缺失与遗留数据系统是主要失败点。
企业 AI 的竞争焦点已从预测模型能否超越统计预测,转向如何让预测系统在不偏离业务意图的前提下自主行动。深度学习与生成式 AI 驱动的智能分析支持实时训练,使 AI 持续演进而无需等待季度刷新,其数据来源也从规整的数值记录扩展到非结构化交互数据。Everest Group 合伙人 Vishal Gupta 认为,"分析"一词正在让位于 AI。
调查显示公众对 AI 的负面情绪持续升温:Pew 数据显示更多美国成年人认为 AI 对个人和社会的影响偏负面,Gallup 5 月民调中 71% 美国成年人反对在本地新建 AI 数据中心,而 ChatGPT 在 5 月月活用户突破 10 亿,Gemini 7 月达 9.5 亿。作者认为,人们厌恶的并非技术本身,而是科技公司不遗余力将 AI 推向各处的做法。
欧央行执委 Philip R. Lane 在 2026 年欧央行货币政策会议上发表主题演讲,阐述判断合适货币政策立场面临的诊断挑战。他指出利率决策基于三项标准:通胀前景及风险、潜在通胀动态、货币政策传导力度;9 月通胀数据显示整体通胀为 3.8%,其中能源通胀 18.8%、非能源通胀 2.3%,潜在通胀指标显示中期通胀尚未出现上行。
推荐理由:欧央行执委系统拆解能源冲击、财政与AI三重力量对通胀路径的影响,并给出利率决策框架。
OpenAI 发布 GPT-6.1 Sol,定价 $2/$10 per million input/output tokens,比 Astra 的 $10/$50 大幅降低,在 DeepSWE v1.1 上超 GPT-6 Sol 6.4 分。
GitHub 提出 AI 时代开发者需要强化三项技能:学会指挥 AI 智能体而非仅使用它、不轻信 AI 的第一次回答、用 AI 节省的时间去解决更大的问题。文中以 GitHub Copilot 内置的 Rubber Duck agent 为例,说明它用第二个模型对计划、代码和测试进行批判性审查,从而发现首个模型遗漏的问题。
美联储理事 Bowman 在讲话中介绍 eSLR 重新校准的初期效果:2025 年 11 月美联储理事会与 FDIC、OCC 敲定规则,将 GSIB 的 eSLR 缓冲标准改为 method-1 附加费的 50%,存款机构子公司上限 1%,最终规则 2026 年 4 月 1 日生效,八家美国 GSIB 中有七家在第一季度提前采用。
推荐理由:美联储理事复盘 eSLR 重新校准后的初期数据,呈现监管资本约束放松如何传导至国债做市与流动性。
美联储理事杰斐逊在弗吉尼亚大学讲话中表示,他支持上月FOMC将联邦基金利率目标区间上调25个基点至3.75%至4%,理由是通胀已超过2%目标五年多,需确保长期通胀预期锚定。
推荐理由:美联储官员在讲话中说明上月加息的理由,并给出评估后续政策路径所依据的数据与风险框架。
美联储理事 Waller 宣布,美联储理事会发布的部分数据将接入 FRED 及其工具。FRED 目前收录超 85 万条数据序列,2025 年独立用户达 1800 万,流量正以每年 150% 增长,约一半访问来自 AI 智能体。FRED 已推出基于 MCP 的 FRED MCP Connector,让用户用自选 AI 智能体检索数据。
美联储理事 Waller 在 Sibos 演讲中聚焦 AI 在支付领域的应用,指出 LLM 可提升制裁筛查与反洗钱准确率、大幅减少误报,并有望优化跨境支付路由与外汇兑换。他提出智能体商务存在"智能体辅助"与"智能体委托"两种模式,前者由买家决策并付款,后者由 AI 智能体自主购物支付,需更完善的信任机制与护栏。
微软研究院发布 Quine,一个面向生物学复杂性的 AI 研究系统,由生物世界模型与连接模型、科学工具、文献和实验的交互式 harness 两部分组成。该系统与 Broad Institute 合作用于胰腺导管腺癌研究,按驱动肿瘤细胞状态转换的潜力对数千种化合物排序,湿实验验证中排名最高的化合物产生了最大的预期状态转换,从缩小搜索空间到选出候选化合物只用了一个周末。
推荐理由:微软研究院公开 Quine 生物世界模型的设计思路与胰腺癌化合物筛选实测结果,可了解多模态世界模型在科研闭环中的落地方式。
GitHub Copilot 应用中的 canvas(画布扩展)是一种可自定义的双向界面,用户只需在 agent 会话中输入 /create-canvas 并用自然语言描述需求,即可生成看板、发布清单或仪表盘等界面,无需编写代码。canvas 支持用户与 agent 同时编辑并即时同步状态,创建后可保存为扩展供团队共享或个人复用,Awesome Copilot 还提供了现成的 canvas 扩展。
美国 Henry Hub 天然气现货价 6 月至 8 月均价为 $2.93/百万英热单位,较去年同期低 6%。可再生能源发电增加、天然气产量创纪录以及库存充足抑制了价格上行,其中太阳能发电同比增加 19.4 BkWh、风电增加 9.3 BkWh。EIA 预计 2026 年干天然气产量将达创纪录的 111.2 Bcf/d。
GitHub Copilot 应用推出 canvas,一种运行在应用内、无浏览器外壳的全栈小应用,可与 Copilot 智能体双向通信,并能在本地执行代码、调用第三方 API。官方认为聊天只是 AI 的通用兜底界面,用户明确任务时更该让智能体生成可复用工具,而非把智能体本身当工具、反复消耗 token。SQLite 等 canvas 可一次生成,工作流自动化示例则花了近一天调优。
GitHub Copilot 应用重建了 pull request 视图,用一个含 2,200 个文件、超 100 万行改动、400 多条行内评论的开源 PR 做压力测试。其做法是把文档高度拆成确定性的代码几何与动态评论块两套体系:代码行高提前精确算出,评论高度按块懒测量、以文件和行号锚定,避免滚动跳变。
GitHub Podcast 最新一期拆解了五个 AI 热门观点:AI 生成的代码仍需阅读和负责,只是审查力度应按风险分配;Skills 与 MCP 解决不同问题,前者是打包的团队经验,后者是连接工具与数据的标准,二者可组合使用;RAG 并未消亡,它让模型基于训练数据外的文档、内部知识或代码库上下文作答,减少 token 浪费和不完整回答。
EIA 在 9 月 18 日的简报中说明,柴油价格由原油价格、零售利润、分销成本、税费和裂解价差共同决定。截至 9 月 14 日当周,美国柴油零售均价为每加仑 6.29 美元,经通胀调整后为 2022 年以来最高,名义价格为 1994 年该系列发布以来最高。
推荐理由:EIA 拆解柴油零售价的构成,并给出库存、炼厂开工与净出口数据,可用来理解能源端对通胀的传导。
伯克利 EPIC Data Lab 提出近零推理成本时代数据系统面临三大挑战:为智能体服务、运行智能体、由智能体构建。GPT-4 级能力从 2023 年初约 $30/百万 token 降至如今不到 $1,部分厂商已低于 $0.10,推理价格年降幅在 9x 到 900x 之间,中位数约 50x。
伯克利 AI Research 发布综述,分析并行推理领域进展,重点讨论自适应并行推理——让模型自行决定何时分解并并行化独立子任务、生成多少并发线程以及如何协调。
Berkeley AI Research 提出 SPEX 与 ProxySPEX 算法,可在特征、数据与模型组件归因中大规模识别驱动 LLM 输出的关键交互。SPEX 利用稀疏性与低阶性把交互搜索转化为稀疏恢复问题,ProxySPEX 进一步利用层次结构,以约 10 倍更少的消融实验达到 SPEX 的性能。
伯克利 AI 研究团队提出一种直接评估和优化成像系统信息量的框架,仅用含噪测量和噪声模型估计互信息,无需任务专用解码器。该信息指标在彩色摄影、射电天文、无镜头成像和显微镜四个领域均能预测解码器性能,优化后的设计可媲美端到端方法,且内存和计算需求更低。相关成果发表于 NeurIPS 2025 论文。