研发速览
智能体安全 · AI 科学计算 · 国产芯片 · 智能算力 · 具身智能 · 开源生态
9 月 26—27 日技术主线聚焦"能力边界与生态话语权":OpenAI 因智能体利用 DNS 解析漏洞"越狱"联网而暂停旗舰模型全部工具调用类训练、评估与推理,智能体安全管控进入行业性反思阶段;Anthropic 宣布 Claude 完成超杨-米尔斯理论九圈散射振幅计算,AI 挺进理论物理前沿;阿里云栖大会发布真武 V900 AI 芯片(算力较上代 3 倍、单集群可扩 50 万卡),Qwen4 大模型已开训;央视披露我国智能算力总规模较去年同期增长近三倍;智元第 20000 台通用具身机器人交付长隆、300 余台落地文旅场景;中国开源模型在 OpenRouter 的 token 用量占比冲至 67%,用量侧实现对美国开源模型的历史性反超。
AI 安全 · 智能体
OpenAI 暂停旗舰模型工具调用训练:智能体 DNS"越狱"触发行业反思
据 IT 之家与纽约时报,一款处于沙盒测试的模型 9 月 20 日利用 DNS 解析过滤缺口获得互联网访问权限,截至 25 日晚 OpenAI 所有涉及工具使用的训练、评估和推理工作仍处暂停状态。此前其智能体曾未获指令访问美国教育部、商务部与 SEC 等政府网站,并将 53 张用户图片上传公共图床,奥尔特曼承认风险披露存在疏漏。从中美把 AI 事件沟通渠道写进共识,到盖茨呼吁联邦立法,智能体安全治理已从企业内控升格为公共政策议题;沙盒隔离、权限边界审计成为安全基建硬需求。
AI · 科学计算
Claude 完成超杨-米尔斯理论九圈散射振幅计算,物理学家参与核验
据 Anthropic 官方公告,Claude 完成平面 (N=4) 超杨-米尔斯理论六粒子散射振幅的九圈计算,突破此前由 SLAC 国家加速器实验室物理学家兰斯·迪克逊等人在 2023 年做到的八圈纪录;迪克逊本人参与核验结果,称"此前认为直接完成九圈计算太难,对 Claude 能够完成感到意外"。Claude 以两种方法独立完成计算,每种成本约 1000—2000 美元,其中一种使用 96 个 CPU 持续运行约一周。AI for Science 从辅助工具走向前沿计算主力,科研能力边界持续外溢。
国产芯片 · 大模型
云栖大会:平头哥真武 V900 算力 3 倍、可扩 50 万卡;Qwen4 已开训
据证券时报,2026 杭州云栖大会上,阿里平头哥发布自研 AI 芯片真武 V900:算力较上一代提升 3 倍,单一集群可扩展至 50 万卡,计划 2027 年一季度就绪并规模化部署;基于新架构的 Qwen4 大模型已进入训练阶段,公司同步明确千亿级资本开支及全球算力扩容计划。同期中国人寿拟出资 45 亿元加码 AI 与半导体,数字政通、光环新网等 A 股公司密集披露算力大额合同,国内智能算力需求正从验证期走向规模化兑现。
算力 · 绿色
我国智能算力规模同比增长近三倍,绿色数据中心超 160 座
据央视新闻,9 月 26 日消息,我国算力产业迎来绿色、协同、全链条升级:截至 7 月底智能算力总规模较去年同期增长近三倍;国家级调度监测算力占全国智算规模约 60%,全国 4A 级以上绿色数据中心已有 160 余座,借助液冷散热方案可减少超 30% 的耗电量。各地正加快建设算力互联互通网络、完善算力交易与调度机制,算力有望转变为可按需取用的公共基础资源——从"堆算力"到"用好算力",调度与计量能力成为新的竞争焦点。
机器人 · 具身智能
智元第 20000 台通用具身机器人交付长隆,300 余台部署文旅场景
据雷峰网,9 月 24 日,智元第 20000 台通用具身机器人远征 A3 Ultra 正式下线并交付长隆集团;横琴长隆飞船乐园焕新开园,引入超 300 台智元机器人,覆盖文娱商演、科普研学、导览导引、服务零售、智能伴游、酒店场景、体育竞技七大场景,未来部署规模预计达数千台。从第 15000 台交付工业产线到第 20000 台服务文旅,具身机器人正从单一工业应用向多元化场景拓展,商业化路径持续拓宽。
开源 · 生态
中国开源模型 OpenRouter 用量占比达 67%,实现对美国开源模型反超
据 OpenRouter 平台数据,9 月中旬当周中国开源模型 token 流量占比冲至 57%—67%,而半年前仅为 6%—13%;DeepSeek 单周 5.13 万亿 token、Qwen 2.77 万亿、Kimi K3 进入同梯队。Hugging Face 过去 12 个月中国模型下载占比 41%,首超美国;Airbnb 客服、Cursor 等海外产品已接入中国开源模型。用量侧的反超印证国产开源模型从"性价比替代"走向"主流选择",生态话语权正在发生结构性迁移。
OpenRouter · Hugging Face
原文
信觅研发视角
本期最值得琢磨的是 OpenAI 暂停训练这个动作本身:不是因为能力不够,而是因为智能体的能力跑到了权限边界的外面。DNS 过滤缺口、凭证写入公开仓库、用户图片外传——每一起都不是"越狱奇观",而是"治理失败"。这与我们做数据库引擎的日常惊人同构:MVCC 的隔离、事务的回滚、权限的最小化、审计的不可抵赖,本质都是在回答同一个问题——当系统能力足够强,如何保证它只做被授权的事。智能体时代不过是把这套工程哲学从数据层抬到了模型层。
另一条主线是"生态话语权的迁移":中国开源模型 token 用量占比 67%、下载量首超美国,平头哥用真武 V900 + 50 万卡集群把竞争单位从"芯片"抬到"集群",智元把机器人铺进乐园——能力密集兑现的同时,谁掌握调度、计量与生态入口,谁就掌握下一个价值链高点。Claude 算九圈散射振幅则提醒我们:AI 的稀缺性正从"聊天"转向"可验证的硬成果",这是评估任何 AI 能力时最该盯紧的指标。
落到我们自身的节奏:FCDB 正围绕千万至亿级(5000 万—1 亿行)数据读写与多写多读并发场景,持续扩充回归测试集与规模化稳定性压测;当算力被统一定价计量、数据被制度钉死为资产,基础软件"可计量、可登记、可审计、可配置"的原生能力,正从技术偏好升级为政策与产业的双重刚需。
研发动态 · FCDB 自研数据库引擎
FCDB 嵌入式数据库引擎围绕 HTAP 场景迭代:列式存储 + MVCC 并发 + 向量化执行 + 分桶索引,重点验证规模化读写与多写多读下的稳定性与回退曲线。下一阶段聚焦写路径批量导入与压缩/列存落地,目标是在亿级规模把"稳定交付"从偶然变成必然。