大模型 · 开源 · 头条
DeepSeek V4.1 Flash 发布:token 价格打到几分钱,性能反超 V4 Pro
DeepSeek 9 月 10 日 12:00 起执行新定价:闲时输入缓存命中 0.02 元/百万 token(降幅 60%)、未命中 1 元、输出 4 元;V4.1 Flash 原生多模态、约 284 token/s,性能全面超越 V4 Pro,并自动把 V4 Pro 请求路由到新模型按低价计费。华泰证券认为有望提振开源社区共建氛围,中信证券指 AI 应用正走向普惠。对数据系统,廉价且高性能的模型 API 让"本地长上下文 + 库内推理 + 向量检索"的同进程原生能力更具落地性价比。
¥0.02/百万
降幅 60%
原生多模态
库内推理
国产数据库 · 多写 · 开源
openGauss 7.0.0 LTS 月底发布,oGRAC 多写首个开源可商用版
DTCC 2026 上华为 openGauss 公布"1+2"战略:"1"是高性能高稳定主备 TP 内核;"2" 即 oGRAC 多写与 AI 原生多模。oGRAC 通过 DLS 分布式锁、DCS 分布式缓存、MES 集群间通信构建内核级多主引擎,2 节点性能达 470 万 tpmC(较去年底 +27%),预计 9 月底随 openGauss 7.0.0 LTS 发布首个开源可商用版本;同步布局多模检索、Serverless 数据分支(1000 实例 5 秒启动)与 Agent 记忆系统。开源多写数据库从技术验证走向生产落地。
oGRAC 470万tpmC
7.0.0 LTS
多写商用
Serverless分支
国产数据库 · AI 湖库
OceanBase 拟 A 轮融资 20–30 亿,推出 AI 湖库一体架构
OceanBase 寻求 A 轮融资约 20–30 亿元,年化收入已超 14 亿元(同比 +70%)、全球客户超 4000 家,被媒体称为"中国的 Databricks"。产品侧推出 OceanBase AI 湖库:一份数据承载事务、分析与 AI 工作负载,多模表统一管理结构化、非结构化与向量数据,数据沙箱毫秒级克隆支撑 Agent 从安全试错到规模化运行。从"分布式数据库"向"AI 数据平台"延伸,印证"库内原生 AI"成为头部厂商共识。
A轮 20-30亿
收入 +70%
湖库一体
多模表
数据库安全 · 高危漏洞 · 头条
PostgreSQL CVE-2026-14669 高危 RCE:to_char 堆溢出,PoC 已公开
PostgreSQL 8 月安全更新修复 CVE-2026-14669(CVSS 8.8)堆缓冲区溢出:to_char() 在处理时区路径时未做长度检查,攻击者可借超长 POSIX 时区缩写触发堆溢出转化为远程代码执行,完整 PoC 已公开。影响 PG 18.5/17.11/16.15/15.19/14.24 之前版本,任何有 SQL 执行权限的用户均可触发(无需超级用户)。DBA 应在 Q3 补丁窗口优先升级,并对数据库连接实施最小权限原则——这再次警示:连接层的"可审计、最小权限、访问留痕"是数据库原生能力。
CVSS 8.8
PoC 公开
to_char RCE
最小权限
具身智能 · 机器人 · 数据
智元 AGILE2.0 感控一体:灵犀 X2 首次实现双足人形机器人自主踩球行走
智元发布 AGILE2.0 端到端感控一体闭环模型,在环境观测、地形理解、全身运动控制、接触状态切换与末端精细操作等环节全链路深度耦合,构建无中间模块的统一自主推理。灵犀 X2 双脚站球滚动前行,成为行业首次双足人形机器人自主踩球。从本体、控制器到数据集、标准体系的生态成型,意味着具身智能进入"可量化评测、可标准化量产"阶段——而机器人每秒产生的传感/轨迹数据,正是边缘数据库与实时流处理的天然练兵场。
AGILE2.0
踩球行走
感控一体
边缘实时
具身智能 · 金融 AI · 开源
小鹏 IRON 走下自动化产线,蚂蚁开源金融增强模型 Ling-3.0-flash-Fin
小鹏在广州激活全球首条高阶人形机器人自动化产线,核心制程自动化率超 80%;IRON 全身 76 自由度、单手 21 自由度、3 颗图灵 AI 芯片、2250 TOPS、端侧跑物理 AI 大模型,计划年底规模量产、2027 海内外交付。同期外滩大会上,蚂蚁百灵开源首个金融增强模型 Ling-3.0-flash-Fin(124B 总参/5.1B 激活/256K 上下文 MoE),并开放金融搜索 Agent 评测基准 FinFIRST——专业场景闭环 + 开源评测基准,正在抢金融 AI 的事实标准。
IRON 产线
2250 TOPS
Ling-3.0-flash-Fin
FinFIRST
半导体 · 国产 GPU · 算力
国产 AI GPU 单卡追至 H100 六成,自研互联瞄准 1024 卡"团战"
2026 上半年国产 GPU 静悄悄跨过规模化商用门槛:昇腾 910C 综合性能约发挥 H100 的 60%,摩尔线程 S5000 推理 Prefill 极致优化后实测吞吐逾 H100 的 61%(注:H100 为英伟达 2022 年旗舰)。单卡追不上就捆更多芯片——华为 CloudMatrix、沐曦 BLink 2.0、壁仞 BLink 2.0 自研互联均支持最高 1024 卡单域扩展;昇腾 384 超节点已累计商用 750 多套,下一代昇腾 950 超节点理论支持 8192 卡互联、先期商用 1024 卡,预计 2026 年四季度上市。对数据库,"多架构可移植 + 计算卸载友好"已从技术偏好升级为政策与业绩双重刚需。
H100 60%
1024 卡互联
昇腾 384
950 超节点
端侧 AI · 消费电子
苹果 iPhone Duo 折叠屏发布:端侧 AI 成卖点,国行双供应商方案
9 月 10 日凌晨苹果秋季发布会,首款折叠屏 iPhone Duo 国行 15999 元起、顶配 26499 元,7.6 吋内屏 + 5.4 吋外屏,搭载 2nm A20 Pro(32 核神经引擎),iOS 27 强化端侧 AI;国行采用"苹果端侧基础 AI + 阿里通义千问生成 + 百度 AI 搜索"双供应商方案。Counterpoint 预计首年拿下全球折叠屏约 25% 份额。端侧 AI 与本地大模型推理进入消费级主战场,对嵌入式与边缘数据库的低延迟、小 footprint 提出新要求——"库内向量 + 本地推理"离口袋越来越近。
A20 Pro 2nm
端侧 AI
通义千问
小 footprint