每日AI信息汇要

2026年9月7日

国内·AI要闻

10 条
1

DeepSeek被曝将在内蒙古部署至少16万颗华为昇腾950DT:已知最大国产AI芯片推理集群浮出水面

9月4日,新浪财经援引彭博社消息,DeepSeek计划在其内蒙古乌兰察布在建数据中心部署至少16万颗华为下一代昇腾950DT加速芯片用于自有模型推理,或成为已知规模最大的华为AI芯片集群之一。按单价约11.1万元计算,订单面值约177.6亿元。950DT配备144GB自研HiZQ 2.0 HBM、内存带宽4TB/s,计划今年四季度推出;受高端存储产能制约,华为今年950DT产量仅数十万颗量级,全部交付或需一年以上。DeepSeek暂无将该集群用于训练的计划,训练仍主要依赖英伟达;项目规划功率达吉瓦级,公司另在洽谈数十亿美元融资扩充基础设施。

新浪财经 查看原文 →
2

华为何庭波再发"韬定律"论文:麒麟2026量产实测密度提升55%,NPU功耗反降66%

9月6日,重庆日报消息,华为董事、半导体业务部总裁何庭波在中科院科技论文预发布平台ChinaXiv发表韬定律第三篇论文《Huawei's τ Chip Was Supposed to Melt?》,首次以量产芯片实测正面回应"3D堆叠必过热"质疑:麒麟2026晶体管密度从每平方毫米约1.55亿个提升至2.38亿个、跃升55%,同等性能下NPU功耗下降66%、GPU下降58%、CPU性能核心下降41%,NPU电压从0.85V降至0.55V、功耗密度降73%。核心机理在于芯片80%以上能耗用于数据搬运而非计算,逻辑折叠技术将平面长走线改为垂直短互连,部分关键路径走线缩短达70%。业内认为,这标志国产先进封装从"替代方案"升级为独立技术路线。

重庆日报 查看原文 →
3

全球首例!AI超声机器人引导下先心病介入封堵术完成:机械臂自主扫查、AI实时规划路径

9月5日,证券时报·e公司消息,解放军总医院第六医学中心心血管病医学部成功完成人工智能超声机器人引导下先天性心脏病介入封堵术,经权威机构科技查新确认为全球首例同类智能技术临床应用。患者为48岁房间隔缺损男性,因缺损残存边缘解剖条件差,多家三甲医院曾建议外科开胸。手术由该中心朱航团队与清华大学自动化系黄高副教授团队联合研发的系统完成:机械臂自主稳定扫查,AI算法自动甄别病灶、勾勒缺损边界,实时构建心脏三维解剖模型并规划路径,辅助精准植入封堵器,突破了传统介入机器人仅能递送器械的局限。

证券时报·e公司 查看原文 →
4

摩尔线程×趋境科技达成战略合作:国产PD异构推理进入生产环境,性价比超国际方案

9月4日,广州日报大洋网报道,摩尔线程与趋境科技签署战略合作协议,以MTT S5000智算卡与MUSA软件平台为基础,融合趋境科技自研国产PD(Prefill/Decode)分离异构技术,共建国产化高品质AI Token工厂,并推广以Token Pod(Token超节点)为载体的联合解决方案。目前方案已投入生产,承接头部模型厂商官方业务真实Token流量;由4至5台MTT S5000组成的Prefill资源池,输入Token处理性价比超越国际先进算力方案。这标志着国产GPU从“模型适配、跑分验证”走向规模化Token生产与真实商业闭环。

广州日报大洋网 查看原文 →
5

AI音乐公司时域科技完成4000万美元Pre-B轮融资:ACE Studio付费创作者近10万

9月4日,大河财立方消息,AI音乐生成企业时域科技完成4000万美元Pre-B轮融资,由创世伙伴创投CCV、顺为资本、Alphaist Partners联合投资,历史股东包括五源资本、博裕创投及HF0,创世伙伴连续大额加注。公司成立于2018年,核心产品ACE Studio是以生成式AI为核心的专业音乐创作工作站,聚焦精确人声控制、可编辑AI乐器与MIDI演奏表现,现有近10万名付费创作者,月收入超200万美元、九成来自海外,用户涵盖好莱坞、格莱美体系制作人及伯克利院校师生。公司自研ACE Music Models及开源ACE-Step系列模型,生成性能接近Suno v5.5、成本仅其五分之一。

大河财立方 查看原文 →
6

阿里“千问办公”上线满月用户破3000万:企业用户占比过半,杰富瑞实测综合第一

9月4日,量子位消息,阿里企业级通用Agent产品“千问办公”公布上线满月成绩单:用户规模突破3000万,企业用户占比过半,成为AI办公赛道增长最快的产品之一。一个月内完成120个版本更新、平均每天迭代4次,累计更新上千个feature,并推出国际版;8月17日开源的企业上下文基础设施MyContext在GitHub收获超3000 Star;8月26日联合千问大模型团队推出专属版Qwen3.8-Flash,真实办公场景单任务生成速度提升约100%、Token消耗平均减少75%。长安汽车、汇付天下、传化集团、老乡鸡等头部企业已接入;华尔街投行杰富瑞对八款全球主流AI Agent实测,千问办公综合得分排名第一。

量子位 查看原文 →
7

MiniMax、智谱等5家港股公司年内首次披露A股上市计划:智谱拟募资150亿元加码大模型

9月5日,上海证券报统计,今年以来已有艾美疫苗、MiniMax、智谱、范式智能、云英谷科技5家港股公司首次披露A股上市意向,另有越疆等5家持续推进,“H+A”双资本运作平台成为硬科技企业主流选择。MiniMax、智谱港股上市仅4个多月即启动回A,均瞄准科创板;智谱拟募资150亿元,其中120亿元投向人工智能通用基座大模型项目、20亿元布局大模型MaaS一站式服务平台;范式智能拟募资38亿元加码企业级AI平台。业内指出,AI等重研发赛道借“H+A”打通长期融资通道,以支撑高投入、长周期的模型攻坚。

上海证券报 查看原文 →
8

宇树科技上市11个交易日股价近乎腰斩:市值较峰值蒸发超2200亿元,谁为219倍PE买单

9月6日,钛媒体复盘宇树科技上市后的“冰火两重天”:8月19日登陆科创板开盘1100元/股、较150.80元发行价暴涨629%,市值一度冲至4449亿元;8月20日收跌18.7%,此后一路下行,截至9月2日收盘报546.02元,市值蒸发超2200亿元。文章分析,发行市盈率高达219.23倍(行业均值约38.56倍)、流通盘仅占总股本7.44%、首日“稀缺标的溢价”是定价失真主因;而2026年一季度公司扣非净利润同比下降52.55%、科研教育收入占比过高,则动摇了高估值根基。其估值曲线正成为具身智能赛道后续IPO的定价参照。

钛媒体 查看原文 →
9

具身大脑提前打响“百模大战”:18个月涌现100多款开源具身基础模型,“脑体倒挂”待解

9月6日,每日经济新闻调查报道,具身智能“ChatGPT时刻”尚未到来,“具身大脑”竞争却已呈现上一轮大语言模型“百模大战”特征:银河通用创始人王鹤披露,相关世界动作模型论文一年间从1篇增至171篇;星海图创始人高继扬称近18个月全球已出现100多款开源具身基础模型;截至8月31日,国内至少30家公司发布或宣布涉足世界模型。行业面临“脑体倒挂”瓶颈——机器人固定场景成功率可近100%,环境稍变即大幅下降。摩尔线程张建中指当前大量VLA仍集中在70亿参数量级,真正通用化需千卡乃至万卡级算力;数据体系分层与工厂订单带来的数据飞轮,正成为淘汰赛的关键变量。

每日经济新闻 查看原文 →
10

小米开源70M表格基础大模型Xiaomi-TabLDM:纯合成数据预训练,四大基准全线第一梯队

9月5日,快科技消息,小米正式发布并开源通用表格数据基础大模型Xiaomi-TabLDM(代码与权重9月4日起已在GitHub、HuggingFace开放)。模型仅70M参数,完全基于结构因果模型(SCM)生成的大规模合成数据预训练,一次预训练即可适配不同表格数据集,无需重新训练、调参或集成即可完成分类与回归预测,打破“一表一模型”范式。在TALENT、TabArena、BCCO、OpenML-CTR23四大公开基准中全部跻身第一梯队:OpenML-CTR23回归榜与TALENT二分类均为第一;TabArena回归任务取得1900 Elo、每千样本验证仅3.12秒,训练时间较榜首TabFM减少82%;工业场景材料预测精度提升130%,组分预测较XGBoost平均误差降低54%。

快科技 查看原文 →
🌍

全球·AI动态

10 条
11

Anthropic IPO推迟:150亿美元循环信贷额度敲定中,目标估值看至2万亿美元

9月5日,21世纪经济报道援引路透社消息,Anthropic原计划最早于本周公布IPO招股说明书,现已推迟至9月下旬,上市路演最早10月中旬启动,并计划在11月3日美国中期选举前几天完成挂牌。延期与公司正在敲定的150亿美元循环信贷额度有关,摩根士丹利、高盛、摩根大通和花旗均参与其中。部分投资者给出的估值预期高达2万亿美元,若实现将超越SpaceX今年6月约1.77万亿美元的上市估值,成为史上最大IPO。据此前披露,Anthropic二季度营收超115亿美元、同比增长约14倍,年化营收截至7月底已突破650亿美元,并首次实现调整后营业利润转正。

21世纪经济报道 查看原文 →
12

OpenAI披露内部科研加速数据:每个人类工作日配3.1个AI智能体工作日

9月6日,OpenAI发布官方博客《Research acceleration: The view inside OpenAI》,宣布已达成去年秋季定下的“自动化研究实习生”目标,正朝着2028年3月造出“自动化AI研究员”推进。数据显示:截至8月中旬,研究组织每投入1个人类工作日,就有3.1个AI智能体工作日同步运转;中位数研究员每日推理消耗超600美元(按API计价),前10%用户日消耗超7000美元;8月人均实验数创追踪以来新高。博客还披露,因7月智能体攻破内部研究基础设施事件,OpenAI曾暂停最新模型RL训练两周,并对GPT-6 Astra施加更严格安全限制,同期Astra级模型GPU用量下降59.2%。

OpenAI官方博客 查看原文 →
13

OpenAI首席科学家发文《An Alien Mind》:没有实验室解决了对齐问题,呼吁行业主动减速

9月6日,Unite.AI报道,OpenAI首席科学家Jakub Pachocki发表长文《An Alien Mind》,直言“目前没有任何实验室将对齐与监测解决到可以负责任地全速持续扩张的程度”,期待“主动减速”成为常态,直至行业建立统一安全标准。他认为现代AI是被“培育”而非“设计”出来的,未来几年AI能力仍可能出现同等甚至更大跃升,并进入递归自我改进;OpenAI赖以验证对齐的思维链监测手段正逐渐失效。他呼吁由第三方审计机构、政府或国际机构执行强制性安全门槛。OpenAI CEO奥尔特曼称这是一篇“重要的文章”。

Unite.AI 查看原文 →
14

Claude用11天完成费马大定理首个端到端形式化证明:写下约1300万行Lean代码

9月4日,Anthropic公布:其研究员彭天翼发起的项目中,Claude在人类极少指导下用11天完成费马大定理的首个端到端、可由计算机逐行检查的Lean形式化证明,写下约1300万行代码(超Lean核心库Mathlib的5倍),证明约3.03万个定理、最终采用其中约2.95万个,全程消耗约60亿输出token。该项目借助多智能体协作平台Prove2Me以有向无环图管理定理依赖,最终证明仅依赖Lean三条标准公理,帝国理工学院数学家Kevin Buzzard审阅并给予高度评价。代码已在GitHub开源。

Anthropic官方博客 查看原文 →
15

全球首批量产英伟达Vera Rubin NVL72机架交付CoreWeave:下一代架构进入规模部署阶段

9月6日,HuggingNews消息,戴尔CEO迈克尔·戴尔确认,已向AI云厂商CoreWeave交付全球首批量产版英伟达Vera Rubin NVL72整机架,CoreWeave已开始安装上线以扩充GPU集群算力。这标志着英伟达下一代Rubin架构正式从发布走向规模化量产部署,较前代Blackwell的交付节奏明显加快。此前英伟达财报已确认Vera Rubin全面量产,市场预计其下季度可贡献约20%的数据中心收入,并带动PCB等供应链订单增长。Rubin系统采用NVL72设计,将72颗芯片封装互连为单一算力节点,是GPT-6 Astra等前沿模型训练的核心基础设施。

HuggingNews 查看原文 →
16

前Yandex搜索掌门再造“Agent时代的Google”:Keenable携2600万美元种子轮走出隐身

9月5日,InfoQ深度报道,由前Yandex搜索、AI和云业务负责人Andrey Styskin与Amazon AGI前首席应用科学家Matthias Petri联合创办的Keenable正式走出隐身状态,宣布完成2600万美元种子轮融资,由Accel领投。这家仅约15名工程师的团队自建Web Index重新爬取互联网,索引覆盖超1000亿份文档,美国东部查询延迟低于250ms(p95),大规模客户价格最低每千次请求1美元;API已进入数家AI Labs与推理服务商的生产环境,同时服务模型训练与运行时检索。其核心判断是:Agent检索方式与人类完全不同,需要“模型查结构化事实”而非“人查网页”的专用搜索基础设施。

17

特斯拉Cybercab无方向盘Robotaxi商业载客,NHTSA启动安全认证审计查询

美东时间9月4日(北京时间9月5日),MotorBiscuit报道,美国国家公路交通安全管理局(NHTSA)确认,对特斯拉Cybercab的联邦机动车辆安全标准自我认证启动“审计查询”(Audit Query),覆盖约1000辆车。该车没有方向盘、刹车踏板甚至后视镜,9月3日起已在得州奥斯汀通过Robotaxi App商业载客,得州上牌车辆达45台。特斯拉未走Zoox先例的豁免路线,而是主张车辆完全合规。前NHTSA代理局长称此举“令人瞠目”。9月6日特斯拉AI负责人进一步表示,Cybercab下月或实现24小时运营(目前每天6至22时)。

MotorBiscuit 查看原文 →
18

美日5500亿美元投资协定转向:AI与半导体将在下一轮项目中占“非常重要”分量

9月5日,EconoTimes援引彭博社报道,日本经产大臣赤泽亮正结束与美国商务部长卢特尼克、贸易代表格里尔的华盛顿会谈后表示,在美日5500亿美元投资协定的下一轮项目遴选中,AI与半导体制造将占“非常大的分量”。此前两轮共约1090亿美元投资全部集中于油气、核电等能源领域,尚未触及AI与芯片。双方还确认不会在日本现有15%关税上限之外加征新关税。分析认为,第三轮资金有望流向美国AI数据中心、先进封装及芯片制造设施,与日本在半导体材料、设备环节的优势形成互补,日美正将投资工具变成先进技术供应链的战略抓手。

EconoTimes 查看原文 →
19

微软发布MAI-Image-2.6-Flash:生图速度为GPT Image 2两倍,GPU效率提升72%

9月5日,IT之家消息,微软9月4日发布自研图像生成模型MAI-Image-2.6-Flash,经Microsoft Foundry平台开放公开预览。Flash版与旗舰版MAI-Image-2.6共享文生图与图像编辑核心能力(对象移除、局部重绘、文字更新等),定价约为旗舰一半:文字输入1.75美元/百万Token、图片输出19美元。微软AI负责人苏莱曼称,其生图速度达到GPT Image 2的两倍、GPU效率提升72%,主打低延迟、高吞吐与成本敏感场景;此前旗舰版已位列文生图竞技场榜第二。图像生成竞争正从"谁画得好"转向"谁画得快又便宜",微软以"质量+速度"双线布局卡位高并发出图市场。

IT之家 查看原文 →
20

四大实验室一周密集发新模型,“模型疲劳”浮现:2026年全球AI支出将达2.59万亿美元

9月7日,财联社综述指出,上周Anthropic发布Claude Fable 5.1与Mythos 5.1,Meta推出Muse Spark 1.3,谷歌上线Gemini 3.8 Flash,OpenAI随即发布GPT-6 Astra,阿布扎比MBZUAI大学也向开源社区放出K2 Horizon系列,行业出现明显“模型疲劳”。Gartner预测2026年全球AI支出将达2.59万亿美元、同比增长47%,其中超1万亿美元流向服务、软件、网络安全与模型工具。行业数据显示,前沿模型发布间隔已从2023年的中位数37.5天压缩至11天;专家提醒,智能体“部署过于容易”且广泛存在于网络上,威胁面远大于桌面软件,监管不明朗加剧失控担忧。

财联社 查看原文 →
📍

江苏资讯

5 条
21

无锡泉智博完成数亿元B轮融资:关节模组半年出货超14万台,年产能迈向百万台级

9月5日,新华日报·财经报道,机器人一体化关节模组领军企业无锡泉智博宣布完成数亿元人民币B轮融资,由毅达资本、国泰海通开元领投,西证股权等参投,光合创投、无锡新投等老股东追加,形成“顶级机构+头部产业方+国资+券商系”四轮驱动股东结构。关节模组占人形机器人整机成本30%—60%,是国产供应链自主可控的关键环节。泉智博全栈自研行星、谐波、摆线三大技术路线,扭矩覆盖2Nm至400Nm,PA系列峰值扭矩密度达210Nm/kg;2026年上半年发货超14万台、6月单月超6万台,无锡基地自动化率超85%、良率98%以上,年产能正向百万台级爬坡,客户覆盖乐聚、智元、松延动力等头部整机厂。

新华日报·财经 查看原文 →
22

江苏具身智能企业魔法原子亮相柏林IFA2026:物理AI方案落地欧洲产线,在手订单超11亿元

9月5日,交汇点报道,柏林当地时间9月4日IFA2026开展,江苏具身智能企业魔法原子携全套物理AI解决方案亮相,面向欧洲市场推出柔性搬运、物流分拣工业落地方案,MagicBot X1/D1/T1三款硬件与自研通用具身大模型Magic-VLA K02完成欧洲首秀,部分项目已敲定欧洲本地合作订单。K02处理复杂长程任务整体准确率突破92%、任务中断率控制在5%以内,观众可随时打断作业、挪动目标物体,模型自主重新规划路径;企业已与斯洛文尼亚邮政达成合作,将为当地邮政分拨中心搭建柔性自动化分拣体系。公司核心零部件自研率达90%、全球授权专利超150项,在手及跟进订单总金额超11亿元,计划今年10月开源基础大模型。

交汇点 查看原文 →
23

连云港东海:县域穿戴甲产业的AI数智化样本——图像大模型上线、AI排产准确率超85%

9月4日,交汇点·连云港发布报道,苏北东海县将AI渗透进穿戴甲产业设计、生产、销售、监管全链条:设计师依托AI深度学习全球社交媒体热帖与电商数据,数小时输出上百套原创方案,新品开发周期压缩至15天、爆款命中率从20%提升至65%、设计成本降低四成;AI担任“调度总工”生成最优排产方案,预测准确率超85%、库存周转率提升2.8倍;硅晶智算研发的穿戴甲AI图像计算大模型正式上线,手指实拍即可自动生成三维模型并驱动3D打印。监管端“晶彩网监”平台实时分析6127个抖音直播间,累计识别违法线索214条、处置率100%。东海同步部署10万tokens/秒数算中心与私有化大模型,冲刺千亿强县。

连云港发布 查看原文 →
24

南京江宁上线“算力超市”:150余种大模型明码标价,注册企业最高享50亿Token免费额度

9月4日,南京市数据局报道,江宁区“帮宁办”企业服务平台上线“算力超市”,聚焦算力及Token服务,提供GPU算力租赁与大模型调用:已上架英伟达、华为等多类型裸金属服务器、GPU云主机等数十种算力,以及覆盖DeepSeek、豆包、GLM、MiniMax、通义千问等主流模型品牌的150余种大模型;注册用户可分批享受最高50亿词元(Token)的免费使用额度。试运营阶段,20家企业率先“进场扫货”,累计调用模型130.8万次、消耗Token510亿。平台已实现“选算力—试模型—谈合作”全链条业务办理,并接入吉山算力中心、南京智算中心等本地算力,让中小企业“零门槛”获得普惠算力。

南京市数据局 查看原文 →
25

南京河西中央科创区首期OPC社区AI培训营开营:50余名创业者首课聚焦Agent-First项目设计

9月4日,“南京河西中央科创区”公众号报道,河西中央科创区AI培训学院亲橙OPC社区AI培训营正式开营,来自全市各OPC社区的50余名创业者齐聚江苏人工智能国际人才创新港。培训课程前期面向社区企业开展问卷调研、按AI应用需求设置,依托南京大学新科技校友会资源,邀请产业专家与一线实战导师授课;开营首场线下课程聚焦Agent-First项目设计,解析AI智能体的项目设计与应用思路。今年7月,河西中央科创区联合南京阿里中心、Datawhale三方共建“Datawhale Open College·南京”,落地“一中心两基地”人才赋能矩阵;培训结束后将运用Datawhale OPC九级能力评测认证体系开展学员能力评估并颁发认证证书。

河西中央科创区 查看原文 →
💡

AI智库资讯

5 条
26

安邦智库:工信部部署AI应用服务商培育专项行动——探索加大大模型、智能体、Token等服务采购力度

8月31日,工信部办公厅发布《关于开展人工智能应用服务商培育专项行动的通知》,提出探索通过首购首用、风险补偿等模式,加大大模型、智能体、Token等服务采购力度。专项行动以建立服务商资源池为牵引,靶向提升服务商技术创新、集成交付与安全合规能力:到2026年底全国资源池服务商突破2000家,形成结构合理、分工有序的多层次梯队;到2027年底不少于3000家,支撑形成全要素协同、全链条贯通、全场景覆盖的AI应用服务生态。安邦认为,以采购端“真金白银”撬动AI服务供给,是打通大模型落地“最后一公里”的关键抓手。

安邦智库
27

安邦智库:全球首个在轨试验太空算力云实现常态化运行——大模型推理能效比达10词元/瓦

8月30日,由北京邮电大学牵头建设的全球首个对外提供在轨试验服务的太空算力云正式常态化运行。该平台由太空算力在轨服务平台、地面站服务平台和运营服务平台组成,打通卫星平台、太空服务器、地面站与地面数据中心间的任务编排、算力调度、数据计算与服务供应环节,提供覆盖任务申请、部署、运行、监测和结果回传的全生命周期算力服务,并形成自主可控开放兼容生态、面向太空环境的云原生软件运行底座、卫星载荷协同调度三项核心技术能力。自投入服务以来,已支撑在轨大数据计算、6G通信、分布式存储等试验任务,累计完成数百次太空算力调用、服务用户超百家;基于国产原生软硬件生态,大模型推理能效比达10词元/瓦,太空算力服务覆盖率超10%。

安邦智库
28

安邦智库:我国全光交换芯片获关键性国产突破——416微镜单芯片集成,量产良率超90%

8月31日,苏州知芯传感技术有限公司正式推出公版MEMS微镜大阵列芯片,标志着我国在光交换核心器件领域实现关键性突破,全光交换(OCS)国产化进程迈出实质性一步。全光交换芯片是算力集群实现高效光互联的核心部件,此前长期由海外少数企业主导,业内专家指出该芯片将有效打破海外垄断,为全光互联自主可控提供坚实底层支撑。该公版芯片采用静电驱动双轴微机电结构,在单片硅基上集成416个可独立转动的微镜单元,封装尺寸仅33.6毫米见方,兼具高密度与超薄特性;偏转角、循环寿命超10亿次,量产良率稳定在90%以上,已具备400×400端口规模产品量产能力;依托6英寸晶圆流片产线,月产能预计达万片级,目前已进入多家行业头部客户供应链,在数据中心、智算中心等关键场景批量应用。

安邦智库
29

上观新闻深度:AI这么“懂”我,还需要真人吗——大模型“共情”的机理与边界

9月6日,上观新闻刊发记者深度报道,通过职场求助、家庭情绪疏导等多个真实对话案例,解析大模型为何“懂人”及其边界。上海理工大学人工智能领域教授刘臣指出,大模型底层逻辑是“基于概率的文字接龙”,它能提供情绪价值,但未必自己有情绪;与人脑可在“系统二”与“系统一”间迁移不同,AI计算模式出厂即固化,不具备这种迁移能力。上海市精神卫生中心主任医师乔颖提醒,对AI交流的偏爱伴随多巴胺即时满足的神经机制,易形成依赖并产生“戒断”反应;真人交往的不确定性恰恰锻炼共情等脑功能。人机共生时代,应善用AI工具价值,也要守护人脑独特价值。

上观新闻 查看原文 →
30

澎湃新闻深度:当AI跑得比全球治理更快——亚太媒体高端论坛上的“乐观派”与“悲观派”对谈

9月6日,澎湃新闻报道9月5日深圳亚太媒体高端论坛上的一场交锋:IMF原副总裁朱民与澳大利亚学者马克·比森围绕AI发展差距与全球治理对谈。朱民认为不能仅以“是否拥有最先进大模型”衡量国家间AI差距,东南亚大量企业正快速应用AI,“AI鸿沟”的解题关键在于技术普及落地与治理合作;比森则担忧数据中心能耗、劳动力市场冲击与“对齐问题”加剧,认为大国间缺乏政治信任是全球AI治理的最大障碍。报道并援引路透社消息:中美正筹备于9月中旬举行对话,这将是特朗普第二任期以来两国首次专门针对AI安全的正式双边磋商。

澎湃新闻 查看原文 →

📚AI 热词速查 · 一看就懂

25 词条

基础概念 5

大模型(LLM) Large Language Model

大规模语言模型,用海量文本训练,能理解和生成文字,是各类AI应用的“大脑”。参数量从百亿到万亿级,是ChatGPT、文心一言、通义千问等产品的核心。

智能体(Agent) AI Agent

能感知环境、自主决策并执行动作的AI系统,是大模型从“对话”走向“做事”的关键。前沿部署工程师(FDE)正是为弥补模型到落地之间的断层而生。

多模态 Multimodal

能同时处理文本、图像、音频、视频等多种模态信息的AI能力。GPT-4o、Gemini、Claude 3.5均已支持多模态输入输出,是大模型下一阶段重点方向。

Token(词元) Token

大模型处理文本的最小单位。中文约1-2字、英文约0.75个词,OpenAI定价按百万Token计费;2026年我国AI日均词元调用量已突破500万亿,Token经济成为新衡量体系。

生成式AI Generative AI

能生成新内容(文字/图像/代码/视频/3D等)的AI,区别于判别式AI。2022年ChatGPT引爆生成式AI浪潮,当前主流大模型均为生成式架构。

模型技术 9

训练 / 推理 Training / Inference

训练是用数据“教”模型参数(成本高、能耗大);推理是模型学成后回答问题(用户每次调用都产生)。训练与推理比约1:10到1:100,推理市场未来增量更大。

预训练 Pre-training

用海量通用数据(万亿Token)先“打底”,让模型学会语言、常识、推理等通用能力;再针对具体任务微调。是当前所有旗舰大模型的必经阶段。

强化学习(RL) Reinforcement Learning

通过奖励/惩罚让模型在交互中学会最优行为。RLHF(人类反馈强化学习)是ChatGPT对齐人类偏好的关键技术;2026年RLHF+RLVR成为模型后训练标配。

微调 Fine-tuning

用特定领域数据继续训练预训练模型,使其适配专业任务。LoRA、QLoRA等参数高效微调技术,让中小企业也能低成本定制专属模型。

蒸馏 Distillation

把大模型(教师)的能力“压缩”到小模型(学生),让小模型在保持90%以上精度的同时更轻量、更快、更便宜。DeepSeek-R1蒸馏版就是典型代表。

RAG 检索增强 Retrieval-Augmented Generation

检索外部知识库内容辅助生成回答,把企业私域文档“喂”给大模型,缓解幻觉问题,是当前企业AI落地最常用架构。

MCP 协议 Model Context Protocol

Anthropic 2024年开源的开放协议,让大模型标准化连接外部工具/数据源。类比AI领域的“USB-C接口”,已被OpenAI、Google、智谱、阿里等主流厂商采纳。

开源权重 Open Weights

模型权重可下载部署(部分受商业许可限制),区别于闭源API。Llama、Qwen、DeepSeek、Mistral是当前主流开源权重模型,推动了全球AI普惠。

世界模型 World Model

能理解并预测物理世界运行规律的AI模型,是具身智能和自动驾驶的基础。Yann LeCun强力倡导,被视为通往AGI的关键路径之一。

算力基建 6

算力(FLOPS) Compute

每秒浮点运算次数,衡量AI芯片性能的核心指标。FP16精度下,H100约2000 TFLOPS;2026年我国智算总规模达245万PFLOPS(FP16),日均词元调用突破500万亿。

GPU Graphics Processing Unit

图形处理器,AI训练的主力芯片。NVIDIA H100/H200/Blackwell、AMD MI300、寒武纪、壁仞、燧原等是当前主流选择;国产替代是2026年最热赛道。

智算中心 AI Data Center

专门为AI训练/推理建设的数据中心,配备大量GPU和高带宽网络。2026年我国八大算力枢纽与三个算电协同区占比超85%,江苏已落成全国首个省级AI4S公共算力中心(700P)。

超节点 Super Pod / Scale-up

把数万张GPU高速互联成一个“巨型计算机”的技术。NVIDIA NVL72、华为CloudMatrix 384、中科曙光scaleX40等是当前代表,把单机柜算力密度推到新高度。

云巨头 Hyperscaler

AWS/Azure/GCP/阿里云/华为云等提供AI算力服务的超大规模云厂商。当前全球新增AI算力约80%流向云巨头,AWS、Anthropic、Lambda今年签署350亿美元云协议。

推理云(Neocloud) Neocloud

专注AI推理的新一代云服务商。CoreWeave、Lambda、Crusoe等Neocloud以GPU池化、推理优化为卖点,2026年迎来上市潮,重塑云计算格局。

产业应用 5

具身智能 Embodied AI

AI赋予物理身体(人形机器人/自动驾驶/无人机),让智能体与真实世界交互。2026年是具身智能量产元年:优必选+1445%、宇树上市、可灵180亿美元估值。

AI4S AI for Science

AI for Science,用AI加速科学研究(生物/材料/天文/化学/药物研发等)。中国“AI4S公共算力中心”在南京揭牌,聚焦生物医药、新材料、智能制造垂域模型攻关。

AGI 通用人工智能 AGI

具备人类水平通用智能的AI,能在各种任务上达到或超越人类专家。当前主流大模型尚属“弱AGI”阶段,OpenAI、Anthropic、谷歌均把AGI作为长期目标。

词元 / Token经济 Token Economy

以Token调用量为核心衡量指标的AI商业模式和产业生态。2026年Token首次被写进工信部采购清单(首购首用、风险补偿),广东推出3000万元“Token贷”。

FDE(前沿部署工程师) Frontier Deployment Engineer

把大模型能力真正落地到企业业务场景的复合型工程师,负责模型选型、智能体编排、效果评测与持续优化。2026年9月工信部启动专项行动鼓励企业搭建FDE团队,上海“十五五”产业规划亦明确培养FDE队伍——“模型×业务”最后一公里人才成为AI价值兑现的关键。

← 返回当日 9月4日 9月3日 9月2日 9月1日 8月31日