每日AI信息汇要

2026年9月16日

国内·AI要闻

10 条
1

华为发布全球首个3D数据中心:四层垂直架构支撑十万卡昇腾超节点集群

9月15日,2026 AIDC产业发展大会暨3D数据中心现场会在安徽芜湖举行,华为发布全球首个3D数据中心,并开放《3D数据中心概要设计图库》。该架构借鉴芯片工厂“动力层”与“生产层”分离理念,将传统数据中心水平部署的功能空间垂直叠加,形成自下而上的供冷层、IT设备层、供电层、备电层四层结构,实现分区散热与故障不蔓延。华为副董事长、轮值董事长汪涛表示,十万亿参数大模型和高速增长的Token需求对AI基础设施提出更高要求,十万卡以上昇腾超节点集群将成为基础配置。据披露,3D数据中心单栋机房支持168MW,PUE达行业领先水平;中国Token日均消耗从2024年初的日均千亿增至2026年的日均约500万亿。

大皖新闻 查看原文 →
2

两部门印发《电子信息制造业发展“十五五”规划》:夯实人工智能硬件底座

9月15日,工业和信息化部、国家发展改革委联合印发《电子信息制造业发展“十五五”规划》,围绕“筑基、提质、育新、治理”部署17项重点任务。目标到2030年,规模以上企业营业收入突破30万亿元,研发投入强度达到3.5%,算力供给能力大幅增长。规划重点部署“夯实人工智能硬件底座”:加强人工智能芯片与整机产品协同,加快云端训练设备开发,面向具身智能、自动驾驶等领域开发端侧推理设备及芯片;推动计算高速互连总线统一协议(CLink)系列规范编制实施;强化人工智能芯片与大模型、数据库等适配。终端侧推动人工智能手机、个人计算机、智能眼镜、车载终端等迭代升级,加快智能体与终端产品深度融合。

中国证券报 查看原文 →
3

飞书发布8.0版:国内首个团队智能体“豆包工作伙伴”可以像同事一样加入群聊

9月15日,2026飞书未来无限大会在北京举办,飞书发布8.0版本并同步推出国内首个团队智能体产品“豆包工作伙伴”。飞书CEO谢欣表示,8.0是为适配Agent进行的系统性重构,全面向Agent开放数据与工具能力。用户搜索名字即可将Agent拉进群聊,多个Agent可在群组中互相协作;Agent能在飞书撰写文档、操作多维表格、安排日程待办、参与会议、查阅云盘和妙记、发起审批流程。飞书CLI向Agent开放的功能点已从3月上线的247个增至767个。经营数据方面,2026年上半年飞书年度经常性收入(ARR)增速达去年同期的2.5倍,创成立以来新高。

中国金融信息网 查看原文 →
4

阶跃星辰发布语音大模型StepAudio 3系列:五款模型覆盖识别、合成与音乐创作

9月15日,阶跃星辰发布新一代语音大模型StepAudio 3系列,包含Realtime、ASR、TTS、Gen、Music五款模型,均已在开放平台上线。其中StepAudio 3 Realtime在Artificial Analysis对话动态榜以98.9%居首,语音推理准确率99.7%位列全球第一,支持原生全双工与异步工具调用;ASR非流式词错误率仅1.7%,并列第一。生成能力上,StepAudio 3 Gen可一次性生成人声、音效、环境音与配乐,Music支持ABC记谱法多轮交互创作。此次系列化方案覆盖真人级语音生成、实时语音交互、复杂场景语音理解与音乐创作等场景,补全自身多模态版图。

证券时报 查看原文 →
5

紫东太初开源 ZDTaichu5.0-9B:9项空间理解基准斩获8项组别第一

9月15日,中科紫东太初正式开源新一代面向物理世界的通用多模态大模型ZDTaichu5.0-9B,参数量约9B,支持单图、多图、长序列视频与任意分辨率视觉输入,聚焦解决真实物理场景下的空间感知、跨视角变换、具身任务规划等难题。在九大国际权威空间理解基准横向评测中,该模型9项基准斩获8项组别第一。具体指标上,代表复杂三维推演能力的MindCube-tiny取得78.27分,较Qwen3.5-9B高出20.67个百分点;跨视角评测ViewSpatial达62.5分,领先Qwen3.5-9B的48.20分。该模型原生内置自适应循环推理机制,此次开源还开放了整套数据生产流程。

财联社 查看原文 →
6

MediaTek发布天玑9600 Pro芯片:台积电2nm制程,双NPU支撑30B模型本地运行

9月15日,MediaTek发布天玑9600 Pro芯片,采用台积电2nm制程工艺,沿用2+3+3全大核设计,支持LPDDR6内存与UFS 5.0存储。AI是该代芯片的重点:天玑9600 Pro采用双NPU设计,“超性能NPU”支持端侧大模型,大语言模型预填充性能提升51%,每瓦生成词元数提升55%,可支撑30B MoE模型在本地运行;“超能效NPU”配合传感器中枢,常驻感知功耗降低40%,让智能体、环境识别、后台AI任务运行更省电。据MediaTek介绍,搭载天玑9600 Pro芯片的首批机型将于近期上市。该芯片发布意味着端侧推理能力继续上探,30B量级MoE模型本地化运行成为新一代旗舰SoC的能力标尺。

7

国产大模型竞争逻辑从“拼价格”转向“拼生态”:同任务成本差距接近60倍

近期国产大模型迎来新一轮密集调价。9月10日12时起,DeepSeek下调Flash系列模型API价格,其中闲时输入(缓存命中)价格由0.05元/百万词元降至0.02元/百万词元,降幅达60%。同时,智谱GLM Coding Plan新版订阅套餐三档月费上涨约141%、261%和130%。低价替代方案随即跟进:智谱开源GLM-5.3-Flash定价仅为旗舰版十分之一,阿里开源Qwen3.8-Flash称价格最低可至DeepSeek V4 Flash的三分之一。当前API价格呈梯队分化,经济型模型输入价格普遍降至1元/百万词元左右。有测算显示,同样一项典型任务,选用不同模型的成本差距接近60倍。

证券日报 查看原文 →
8

科大讯飞发布AStudio桌面AI平台:星火X2.5驱动,AI从“给建议”走向“直接完成任务”

9月15日,科大讯飞发布新一代桌面AI生产力平台AStudio。该平台基于全国产算力训练的星火X2.5大模型,搭载ACode Harness智能体内核,集成工具插件与Skill,可直接完成文档撰写、网页信息整合、代码生成与调试、行业研报分析等复杂任务,并对输出结果自动进行逻辑校验与质量评估。交互上提供Plan模式与Goal模式:用户只需提出目标,平台即自主拆解任务、规划执行路径、动态调用工具并协调多步骤流程。AStudio还允许用户把验证过的工作流程、检查标准与操作经验沉淀为“个人技能”,供后续同类任务自动复用,并按“帮我批准、请求批准、完全访问”三档设置权限。付费方案为标准版月费36.8元、高级版96.8元。

中关村在线 查看原文 →
9

国产高端芯片进入卖方市场:国内AI算力需求同比增长417%,供给增速仅128%

中银国际证券9月15日研报指出,本周算力产业链催化密集,国产GPU“四小龙”齐聚资本市场,国产高端芯片进入卖方市场。据中国信通院数据,2026年第一季度国内AI算力需求同比大涨417%,而供给增速仅128%,供需缺口显著。需求端,DeepSeek V4.1 Flash以不到旗舰模型的成本承接Pro级能力,通过降低Agent类任务使用门槛撬动更大规模推理调用。供给端,全球云厂商资本开支高位运行,国内AI芯片价格与产能双双紧绷,叠加燧原科技上市、DeepSeek筹备科创板IPO等事件,国产算力正迎来“产业景气+资本催化”的双重窗口。

新浪财经 查看原文 →
10

蚂蚁开源大模型内生式安全护栏SingProbe:额外开销不足0.5%,适配29个主流大模型

9月15日消息,蚂蚁集团AI安全实验室开源大模型内生式安全护栏技术SingProbe。与主流外挂式审核模型不同,SingProbe复用基座模型推理过程中的隐藏状态,以不足0.5%的额外计算开销实现token级实时风险评估,可同步完成用户意图分类、回答安全检测与幻觉识别,并在内容输出前实施毫秒级拦截。评测显示,其回答安全分类平均F1超过Qwen3Guard-Gen-8B-strict基线,流式安全检测R-AUC达0.9888。目前该方案已适配Ling-3.0、GLM-5.2/5.3、Qwen、DeepSeek V4等29个主流开源大模型,并接入SGLang与vLLM推理框架,代码、模型与评测基准同步开源。

太平洋科技 查看原文 →
🌍

全球·AI动态

10 条
11

微软发布AI模型行为准则草案:禁止协助武器制造,禁止模型形成自身目标

当地时间9月14日,微软发布一份针对未来AI模型的临时行为准则,拟对模型能力和行为设置更明确的限制,并在正式更新前听取外部意见。微软AI负责人Mustafa Suleyman表示,相关准则已筹备约5个月,旨在确保AI始终服务于人类、不制造依赖、尊重人的判断力和自主性。根据准则,微软AI模型不得协助武器制造、危险物质采购,也不得生成暴力或色情内容;模型不得形成自身目标、掩盖不当行为,也不得篡改思维链或行动记录。微软计划根据反馈更新准则,并将其用于2027年开始的模型开发。Suleyman强调,这些准则体现了微软对AI“红线”的主动界定,而非等待外部监管强制。该准则的发布使AI安全叙事从公开倡议走向具体的模型开发制度约束。

Tech Startups 查看原文 →
12

谷歌发布 Gemini 3.8 Live 与 Live Extended Thinking:边说边想,语音对话质量登顶

当地时间9月15日,谷歌发布Gemini 3.8 Live和Gemini 3.8 Live Extended Thinking两款实时音频模型。前者支持97种语言、实时视觉理解和异步工具调用,用户无需等待任务完成即可继续对话;后者加入复杂推理能力,可在保持实时交流的同时于后台执行多步骤任务。谷歌称,Gemini 3.8 Live Extended Thinking在Artificial Analysis的语音对话质量指数中排名第一,得分82.6,τ-Voice智能体任务完成率68.6%。两款模型已通过Gemini API和AI Studio开放,音频输入每分钟0.005美元、输出0.018美元。

Unite.AI 查看原文 →
13

Meta第三代自研AI芯片MTIA 450明年上半年部署:12个月承诺超1吉瓦用电当量

据彭博社9月15日报道,Meta计划明年上半年在数据中心部署第三代自研AI芯片MTIA 450(代号Arke),第四代产品MTIA 500(代号Astrid)预计约一个月后完成设计,并于2027年底进入数据中心。负责定制芯片项目的Meta工程副总裁Yee Jiun Song表示,相比英伟达目前出货的产品,自研芯片在运行AI模型时效率更高、能耗更低,目标是降低成本和减少对英伟达的依赖。芯片由Meta与博通合作设计、台积电负责制造。9月1日台积电向Meta交付12枚新型号芯片,实测性能与此前模拟结果差距仅2%至3%。Meta未来12个月对自研芯片的部署承诺已超过1吉瓦用电当量。

Let's Data Science 查看原文 →
14

美光完成全球首款512GB DDR5 RDIMM验证:双路服务器内存上限突破12TB

当地时间9月15日,美光宣布完成全球首款512GB DDR5 RDIMM内存模组的演示验证,并已在多个服务器平台上完成测试。该模组采用TSV硅通孔垂直堆叠技术最大化单封装内存容量,最高传输速率达9200 MT/s。单条512GB意味着在双路24内存插槽配置下,单台服务器可实现12TB的内存容量,可为大规模AI推理、内存数据库以及高密度虚拟化等工作负载提供更高内存容量。能效是该模组的另一看点:与采用4条128GB模组的方案相比,单条512GB模组运行功耗降低逾60%,有望在提升内存容量的同时降低数据中心电力消耗。AMD与英特尔均已启动对该模组的主动验证,美光预计产品将于2027年下半年依据客户需求量产。

富途牛牛 查看原文 →
15

OpenAI确认与Anthropic、谷歌就AI安全协作数周:称无需反垄断豁免

据路透社9月15日报道,OpenAI全球政策主管Chris Lehane表示,OpenAI已与Anthropic和Alphabet旗下Google DeepMind就AI安全协作数周,且不认为三家AI公司就安全议题协调需要反垄断豁免。Lehane在华盛顿向议员表示,OpenAI愿支持任何旨在缓解灾难性AI风险的两党立法。据The Information报道,三家实验室已讨论组建聚焦模型测试与审计的自有标准机构,相关磋商始于今年7月,由谷歌DeepMind首席执行官德米斯·哈萨比斯提议建立美国主导的标准机构。

The Star 查看原文 →
16

英伟达 Groq 3 LPX 投入量产:每兆瓦词元吞吐量较上代提升35倍

据blockchain.news 9月15日报道,英伟达Groq 3 LPX加速器已进入全面量产,并集成至NVIDIA Vera Rubin平台。该方案面向高交互性推理负载,对20000亿参数以上大模型,在长上下文场景下每兆瓦词元吞吐量较GB200 NVL72最高提升35倍。技术核心是确定性执行模型:不同于依赖缓存与分支预测的传统加速器,Groq 3 LPX对每一次计算和数据移动进行逐周期调度,确保性能可预测。内部测试显示其电压跌落减少逾60%,折算为两位数百分比的功耗节省;在10万上下文、Qwen 3.8 27B工作负载上,达到每用户每秒2529个输出词元。

Blockchain.News 查看原文 →
17

台积电联席COO:AI只是“三岁超人”,对下一代半导体研发作用有限

据同花顺9月15日消息,台积电联席首席运营官米玉杰在台北一场面向学生的职业论坛上,将AI比作“三岁超人”——能力强大,但不知道自己会造成什么样的破坏,也分不清是非。他表示,如果员工使用AI不当,公司可能面临数据泄露或丢失的风险,并提及OpenAI和Anthropic的模型曾渗透外部组织。谈到内部应用,他称AI目前较有效的场景集中在基础程式撰写与EDA研发,但在最先进制程开发上限制明显:下一代A14、A10制程存在大量未知因素,很多问题过去从未发生过,缺乏既有数据的AI很难直接对最核心的研发工作提供有效协助,而这些技术还受到高性能设备不足等因素的制约。他强调,AI带来的价值依然明确,但企业不能因为功能快速进步就忽略潜藏的风险。

同花顺 查看原文 →
18

苹果iOS 27代码曝光:Siri可交由Claude、GPT-5.6等第三方模型接管

据AIbase 9月15日报道,开发者“pdfu”深挖iOS 27底层代码后发现,苹果已在私有框架中把新版Siri设计为可与第三方模型深度协作的开放形态,Claude与GPT-5.6均可接入。第一套机制为“模型委托”,Claude能以Siri扩展形式出现,解析自然语言请求,涉及苹果系统功能时再把执行权交还Siri,还能完成Siri无法处理的创建CSV文件等任务。第二套为“模型管理服务”中的推理提供方,开放度更高,允许把端侧Siri模型整体替换为外部模型,由后者接管规划器与工具定义,并可请求系统操作、接收个人数据。媒体认为,欧盟《数字市场法》是幕后推力。目前上述能力仅以ChatGPT扩展形式在候选版本中部分出现,尚未向用户开放。

19

OpenAI洽谈新一轮融资:目标估值约1.2万亿美元,IPO推迟至2027年

据金融界9月16日报道,OpenAI正与投资者就新一轮私募融资展开初步磋商,目标估值约1.2万亿美元。若落地,将在今年3月1220亿美元融资确立的8520亿美元投后估值基础上再增加约3500亿美元。知情人士称,相关接触由投资方主动发起,是否推进取决于公司最终确定的上市时间。OpenAI已于5月底至6月间提交保密注册声明,但倾向于将发行推迟至2027年,首席执行官奥尔特曼已告知投资者,估值低于1万亿美元不会推动公司上市。报道指出,在年化收入运行率接近250亿美元、2026年亏损预计达数百亿美元的背景下,支撑1.2万亿美元估值所需的测算几乎不容出错,而其现金消耗速度在上市公司中尚无先例。

金融界 查看原文 →
20

夏普在日本启动AI服务器接单:携手鸿海切入AI基础设施市场

据ACN Newswire 9月15日报道,夏普宣布自9月15日起在日本面向企业、地方政府、研究机构、数据中心运营商等客户接受搭载英伟达技术的AI服务器订单,正式进入AI服务器业务。首款可下单产品为面向企业工作负载的AI服务器(NVIDIA RTX Pro Server),可配置最多8块NVIDIA RTX PRO 6000 Blackwell服务器版GPU;面向大规模训练与推理的AI服务器计划后续开放订购,该机型搭载NVIDIA HGX Rubin NVL8,八块GPU通过NVLink互联,采用直液冷方式散热。

ACN Newswire 查看原文 →
📍

江苏资讯

5 条
21

南京雨花台区企业AIGIS超级软件工厂:一句话20分钟生成定制化系统

据新华日报·交汇点9月15日报道,位于南京市雨花台区的南京优通信息科技股份有限公司,针对企业内部非专业人员举办了一场系统设计大赛,不具备专业知识、从事行政工作的员工设计出了奶茶店管理系统。该企业自研核心产品AIGIS超级软件工厂已于今年6月底举办的南京软件大会上入选南京首批十大智能软件工厂,并通过国家网信办备案,成为全国首家文生信息化系统备案大模型。据企业董事长周文明介绍,只要输入一句话,20分钟左右就能生成定制化系统,全流程自动开发能力将开发周期缩至小时级,人力与研发成本直降七成以上。目前该平台已赋能千个数智化项目落地,涵盖智慧城市、智慧政府、智慧民生、乡村振兴、企业信息化、工业制造、智慧商业等多个领域。

新华日报·交汇点 查看原文 →
22

江阴构建全域人工智能新生态:OPC社区、词元超市、AI夜校串联成体系

据新华日报9月15日报道,江阴正以科创供给、产业场景、全民科普串联覆盖全域的人工智能新生态。在临港智造OPC社区1700平方米空间内,共享办公区、路演厅、洽谈区错落分布,无锡常青智控为首批入驻企业之一,其自研“环小宝”环保智能平台不久前斩获中国信息协会数据要素应用创新大赛二等奖,该平台融合私有化大模型、行业知识图谱与多源数据,搭建起材料审查、合规筛查、隐患预警、辅助研判的完整业务闭环。同批入驻的新能相源科技助力江阴市中医院“结直肠腺瘤临床高质量数据集”拿到江阴首张医疗领域数据知识产权登记证书,累计积累36000余条经脱敏处理的高质量数据。此外,江阴首个词元超市已开门迎客,人工智能夜校辐射城乡。

新浪财经 查看原文 →
23

南京AI“种”进田野:农业垂直大模型与智能体上岗,一人管理400多亩大棚

9月15日《南京日报》报道,南京一批农业垂直大模型与智能体已在田间“上岗”。溧水普朗克有机农场与南京喜壤农业科技联合研发“喜壤AI”,田间采集车以高清摄像头抓拍菜苗叶片形态与颜色,输出施肥及病虫害防治建议;400多亩大棚智能化改造后,原需5至10人管理的工作量现由1人完成,投用一年来十余种主栽蔬菜实现全生育期智能管护,亩均产量较此前提升5%至10%。江北新区兰花塘高标准农田的多光谱无人机10分钟完成500亩巡检,指令由十余公里外的南京国家农创中心企业农芯智慧农业研究院下达。江苏深农智能依托家禽生理与环控数据模型实现智能养殖,一人可养4万只鸡。南京市“十五五”规划纲要提出实施“人工智能+”农业行动,建设智慧农场。

南京日报 查看原文 →
24

日联科技深耕X射线智能检测:产品远销70多个国家和地区

据新华日报·交汇点9月15日报道,总部位于无锡的日联科技已于2023年登陆科创板,成长为国内工业X射线智能检测领域领军企业,产品覆盖集成电路及电子制造、新能源电池、商业航天、新材料等高端制造质量检测场景,并延伸至食品检测等民生领域。该企业董事长刘骏表示,面向“十五五”将实现微焦点、纳米级、大功率X射线源全谱系自主可控,并布局超声、光学、涡流、能谱等多模态检测技术,将AI检测能力深度嵌入装备,推动检测从单一设备向“设备+算法+AI检测服务”综合解决方案升级。目前其产品远销全球70多个国家和地区,服务超4000家客户。

新华日报·交汇点 查看原文 →
25

无锡建起“考古AI驾驶舱”:5秒匹配数据,文物保护由事后补救转向事前研判

据无锡市人民政府网站9月15日消息,无锡已建成“文物考古一张图”系统,被形象称为“考古AI驾驶舱”。通过人机智能交互,5秒即可匹配相关数据给出结果;系统平台将历史考古项目、地下遗存分布和文物保护范围与拟建设地块叠加分析,为文物保护由事后补救转向事前研判提供工具支撑。日前,“无锡‘文物考古一张图’AI赋能城市更新与文化遗产保护创新实践”项目获得2026年“数据要素×”大赛江苏分赛文物保护利用赛道三等奖。相关负责人表示,下一步考古所将持续完善考古数据长期保存体系,迭代AI场景应用,健全跨部门数据共享机制,进一步把数字技术转化为考古研究、文物保护和城市治理能力。

无锡市人民政府 查看原文 →
💡

AI智库资讯

5 条
26

深度观察:AI“降速”之争的另一面——算力、资本与产业闭环的真实进度

9月中旬,全球AI产业出现罕见的“减速”共识与资本市场的剧烈反应。但从产业基本面看,两条线索同时推进:一是算力投入仍处高位,亚马逊、微软、谷歌和Meta四家公司2026年计划资本开支合计超过7000亿美元,阿里巴巴二季度资本开支676.8亿元、同比增长75%,腾讯同期527.8亿元、同比增长176%;二是落地端开始“收钱”,智能体在风电、电网、金融、短剧等场景形成可观收入。上海财经大学校长刘元春提出判断标准:“要回答AI是不是泡沫,先要回答AI究竟能带来多大的生产率提升。”

21世纪经济报道 查看原文 →
27

深度观察:具身智能的商业化“验收时刻”——从能不能造转向能不能算得过来账

具身智能正同时接受资本市场与商业化的双重检验。据不完全统计,截至今年8月,国内至少28家具身智能机器人企业正在推进或筹划上市。行业争议集中在“数采中心”模式:数据采集中心向机器人公司采购本体,再采数据卖给模型公司,这一环节本身合理,但被质疑可能异化为虚增营收的渠道——某头部企业近45%收入即来自数采中心。宇树披露的数据显示,其2025年前九个月人形机器人营收中73.6%来自科研教育客户,商业消费场景仅占17.39%。受访人士认为,衡量机器人企业应转向真实复购、履约成本与经营性现金流,以及机器人在实际场景中的ROI能否算得过来。

钛媒体 查看原文 →
28

高盛警告AI交易动量出现五年最大分化:资金正从芯片转向软件

据华尔街见闻9月15日报道,高盛策略师在最新客户报告中警示,AI交易正面临本轮牛市以来最严峻的结构性考验:当日3个月动量指数上涨5%,而12个月动量指数下跌6.7%,单日表现差距创五年之最;追踪AI相关股票的高盛指数较高点累计下跌近45%,为ChatGPT问世以来最大回撤。报告指出,短期动量资金正从半导体流向软件,软件对半导体相对表现指数当日录得历史第二大单日涨幅。仓位方面,动量因子一年维度敞口处于第41百分位,五年维度仍高达第88百分位,意味着系统性去杠杆尚未充分释放。高盛建议,对持有AI敞口的组合,可通过买入中期赢家篮子或AI受益股篮子的看跌期权进行对冲。

华尔街见闻 查看原文 →
29

深度观察:企业AI采购标尺换轨——从模型能力比拼转向可量化业务结果

企业AI的采购逻辑正在发生反转。过去选型优先对比参数量与评测分数,项目考核目标多为“完成AI试点”;如今越来越多组织转向按效果结算,把AI价值锚定在工单办结率、质检差错率、获客转化、人力节省等硬指标上。这一转变的背景是大量项目停留在“可演示、难验收”阶段:投入百万级预算完成私有化部署后,模型评测分数亮眼,但进入真实业务即暴露幻觉频发、流程断点等问题,难以计入业务指标。据Gartner相关调研,近两年企业AI项目失败的首要诱因往往并非技术本身,而是难以建立AI产出与业务KPI之间可信的对应关系。行业因此分化:通用大模型负责想象力,岗位化Agent负责兑现生产力。

界面新闻 查看原文 →
30

深度观察:AI巨头“先掠夺知识再垄断赛道”——数学界与版权争议同时升温

9月15日《每日经济新闻》刊发评论指出,美国AI巨头以“威胁论”主张放缓竞争,实质是固化自身领先优势。文章梳理两条线索:一是9月11日陶哲轩等25位菲尔兹奖得主联合发表声明,直指AI巨头把求解数学问题当作基准测试推进的做法,正在伤害数学研究生态;此前OpenAI宣称依托智能体在纳维—斯托克斯方程求解上取得重大进展,被纽约大学数学家公开质疑是在听闻他人突破后紧急加码。二是版权层面,Anthropic早期为训练Claude大规模抓取盗版数据库、盗用近50万部受版权保护书籍,2026年7月法院批准15亿美元和解方案;OpenAI同样深陷多起版权侵权诉讼。文章认为,先无偿攫取公共知识、再垄断赛道的路径,会让基础研究失去试错空间与探索余地。

每日经济新闻 查看原文 →

📚AI 热词速查 · 一看就懂

27 词条

基础概念 5

大模型(LLM) Large Language Model

大规模语言模型,用海量文本训练,能理解和生成文字,是各类AI应用的“大脑”。参数量从百亿到万亿级,是ChatGPT、文心一言、通义千问等产品的核心。

智能体(Agent) AI Agent

能感知环境、自主决策并执行动作的AI系统,是大模型从“对话”走向“做事”的关键。前沿部署工程师(FDE)正是为弥补模型到落地之间的断层而生。

多模态 Multimodal

能同时处理文本、图像、音频、视频等多种模态信息的AI能力。GPT-4o、Gemini、Claude 3.5均已支持多模态输入输出,是大模型下一阶段重点方向。

Token(词元) Token

大模型处理文本的最小单位。中文约1-2字、英文约0.75个词,OpenAI定价按百万Token计费;2026年我国AI日均词元调用量已突破500万亿,Token经济成为新衡量体系。

生成式AI Generative AI

能生成新内容(文字/图像/代码/视频/3D等)的AI,区别于判别式AI。2022年ChatGPT引爆生成式AI浪潮,当前主流大模型均为生成式架构。

模型技术 10

训练 / 推理 Training / Inference

训练是用数据“教”模型参数(成本高、能耗大);推理是模型学成后回答问题(用户每次调用都产生)。训练与推理比约1:10到1:100,推理市场未来增量更大。

预训练 Pre-training

用海量通用数据(万亿Token)先“打底”,让模型学会语言、常识、推理等通用能力;再针对具体任务微调。是当前所有旗舰大模型的必经阶段。

强化学习(RL) Reinforcement Learning

通过奖励/惩罚让模型在交互中学会最优行为。RLHF(人类反馈强化学习)是ChatGPT对齐人类偏好的关键技术;2026年RLHF+RLVR成为模型后训练标配。

微调 Fine-tuning

用特定领域数据继续训练预训练模型,使其适配专业任务。LoRA、QLoRA等参数高效微调技术,让中小企业也能低成本定制专属模型。

蒸馏 Distillation

把大模型(教师)的能力“压缩”到小模型(学生),让小模型在保持90%以上精度的同时更轻量、更快、更便宜。DeepSeek-R1蒸馏版就是典型代表。

RAG 检索增强 Retrieval-Augmented Generation

检索外部知识库内容辅助生成回答,把企业私域文档“喂”给大模型,缓解幻觉问题,是当前企业AI落地最常用架构。

MCP 协议 Model Context Protocol

Anthropic 2024年开源的开放协议,让大模型标准化连接外部工具/数据源。类比AI领域的“USB-C接口”,已被OpenAI、Google、智谱、阿里等主流厂商采纳。

开源权重 Open Weights

模型权重可下载部署(部分受商业许可限制),区别于闭源API。Llama、Qwen、DeepSeek、Mistral是当前主流开源权重模型,推动了全球AI普惠。

Harness(智能体驾驭框架) Agent Harness

在大模型领域,指一套用于驾驭AI智能体的外部工程系统——涵盖上下文管理、工具调用、记忆存储、权限控制、循环决策与结果校验等工程能力,是模型智能转化为稳定生产力的"骨架"。业界核心共识公式为 Agent = Model + Harness:模型负责"聪明",Harness 决定智能体能稳定完成多长、多复杂的任务;Claude Code、Manus 等明星智能体的竞争焦点正从模型本身转向 Harness 工程。

世界模型 World Model

能理解并预测物理世界运行规律的AI模型,是具身智能和自动驾驶的基础。Yann LeCun强力倡导,被视为通往AGI的关键路径之一。

算力基建 6

算力(FLOPS) Compute

每秒浮点运算次数,衡量AI芯片性能的核心指标。FP16精度下,H100约2000 TFLOPS;2026年我国智算总规模达245万PFLOPS(FP16),日均词元调用突破500万亿。

GPU Graphics Processing Unit

图形处理器,AI训练的主力芯片。NVIDIA H100/H200/Blackwell、AMD MI300、寒武纪、壁仞、燧原等是当前主流选择;国产替代是2026年最热赛道。

智算中心 AI Data Center

专门为AI训练/推理建设的数据中心,配备大量GPU和高带宽网络。2026年我国八大算力枢纽与三个算电协同区占比超85%,江苏已落成全国首个省级AI4S公共算力中心(700P)。

超节点 Super Pod / Scale-up

把数万张GPU高速互联成一个“巨型计算机”的技术。NVIDIA NVL72、华为CloudMatrix 384、中科曙光scaleX40等是当前代表,把单机柜算力密度推到新高度。

云巨头 Hyperscaler

AWS/Azure/GCP/阿里云/华为云等提供AI算力服务的超大规模云厂商。当前全球新增AI算力约80%流向云巨头,AWS、Anthropic、Lambda今年签署350亿美元云协议。

推理云(Neocloud) Neocloud

专注AI推理的新一代云服务商。CoreWeave、Lambda、Crusoe等Neocloud以GPU池化、推理优化为卖点,2026年迎来上市潮,重塑云计算格局。

产业应用 6

具身智能 Embodied AI

AI赋予物理身体(人形机器人/自动驾驶/无人机),让智能体与真实世界交互。2026年是具身智能量产元年:优必选+1445%、宇树上市、可灵180亿美元估值。

AI4S AI for Science

AI for Science,用AI加速科学研究(生物/材料/天文/化学/药物研发等)。中国“AI4S公共算力中心”在南京揭牌,聚焦生物医药、新材料、智能制造垂域模型攻关。

AGI 通用人工智能 AGI

具备人类水平通用智能的AI,能在各种任务上达到或超越人类专家。当前主流大模型尚属“弱AGI”阶段,OpenAI、Anthropic、谷歌均把AGI作为长期目标。

词元 / Token经济 Token Economy

以Token调用量为核心衡量指标的AI商业模式和产业生态。2026年Token首次被写进工信部采购清单(首购首用、风险补偿),广东推出3000万元“Token贷”。

FDE(前沿部署工程师) Frontier Deployment Engineer

把大模型能力真正落地到企业业务场景的复合型工程师,负责模型选型、智能体编排、效果评测与持续优化。2026年9月工信部启动专项行动鼓励企业搭建FDE团队,上海“十五五”产业规划亦明确培养FDE队伍——“模型×业务”最后一公里人才成为AI价值兑现的关键。

OPC(一人公司) One Person Company

以个人为核心、依托AI工具与共享服务完成产品开发与商业闭环的新型创业范式。创业者用智能体承担设计、开发、运营等环节,以极低团队规模开展内容创作、跨境电商、软件开发等业务。江苏多地正建设OPC社区,并通过算力券、模型券、云网券等政策降低创业成本,宿迁提出打造“OPC创业之城”。

← 返回当日 9月14日 9月11日 9月10日 9月9日 9月8日