每日AI信息汇要

2026年9月2日

国内·AI要闻

10 条
1

科大讯飞词元星火X2.5系列开源:业界首个原生百万Token上下文端侧模型

9月1日,科大讯飞全资子公司词元星火推出并开源星火X2.5-4B、X2.5-1.7B两款端侧通用大模型,为业界首个原生支持最长100万Token上下文窗口的端侧模型,标志端侧智能从“能对话”向“能干活”跨越。两款模型采用混合注意力架构、基于约20万亿Token高质量数据预训练,全流程在全国产算力平台完成;星火X2.5-4B在代码任务上可对标参数规模大2至3倍的云端模型,智能家居控制指令端到端执行正确率达90.3%、平均响应仅0.85秒。权重已在Hugging Face、GitHub开放,API上线讯飞星辰MaaS平台限时免费;9月7日还将发布新一代旗舰星火X2.5。

中国新闻网 查看原文 →
2

腾讯混元Hy4 preview轻量版开源:1.5TB权重压缩至214GB,异构设备可联合推理

9月1日,腾讯混元团队发布Hy4 preview轻量版,将模型权重从接近1.5TB压缩至约214GB,依托Sherry稀疏三值量化算法(路由专家层压缩至平均1.25比特)与MIX-STQ1_0混合精度策略,长文理解几乎与原始BF16模型持平,MCP Atlas得分仅从83.7微降至83.2。与prima.cpp合作验证异构设备联合推理:单张4090笔记本与四卡A4000服务器(合计80GB显存、64GB内存)协同,使轻量版达到1.02 token/s,比笔记本单机offload快约6倍。模型已上线Hugging Face和GitHub,支持llama.cpp、vLLM、SGLang等主流推理框架。

IT之家 查看原文 →
3

全球首个太空算力云在轨服务常态化:大模型推理能效比达10 Token/J

据中华网转引环球时报报道,由北京邮电大学牵头建设的全球首个对外提供在轨试验服务的太空算力云正式常态化提供在轨算力服务,我国太空算力从“单星试验、单次验证”迈向“平台化运行、服务化供给、生态化发展”新阶段。该云基于2021年发起的全球首个太空算力星座“天算星座”,已累计在轨部署16颗低轨卫星、建成7个地面站,支撑60余家单位在轨试验、服务多项国家重大工程,吸引全球50多个国家和地区科研人员参与。基于国产原生软硬件生态,大模型推理能效比达10 Token/J,累计完成数百次太空算力调用、服务用户超百家。

中华网 查看原文 →
4

四川首个Token工厂落地雅安:“天绛·白泽”点亮上线,首创Token度量衡标准

四川省首个Token工厂——“天绛·白泽Token工厂”在雅安经开区正式点亮上线,由天府绛溪实验室与雅安经开区共建,面向行业客户生产智谱、Kimi、DeepSeek等国内主流大模型满血版Token,坚持“不降档、无路由”供给原则,9月将达约3万亿Token/月产能、年内目标10万亿,力争2027年一季度跻身国内头部产能梯队。工厂依托雅安水电优势(度电成本低至0.34元、PUE稳定1.25以内),并首创Token度量衡标准,实现Token生产、流转、消耗全程留痕可核验,下一步将联合推出国内首个Token计量标准白皮书。

川观新闻 查看原文 →
5

国产GPU迈入商业化盈利新阶段:沐曦首度半年报盈利,“四小龙”业绩全面改善

8月30日沐曦股份披露2026年半年报,上半年营收13.24亿元(同比+44.67%)、归母净利润6.12亿元扭亏为盈,成为“国产GPU四小龙”中首家实现半年度盈利的企业,二季度单季净利7.11亿元;寒武纪上半年营收59.96亿元(+108.13%)、归母净利润23.11亿元(+122.61%);摩尔线程营收17.36亿元(+147.42%)、亏损收窄95.73%;壁仞科技营收12.36亿元(+1997.6%)。弗若斯特沙利文数据显示,中国AI芯片市场规模已从2021年303亿元增至2025年3039亿元,预计2030年接近1.6万亿元,行业从“烧钱研发”转向“盈利增长”。

中国金融新闻网 查看原文 →
6

阿里云宣布Qwen3-VL-Rerank降价:多模态输入降至0.5元/百万Token

9月1日,阿里云宣布大模型服务平台百炼自8月31日起下调Qwen3-VL-Rerank模型计费单价:文本输入从0.7元/百万Token降至0.5元/百万Token,多模态输入从1.8元/百万Token降至0.5元/百万Token。此前8月27日阿里云已下调Qwen3.8-Flash价格。近期全球大模型降价潮持续:OpenAI一款模型价格下调20%以上、输出价降至每百万Token 20美元,谷歌Gemini 3.7 Flash以前代半价首发,Anthropic取消涨价计划。分析认为开源模型正对闭源模型形成挑战,迫使各大厂商降价应对。

证券时报 查看原文 →
7

Token赛道竞速,三大电信运营商“负重爬坡”:从卖管道转向卖算力卖服务

南方周末深度报道:2026年以来中国移动、电信、联通先后推出Token套餐(中国电信从9.9元/月1000万Token到299.9元/月1.5亿Token不等),面向政企提供定制化AI解决方案,并大举调整资本开支押注算力。上半年算力业务成最快增长板块——移动算力服务收入529亿元(+14%)、电信智能收入311亿元(+7.1%)、联通算力业务419亿元(+13%);资本开支向算力大幅倾斜(移动算力网投资+71%、电信+97%、联通+80%)。但传统通信业务营收利润双降、净利润分别下滑6.2%、15.4%、34.6%,Token经营被寄望于运营商完成从“卖管道”到“卖算力、卖模型、卖服务”的转身。

南方周末 查看原文 →
8

内蒙古首笔“算力Token贷”落地呼和浩特:词元使用规模纳入授信评估

8月31日,中国银行内蒙古分行为内蒙古和林格尔新区发放内蒙古自治区首笔“算力Token贷”。该产品打破传统信贷依赖抵押担保的固有模式,将企业词元使用规模、算力合作订单、核心技术资质、科创研发能力等新兴指标纳入核心授信评估体系,为词元经济相关企业量身定制普惠科创金融产品,开创金融支持词元经济发展的新路径。算力产业已是呼和浩特重点产业,目前全市算力规模达15万P、其中智算14.6万P,绿色算力指数位居全国第一。

呼和浩特市政府 查看原文 →
9

梅卡曼德登陆港交所:港股“具身智能眼脑手第一股”,市值超127亿港元

9月1日,梅卡曼德(雄安)机器人科技股份有限公司(09615.HK)在港交所主板挂牌,发行价101.7港元、全球发售2314.06万股、募资净额约22亿港元,总市值超127亿港元,成为港股率先以具身智能“眼脑手”为核心标签的上市公司。发行引入Baillie Gifford、泰康人寿、Jane Street、比亚迪旗下Golden Link、易方达等9家基石投资者合计认购1.86亿美元。公司为全球AI+3D视觉引导通用智能机器人组件市场第一(份额22.1%),产品销往近50个国家和地区、服务超100家世界500强企业,2025年收入3.89亿元。

财联社 查看原文 →
10

Manus恢复独立运营:原创始团队重掌公司,与Meta分拆过渡基本完成

9月1日,通用AI智能体公司Manus官网发布公告,宣布正式恢复独立运营,由肖弘、张涛、季逸超组成的原创始团队继续领导公司,与科技巨头Meta的分拆过渡工作基本结束。Manus作为独立AI代理实验室将继续拓展通用AI代理能力边界,让用户看到其更深入地嵌入日常工作流程、更直接地与外部环境互动,更多新产品和功能即将发布。回溯时间线:2025年12月29日Meta完成收购,2026年4月中国监管部门依法禁止该收购并要求撤销交易,8月11日Manus宣布即将恢复独立运营并启动数据迁移。

香港商报 查看原文 →
🌍

全球·AI动态

10 条
11

OpenAI即将发布Astra新模型:因性能过强将限制网络安全能力

据彭博社报道,OpenAI计划很快推出一款名为Astra的强大新AI模型,但将限制能够使用其最先进网络安全功能的用户范围。OpenAI称该模型已达到“关键网络安全门槛”——能够在无需人类干预的情况下识别并开发零日漏洞利用程序,公司8月曾因发现Astra网络安全能力过强而暂停部分内部开发以加入更严格防护。OpenAI将通过Daybreak Blue计划向获批测试人员开放防御性网络安全用途,并利用7月Hugging Face入侵事件的经验为Astra增加更强安全护栏,训练其拒绝回答“有害的网络请求”。

经济观察报 查看原文 →
12

Anthropic发布Claude Fable 5.1与Mythos 5.1:称“全球最先进编程与知识工作模型”

9月1日,Anthropic推出Claude Fable 5.1与Claude Mythos 5.1,量子位报道其在8项公开基准测试中全部排名第一,尤以科学研究和代码两项明显领先Fable 5与OpenAI GPT-5.6 Sol。两款模型基于同一基础模型、安全防护等级不同:Fable 5.1面向所有用户开放,Mythos 5.1仅限经审核的网络安全与生命科学机构。价格方面,缓存读取费下调75%至0.25美元/百万Token,典型工作负载成本降约25%、高度智能体化负载最高降45%;Claude Code网络安全误报减少约60%,并上线反蒸馏机制(思维链签名校验)。

量子位 查看原文 →
13

World Labs发布全模态世界模型Atlas:原生支持文本、图像、视频与3D

9月1日,World Labs发布Atlas——基于多模态自回归扩散Transformer架构从零预训练的全模态世界模型(omni world model),原生支持文本、图像、视频与3D数据。核心能力包括:像素级精确的相机控制生成(最长1分钟1440p视频)、稀疏视图3D重建(超越专用SOTA模型)、空间-时间模拟(视频重取景、机器人Real-to-Sim)、图像及360°全景生成。模型支持上百张输入图像构建空间上下文,可输出点云与3D高斯泼溅,面向创意生成、VFX、机器人导航与操作仿真,将赋能Marble等产品,目前处于合作伙伴早期访问阶段。

World Labs 查看原文 →
14

谷歌正式推出Google Pics:AI图像创作工具内嵌Workspace,正面迎战Canva

据Digital Trends报道,谷歌9月1日正式向公众开放AI图像创作与编辑工具Google Pics(今年5月I/O大会公布)。该工具基于Gemini与“Nano Banana”图像生成模型,用户以文字提示即可生成海报、传单、演示与社媒素材。核心能力包括:物体级定向编辑(选中图中特定物体单独修改、其余部分不受影响)、图片内文字编辑与29种语言互译且保留原字体设计、一次生成多个版本、超采样至2K/4K分辨率、按网页/社媒/印刷等场景自动裁剪。Pics既可作为独立应用使用,也直接内嵌Google Docs与Slides(点选图片即可调出编辑界面),Drive支持将在数周内上线,支持多人实时协作。即日起向Google AI Pro/Ultra、AI Pro for Education及Workspace商务/企业版用户开放,被视为谷歌对Canva与Adobe Express的正面回应。

Digital Trends 查看原文 →
15

Anthropic与Lambda签署350亿美元云计算协议:英伟达充当“撮合方”

据《华尔街日报》报道,Anthropic已与英伟达支持的云服务商Lambda签署一份价值350亿美元的云计算协议。交易结构复杂:数据中心由比特币矿企Hut 8在得克萨斯州开发,英伟达数周前已与Hut 8签约锁定该算力产能,Lambda随后利用该场地部署从英伟达采购的芯片向Anthropic提供云算力。这是Anthropic今年第二笔百亿美元级算力大单(此前与Nscale签450亿美元),两笔合计800亿美元。英伟达通过持有数据中心租约提供信用背书,正将影响力从硬件销售延伸至整个AI基础设施生态。

Proactive Investors 查看原文 →
16

欧盟将ChatGPT认定为“超大型在线搜索引擎”:DSA框架下首个AI平台认定

欧盟委员会根据《数字服务法》(DSA)将ChatGPT指定为“超大型在线搜索引擎”,同时将Reddit和Roblox列为“超大型在线平台”。这些服务在欧盟月均用户超4500万,须防范涉及未成年人、心理健康和非法内容的风险,不得向未成年人投放定向广告、不得使用宗教信仰、政治立场等敏感数据,并须解释推荐算法;合规期限为2026年12月底,违规将面临巨额罚款。这是DSA框架下首个针对AI对话产品的重要监管认定,标志着欧盟对AI平台监管进入实质执行阶段。

Brussels Times 查看原文 →
17

Runway发布Solaris:首个“接口世界模型”,实时逐帧生成可交互界面

Runway推出Solaris——新AI系统家族“接口世界模型”(Interface World Models)的首个模型。Solaris不再依赖代码等中间表示,由世界模型逐帧实时生成应用界面本身,将渲染与交互联合处理:用户以点击、拖拽等自然方式与动态界面互动,界面随操作持续演化,720p画质、交互延迟达实时水平。250人用户研究(近7500次两两对比)显示,遵循指令偏好61%对编码界面的24%、行为自然性71%对21%。模型基于Gen-4.5视频生成模型适配,正与合作伙伴推进公开上线(8月31日发布、9月1日获广泛报道)。

18

G20推进“卡罗来纳原则”:马斯克视频参会批欧盟监管,黄仁勋、奥特曼现场出席

G20峰会围绕AI数据中心与监管展开交锋,与会方推动以相对轻监管为导向的“卡罗来纳原则”。特斯拉CEO马斯克以视频方式参会,批评欧盟AI监管规则阻碍创新、为AI数据中心辩护;英伟达CEO黄仁勋、OpenAI CEO奥特曼现场出席。原则倡导在促进AI产业发展的同时平衡安全治理,被视为全球AI治理“轻监管”路线的一次重要信号,也折射出欧美在AI监管节奏上的明显分歧。

New Straits Times 查看原文 →
19

三星发布“CUBE”存储战略:HBM5带宽翻倍,zHBM性能提升8倍

三星电子发布存储芯片“自主突破”(CUBE)战略以打破内存技术极限:下一代HBM5带宽较HBM4翻倍、每瓦性能提升20%;垂直集成HBM(zHBM)容量与带宽达传统HBM的8倍、每瓦性能3倍、热阻降低75-90%;zNAND-O计划2028年送样。该战略覆盖HBM、DRAM、NAND全线,旨在巩固三星在AI内存市场的竞争优势,回应AI算力对高带宽、低功耗存储的爆发式需求。

Seoul Economic Daily 查看原文 →
20

英伟达向联发科投资35亿美元:联手打造定制AI芯片对抗大厂自研

英伟达宣布对联发科进行35亿美元可转债投资,双方深化“AI边缘到云”计算平台合作:联发科将采用NVLink Fusion技术,为超大规模云服务商打造可直接接入英伟达数据中心的定制AI芯片,并采用英伟达新发布的NVHBM高带宽内存技术。报道显示该可转债获约90%认购、Alphabet参与、期限5年零息。此举意在对抗亚马逊、谷歌、微软、OpenAI和Anthropic等公司以自研芯片降低GPU依赖的趋势,确保英伟达在定制芯片兴起之际仍居核心地位,双方还将继续合作DGX Spark等产品。

📍

江苏资讯

5 条
21

省协会智库观点:聚焦关键环节,激活Token经济发展动能

江苏省人工智能行业协会(屠蕴文、朱佳)在《群众》杂志2026年第16期发表文章:截至2026年3月,我国日均Token调用量突破140万亿,两年增长逾千倍;江苏算力总规模达88.29 EFLOPS、智算占比超74%、综合算力指数位居全国第二,制造业数字化研发工具普及率91.2%,国家卓越级智能制造工厂67家居全国第一。文章建议江苏将Token经济作为培育新质生产力的重要方向:在生产端推动行业知识型Token研发转化、建设“推理与训练协同”公共算力中心、深化算电协同;在流通端统筹建设省级市场化调度枢纽、建立Token服务评价体系、打造“智能经济出海港”;在消费端以场景牵引价值、培育Token消费新形态、建立成本管控体系,夯实新质生产力发展数字底座。

江苏省人工智能行业协会 查看原文 →
22

江苏举办端侧AI芯片对接会:80余家科研机构与企业齐聚无锡

8月31日,江苏省端侧AI芯片对接交流暨2026无锡AI芯片新品发布活动在无锡国际会议中心举行,来自中国科学院工业人工智能研究所、芯朋微、拓易科技等全省80余家科研机构与企业齐聚。无锡摩芯半导体发布第二代端侧AI控制芯片(1-2Tops,聚焦工业与机器人场景,计划2026年二季度发布),沐创集成电路灵骁LINX400G智算网卡、至讯创新存储芯片等硬核产品亮相;现场举行江苏省集成电路产业联盟端侧AI芯片产业组揭牌仪式,并开展供需对接、知识产权与标准解读,推动AI技术从云端算力走向实体产业终端应用。

交汇点 查看原文 →
23

南京鼓楼“AI无界·医健未来”对接会:6家医院发布AI场景需求清单

南京市鼓楼区“AI+X”场景供需对接系列活动首场——“AI无界·医健未来”场景创新供需对接会举行(活动8月27日举办、9月1日报道),省人民医院、鼓楼医院、中大医院、南医大附属儿童医院等6家医疗机构发布真实场景需求:省人民医院期待覆盖全生命周期的本土化肾小球滤过率评估软件,鼓楼医院一口气发布术前访视风险识别、智能发药机器人等8个场景,儿童医院带来儿童AKI垂直大模型。近20家企业参与、8家现场路演“揭榜”。鼓楼区AI核心产业营收突破120亿元、大模型及智能体产业规模达514亿元(+29.4%),系列活动接下来一个月每周一场。

扬子晚报 查看原文 →
24

镇江鸿鑫智造“超级空调房”:IT液冷方舱供不应求,全年目标10亿元

“活力中国调研行”江苏主题采访走进句容经开区镇江鸿鑫智能装备制造有限公司:一排排为AI算力中心量身定制的IT液冷、风冷方舱将被送往华为、阿里巴巴、字节跳动等国内科技头部企业。2025年公司应税销售4.66亿元,2026年1-7月开票销售6.7亿元、在手订单是去年两倍、全年目标直指10亿元,行业市场份额超七成,还有马来西亚、日本等海外订单;创新“方舱集成+智能控制系统”加乐高式搭建模式,建设效率节省约50%。二期新增用地157亩预计10月竣工、11月投产,三期261亩蓄势待发,达产后预计新增工业开票超30亿元。

荔枝网 查看原文 →
25

南通首只AI专项基金“第一投”落地:孪心医疗签约落户开发区

新华日报报道,南通开发区设立全市首只人工智能主题专项基金——南通产控思源人工智能先导基金,首期规模2.71亿元,采用双GP市场化运作模式,深度链接上海交大科研资源与校友生态。江苏孪心医疗成为该基金设立以来首个签约落地的人工智能项目:企业总部位于上海,用计算物理+AI实现高保真数字模拟,可将创新医疗器械研发周期从行业常规8-10年缩短至1-2年。基金设立3个月以来已召开5次投决会、过会7个项目,重点布局大模型及AI推理技术、工业具身机器人本体制造、核心零部件,兼顾医疗AI等高壁垒交叉领域。

新华日报 查看原文 →
💡

AI智库资讯

5 条
26

安邦智库:央视披露“城市大脑”项目暴露地方数字化建设失效风险

央视《焦点访谈》近日披露,云南曲靖“城市大脑”项目在投入4670万元后最终终止运营,其中市财政三年支付运营服务费2970万元,地方11家国有平台公司另出资1700万元。“曲靖通”App截至2025年底日活用户仅约60人,70多个应用中多数只是跳转其他平台,与云南省已有政务App明显重复建设;“一网统管”、数据要素运营平台等项目也未达预期。2025年当地停止支付运营费用,2026年3月App正式下架。该案例表明:地方数字化建设若脱离真实需求和自身能力,易形成重建设、轻运营,重展示、轻实效的问题;数字政务项目应避免与省级平台重复建设,并把用户使用率、业务协同和成本效益作为立项、验收和续费的重要依据,防止数字化项目异化为高投入、低使用率的“数字盆景”。

安邦智库
27

安邦智库:马斯克推进垂直整合AI电力,SpaceX自铸燃气轮机叶片

马斯克在X上表示,天然气发电机交付被卡在核心部件叶片和叶栅的铸造环节,为不让AI算力被停电“憋死”,SpaceX准备在自己厂里直接铸造燃气轮机叶片,将设备上线时间提前最多18个月。燃气轮机叶片制造技术门槛极高——高温段工作温度可达1650-1980摄氏度、需承受每分钟数千转高速旋转,需要单晶高温合金、精密铸造及复杂内部冷却结构,全球仅4家代工厂掌握,GE和西门子订单排期爆表。SpaceX长期自行设计制造猛禽发动机、航电及关键结构件,其高温合金与真空熔炼能力与燃气轮机叶片制造存在技术关联。这是马斯克“哪里短缺,就把哪里纳入自己供应链”的垂直整合模式向AI时代电力基础设施的延伸——2026年其还通过Terafab推进芯片设计制造,以降低芯片短缺风险。

安邦智库
28

AI Token价格创历史新低:前沿大模型实验室IPO承压

据Singularity.Kiwi报道,衡量前沿大模型Token市场价格的LLM Token Expenditure Index(彭博代码SDLLMTK)于9月1日跌破1美元至97美分/百万Token,较夏季高点下跌超过一半,创该指数去年末推出以来新低。低成本开源模型(如月之暗面Kimi K3)崛起、OpenAI 7月底下调两款GPT-5.6价格、动态定价普及及Token生产成本下降是主要驱动。Syz Group投资长Monchau指出“Token通缩压缩收入端、算力承诺成本固定”,OpenAI、Anthropic等前沿实验室的IPO估值与盈利前景承压;对下游应用方则是利好——同等预算可调用更多模型能力,行业竞争焦点正从“拼模型参数”转向“拼成本与落地效率”。

Singularity.Kiwi 查看原文 →
29

钛媒体:“Token效”取代“用了多少AI”,企业AI考核换尺子

钛媒体刊文指出,越来越多企业用“Token用量”考核AI应用效果,却陷入“古德哈特定律”陷阱——当考核指标变成Token消耗量,员工便开始刷量空转,Token消耗反而成为无效AI的“遮羞布”,投入越多、浪费越隐蔽。文章建议企业以“Token效”(业务产出÷人机总投入)取代投入量考核,将Token消耗、业务产出、ROI三个指标联动评估,从“用了多少AI”转向“AI创造了多少价值”;并指出考核指标一旦被盯住就会失真,企业AI转型应从“计量工具”升级为“价值度量”,避免考核导向与真实目标背离。

钛媒体 查看原文 →
30

每经深度:“ChatGPT时刻”尚未到来,具身大脑已提前打响“百模大战”

每日经济新闻深度报道:机器人产业“脑体倒挂”,软件落后于硬件成行业痛处。世界机器人大会上,银河通用创始人王鹤提到,世界动作模型相关论文一年间从1篇增至171篇;星海图创始人高继扬称,过去18个月全球已出现100多款开源具身基础模型;截至8月31日国内至少30家公司发布、预告或宣布涉足世界模型,具身大脑呈现上一轮“百模大战”特征,但行业尚未迎来人人能感知的“ChatGPT时刻”,模型路线也未统一。宇树科技王兴兴指出,机器人在固定场景经充分训练后成功率可接近100%,但环境或物体稍有变化成功率便严重下降——公司数量最繁盛之时,往往也是淘汰真正开始的时刻。

每日经济新闻 查看原文 →

📚AI 热词速查 · 一看就懂

24 词条

基础概念 5

大模型(LLM) Large Language Model

大规模语言模型,用海量文本训练,能理解和生成文字,是各类AI应用的“大脑”。参数量从百亿到万亿级,是ChatGPT、文心一言、通义千问等产品的核心。

智能体(Agent) AI Agent

能感知环境、自主决策并执行动作的AI系统,是大模型从“对话”走向“做事”的关键。前沿部署工程师(FDE)正是为弥补模型到落地之间的断层而生。

多模态 Multimodal

能同时处理文本、图像、音频、视频等多种模态信息的AI能力。GPT-4o、Gemini、Claude 3.5均已支持多模态输入输出,是大模型下一阶段重点方向。

Token(词元) Token

大模型处理文本的最小单位。中文约1-2字、英文约0.75个词,OpenAI定价按百万Token计费;2026年我国AI日均词元调用量已突破500万亿,Token经济成为新衡量体系。

生成式AI Generative AI

能生成新内容(文字/图像/代码/视频/3D等)的AI,区别于判别式AI。2022年ChatGPT引爆生成式AI浪潮,当前主流大模型均为生成式架构。

模型技术 9

训练 / 推理 Training / Inference

训练是用数据“教”模型参数(成本高、能耗大);推理是模型学成后回答问题(用户每次调用都产生)。训练与推理比约1:10到1:100,推理市场未来增量更大。

预训练 Pre-training

用海量通用数据(万亿Token)先“打底”,让模型学会语言、常识、推理等通用能力;再针对具体任务微调。是当前所有旗舰大模型的必经阶段。

强化学习(RL) Reinforcement Learning

通过奖励/惩罚让模型在交互中学会最优行为。RLHF(人类反馈强化学习)是ChatGPT对齐人类偏好的关键技术;2026年RLHF+RLVR成为模型后训练标配。

微调 Fine-tuning

用特定领域数据继续训练预训练模型,使其适配专业任务。LoRA、QLoRA等参数高效微调技术,让中小企业也能低成本定制专属模型。

蒸馏 Distillation

把大模型(教师)的能力“压缩”到小模型(学生),让小模型在保持90%以上精度的同时更轻量、更快、更便宜。DeepSeek-R1蒸馏版就是典型代表。

RAG 检索增强 Retrieval-Augmented Generation

检索外部知识库内容辅助生成回答,把企业私域文档“喂”给大模型,缓解幻觉问题,是当前企业AI落地最常用架构。

MCP 协议 Model Context Protocol

Anthropic 2024年开源的开放协议,让大模型标准化连接外部工具/数据源。类比AI领域的“USB-C接口”,已被OpenAI、Google、智谱、阿里等主流厂商采纳。

开源权重 Open Weights

模型权重可下载部署(部分受商业许可限制),区别于闭源API。Llama、Qwen、DeepSeek、Mistral是当前主流开源权重模型,推动了全球AI普惠。

世界模型 World Model

能理解并预测物理世界运行规律的AI模型,是具身智能和自动驾驶的基础。Yann LeCun强力倡导,被视为通往AGI的关键路径之一。

算力基建 6

算力(FLOPS) Compute

每秒浮点运算次数,衡量AI芯片性能的核心指标。FP16精度下,H100约2000 TFLOPS;2026年我国智算总规模达245万PFLOPS(FP16),日均词元调用突破500万亿。

GPU Graphics Processing Unit

图形处理器,AI训练的主力芯片。NVIDIA H100/H200/Blackwell、AMD MI300、寒武纪、壁仞、燧原等是当前主流选择;国产替代是2026年最热赛道。

智算中心 AI Data Center

专门为AI训练/推理建设的数据中心,配备大量GPU和高带宽网络。2026年我国八大算力枢纽与三个算电协同区占比超85%,江苏已落成全国首个省级AI4S公共算力中心(700P)。

超节点 Super Pod / Scale-up

把数万张GPU高速互联成一个“巨型计算机”的技术。NVIDIA NVL72、华为CloudMatrix 384、中科曙光scaleX40等是当前代表,把单机柜算力密度推到新高度。

云巨头 Hyperscaler

AWS/Azure/GCP/阿里云/华为云等提供AI算力服务的超大规模云厂商。当前全球新增AI算力约80%流向云巨头,AWS、Anthropic、Lambda今年签署350亿美元云协议。

推理云(Neocloud) Neocloud

专注AI推理的新一代云服务商。CoreWeave、Lambda、Crusoe等Neocloud以GPU池化、推理优化为卖点,2026年迎来上市潮,重塑云计算格局。

产业应用 4

具身智能 Embodied AI

AI赋予物理身体(人形机器人/自动驾驶/无人机),让智能体与真实世界交互。2026年是具身智能量产元年:优必选+1445%、宇树上市、可灵180亿美元估值。

AI4S AI for Science

AI for Science,用AI加速科学研究(生物/材料/天文/化学/药物研发等)。中国“AI4S公共算力中心”在南京揭牌,聚焦生物医药、新材料、智能制造垂域模型攻关。

AGI 通用人工智能 AGI

具备人类水平通用智能的AI,能在各种任务上达到或超越人类专家。当前主流大模型尚属“弱AGI”阶段,OpenAI、Anthropic、谷歌均把AGI作为长期目标。

词元 / Token经济 Token Economy

以Token调用量为核心衡量指标的AI商业模式和产业生态。2026年Token首次被写进工信部采购清单(首购首用、风险补偿),广东推出3000万元“Token贷”。

← 返回当日 9月1日 8月31日 8月28日 8月27日 8月26日