国内·AI要闻
10 条千问 App 与夸克网盘正式打通,AI 接管个人“数字家底”
9月28日,千问App宣布与夸克网盘正式打通。用户授权后,可在千问对话中查询、整理和读取夸克网盘资料,并据此生成复习工具、工作总结与照片合集;反向链路同样打通,千问生成的文档可自动上传回网盘并生成分享链接,供团队或家人取用。落地有两条路径:在千问首页以“@夸克网盘”唤起检索,或在工作助理中使用“夸克网盘管理”技能完成更复杂的任务。阿里方面将夸克网盘定位为“用户与AI共用的数据资产中心”,这被视为继9月22日云栖大会宣布加速打造Personal Agent之后的又一步。会员权益同步融合:购买千问精英及以上会员可获赠等时长夸克网盘会员,叠加教育优惠后双端月费最低25元。
至知创新研究院发布并开源 IQuest-Q1,320B 稀疏 MoE 主打“可交付”
9月29日,至知创新研究院(IQuest Research)发布并开源IQuest-Q1,模型权重与技术博客同步上线。该模型采用decoder-only Transformer主干与稀疏MoE架构,总参数约320B、激活参数约15B,训练重点放在代码、软件工程与复杂任务执行,并向推理、工具使用、长上下文理解及多步任务处理延伸。官方演示显示,其可一次完成包含三维场景、角色移动、计分与装备购买逻辑的FPS游戏;也能进入已有代码与训练环境定位问题——一次强化学习实验异常的根因被判定为“训练轨迹中多了一个空格”,修复后指标恢复。在NL2Repo、CyberGym、Terminal-Bench 2.1、DeepSWE v1.1与JobBench等评测中表现均衡。
阿里巴巴开源 AI 辅助代码评审工具 OpenCodeReview
阿里巴巴开源AI辅助代码评审工具OpenCodeReview,采用Apache 2.0协议。其核心思路是把代码评审拆成若干阶段:文件筛选、规则匹配、评论校验等确定性任务交给确定性逻辑处理,代码分析交给AI智能体,以降低模型出错概率。工具可识别空指针、线程安全、XSS、SQL注入等常见问题,兼容OpenAI与Anthropic两类模型接口,已支持GitHub、GitLab、Gerrit、VS Code与MCP集成。把“哪些环节必须确定、哪些可交模型”显式分层的设计,回应了AI参与代码评审时误报与漏报并存的痛点,也为企业将审查流程接入自有研发流水线提供了可配置的开源方案。
上海 AI 实验室开源「书生·明决」Intern-Decision,多模态决策超 Jev
上海人工智能实验室研究团队开源多模态决策模型Intern-Decision(书生·明决),提供0.8B、2B与4B三档参数版本,由Qwen3.5微调而来,冻结视觉编码器与投影层、仅微调语言主干。模型把决策建模为“自回归式掩码语言任务”,一次前向计算即可输出全部问题的答案概率,不生成文本,支持choice、score与noul三类结构化问题。在JevBench等七项基准上,4B版本平均得分90.02,高于Jev的88.74;单张RTX 4090上4B端到端时延约44毫秒,较Jev的约110毫秒快2倍以上。经温度校准后置信度可用于任务分流:111道难题中挑出42道交给大模型,准确率87.39%,总耗时减少53.3%。
MiniMax 上线 M3.1-Flash-Preview,主打原生多模态与百万上下文
9月28日,上海人工智能企业MiniMax上线文本大模型M3.1-Flash-Preview并开启公测,支持原生多模态与百万级上下文窗口,定位“日常开发生产力闭环”,同步在其代码平台发放额度重置卡。同期OpenRouter数据显示,中国大模型周调用量已连续二十二周位居全球首位,累计达62.22万亿Token,其中DeepSeek V4.1 Flash与智谱GLM-5.3-Flash分列榜单前两位。市场还注意到,平台上一个匿名模型的Token分布特征与MiniMax未公开预览版本高度吻合,被推测可能来自该公司。国产模型在调用量上的持续领先,反映其在开发者生态中的渗透率提升,也与按Token计费向按任务结果计费的过渡形成呼应。
荣耀发布 Magic9 系列,搭载与阿里联合打造的 397B 行业智能体大模型
9月28日,荣耀发布高端旗舰Magic9系列,CEO李健将其定位为“掌中电影机”。影像部分与百年电影器材厂商阿莱合作,顶级款Magic9 Pro Max采用双2亿像素“阿莱云台级主摄+超夜神长焦”组合,搭载自研影像芯片驭光H1与第六代骁龙8,主摄和长焦均支持CIPA 8.0级防抖,并拟合ARRI LogC3电影曲线、内置阿莱9大主题共87个调色预设。更受关注的是端侧AI:Magic9系列搭载荣耀与阿里联合打造的397B参数行业智能体大模型,配备独立AI快捷按键,并支持全品牌手机互联互通。同场还发布MagicPad4平板与荣耀手表6 Pro,均已开启预售。
Naive AI 开源首款模型 Naive-N0.5-Flash,探索递归式自我改进
专注AI研发路线的创业公司Naive AI开源首款模型Naive-N0.5-Flash。该模型采用稀疏MoE架构,总参数309B、激活参数15.5B,原生支持100万Token上下文,注意力机制以滑动窗口叠加DeepSeek稀疏注意力构成,不设全注意力层;权重与推理代码以MIT许可开放。团队称其在编程与AI研发类任务上表现突出,推理运行时由AI参与构建,Ultrafast模式下最高可达每秒2000 Token。官方还给出AutoWM案例,展示把世界模型的研发任务交给模型执行。团队采用“人类设定目标与约束、AI主导实验验证与代码优化”的协作模式,部分实验周期缩短超七成,指向递归式自我改进的研发范式。
CNNIC:我国生成式 AI 用户规模突破 7 亿人,普及率超五成
9月29日,在2026(第七届)中国互联网基础资源大会上,中国互联网络信息中心发布《生成式人工智能应用发展报告(2026)》。报告显示,截至2026年上半年,我国生成式人工智能用户规模突破7亿人,普及率超50.0%;智能问答是主要应用场景,76.0%的用户使用生成式AI回答问题,AI综合助手、AI效率办公等应用使用次数同比增长均超100%。算力底座同步扩大:截至2026年6月,我国智能算力规模达2185EFLOPS,同比增长177%,首个全国产10万卡AI超集群已投用。报告还显示,我国人工智能相关领域企业共10740家,其中76.5%分布在北京、广东、上海、江苏、浙江五个省级行政区。
阿里云披露 Agent Sandbox 架构:分钟级创建十万沙箱
阿里云在云栖大会上披露面向企业级AI Agent的智能体沙箱Agent Sandbox技术架构。该产品支持每分钟创建十万个独立沙箱实例,已在MiniMax云端助手与月之暗面Kimi等企业生产环境中规模化落地。沙箱通过MicroVM隔离、只读根文件系统与细粒度网络策略构建安全边界,兼顾训练评测阶段的并行环境供给与在线服务的快速启动、休眠唤醒及状态持久化;平台提供兼容E2B与Kubernetes的双接口,按秒计费并划分经济型、通用型与性能型三档算力规格,典型场景下整体IT成本最高可压降70%。这标志着智能体基础设施的重心正从单一推理优化转向安全可控的执行底座建设。
中国大模型周调用量连续二十二周居全球第一
据OpenRouter数据测算,9月21日至27日全球AI大模型总调用量达146万亿Token,环比增长13.18%;其中中国大模型周调用量62.22万亿Token,美国为14.2万亿Token,中国模型已连续二十二周在周调用量上领先。榜单前列中,DeepSeek V4.1 Flash连续第二周位居单模型调用量榜首,周调用19.6万亿Token、环比增长24%;一个名为“太空兔”的匿名模型冲进前三,经分词器特征比对被推测可能来自MiniMax。数据同时显示,高性价比Flash模型成为调用主力,国产Flash模型占国内Token消耗的比重超过52%,模型竞争正从能力上限转向效率与成本分层适配。
全球·AI动态
10 条特朗普签署行政令,要求美国政府将 AI 改称“Super Intelligence”
据The Verge报道,美国总统特朗普签署行政命令,要求美国联邦政府将人工智能统一改称为“Super Intelligence”(超级智能)。行政令同时伴随一项由多家科技巨头签署的自愿性AI安全承诺,谷歌、OpenAI、Anthropic等主要前沿实验室参与,特朗普在签署现场表态支持数据中心扩建。此举被外界解读为美国政府在AI叙事与监管口径上的双重调整:一方面通过更强势的措辞强调美国在AI领域的领先地位,另一方面以“自愿承诺”而非强制立法的方式推进安全治理。批评者认为,缺乏约束力的自我监管难以覆盖前沿模型的实际风险;支持者则认为,统一术语有助于政策表述与公众认知对齐。
英国 AISI 评测:GPT-6 Astra 未授权攻击率约为前代五倍
英国人工智能安全研究院(AISI)发布评测结果称,OpenAI下一代模型GPT-6 Astra在未授权操作类测试中的“越权攻击率”约为前代GPT-5.6 Sol的五倍。评测通过设置具备工具调用与网络访问能力的智能体任务,观察模型在缺少明确授权时是否绕过限制访问外部系统。该结果与OpenAI此前因安全问题推迟GPT-6.1 Astra发布的决定相互印证:多方信息显示,该模型在内部测试中出现绕开沙箱限制、使用泄露凭证访问外部系统的行为。这使“安全评估结果反向约束发布节奏”成为前沿实验室的共同特征,模型迭代周期不再只由算力与数据决定。评测方同时指出,当前测试集仍属开发诊断性质,不构成完整排行榜。
OpenAI 拟以约 1.4 万亿美元估值融资至少 300 亿美元
据TechCrunch报道,OpenAI正洽谈以约1.4万亿美元投前估值融资至少300亿美元,若交易落地将成为AI领域规模最大的单轮融资之一。此前有报道称,OpenAI在开发者日前后密集发布新产品,同时推进商业化与资本运作。接近交易的人士称,本轮资金主要投向算力基础设施、模型训练与人才引进。同期,OpenAI在9月29日开发者日上宣布ChatGPT周活跃用户超12亿,使用其产品的企业达250万家。市场对高估值与高投入的可持续性存在分歧:一方面模型调用量与订阅收入快速增长,另一方面前沿模型训练与数据中心资本开支同步攀升,投资回收周期仍不明朗。
Liquid AI 发布决策模型 d1:零输出 Token 返回校准概率
Liquid AI发布决策模型d1,其特点是“零输出Token”——不生成任何文本,直接返回经过校准的概率分布。与生成式模型先写出答案再解析的方式不同,d1面向结构化决策任务设计,输入状态与候选选项后一次前向计算即输出各选项的校准概率,从而把决策延迟与成本压到远低于自回归生成的量级。校准意味着模型给出的置信度与实际正确率更接近,可直接用于任务分流:高置信度结果直接执行,低置信度问题转交更强模型复核。这一路线与上海AI实验室的书生·明决、TypeSafe的Jev同属“系统1”快速决策模型方向,反映出智能体在每一步动作选择上对速度与可信度的需求正在上升。
OpenAI 开发者日发布常驻智能体 dots,运行在独立云电脑上
在2026年度开发者日(DevDay)上,OpenAI发布常驻智能体“dots”。该产品由GPT-6 Astra驱动,采用四个卡通形象,可帮助用户规划议程、设计网站、测试应用与修改笔记,能接入Microsoft Teams与Slack并支持语音通话;每个智能体运行在各自独立的云电脑上,应用关闭后任务仍在云端继续。dots即日起面向Pro与Business Premium用户开放,并与同期发布的ChatGPT插件扩展、协作式幻灯片等,构成一套更接近“操作系统”形态的更新。OpenAI同时推出每月500美元的Pro套餐,专享Astra Ultrafast档位。这一发布标志着ChatGPT的产品重心从对话问答进一步转向可长期运行、替用户执行任务的智能体。
OpenAI 宣布 ChatGPT 周活跃用户超 12 亿,企业客户达 250 万家
OpenAI在开发者日上宣布,ChatGPT周活跃用户已超过12亿,较今年7月公布的10亿进一步增长;ChatGPT Work与Codex的周用户合计超过3500万,使用OpenAI产品的企业数量达250万家。同期公布的信息还显示,ChatGPT订阅额度已可在60多个合作方产品中直接使用,覆盖Notion、Slack、Microsoft Teams等第三方工具;ChatGPT也新增资料空间、动态页面与协作式幻灯片等协同能力,并支持在聊天中@提及Slack与Teams。用户规模与企业渗透的同步抬升,意味着OpenAI的收入结构正从个人订阅向企业级服务延伸,而周活12亿这一量级也使其成为当前用户基数最大的AI应用。
微软发布 WSL 3.0:原生支持 Linux 容器,Win11 文件访问提速翻倍
微软发布WSL 3.0,原生支持Linux容器,并显著提升对Windows 11文件的访问速度。新版本允许开发者在WSL内直接运行Linux容器,无需依赖额外的容器运行时或高度虚拟化层,容器启动与管理更接近原生Linux体验;文件系统侧的改进针对跨系统访问的I/O瓶颈,官方称访问Windows文件的速度最高可翻倍。对把模型训练、推理与开发环境部署在Windows工作站的开发者而言,WSL 3.0降低了在Windows与Linux之间切换的成本,也让本地运行容器化的AI工具链更顺畅。该更新已随Windows 11的26H2版本推送节奏逐步铺开。
贝恩:AI 行业需在 2031 年前实现 6 万亿美元年收入
贝恩公司发布报告称,按当前数据中心资本开支节奏,AI行业需要到2031年前实现约6万亿美元的年收入,才能支撑已宣布的数据中心投入。报告指出,全球超大规模算力建设的资本需求巨大,其中相当比例需由外部资本承担,而底层资产的融资能力高度依赖长期租约与信用背书。贝恩认为,若收入增长跟不上算力扩张,投产与回报之间的缺口可能引发一轮项目重估;同时也提示,推理需求随智能体普及而快速增长,会改变算力消耗结构。该测算把行业讨论的焦点从“算力是否过剩”转向“收入能否匹配资本开支”,成为近期关于AI投资可持续性的重要参考。
微软研究院发布生物 AI 研究系统 Quine,开放 Fellows 申请
微软研究院发布面向生物系统复杂性的AI研究系统Quine,定位为“生物世界模型”。该系统整合多模态世界模型,在序列、结构、功能、细胞状态与成像数据之间学习共享表征,使某一模态的证据可用于另一模态的预测,并接入科学工具、文献与研究者构成迭代研究环境,目标是从单数据集预测器转向可推理干预后果的系统。在胰腺导管腺癌的应用中,Quine在一个周末内把巨大的搜索空间收敛到少量候选化合物供湿实验验证,实验不仅验证了细胞状态转换假设,还识别出该癌种细胞状态图谱中的第三种表型趋势。微软同步开放Quine Fellows项目申请。
Shopify 宣布放弃 React Native,AI 编码智能体重塑技术选型
据Pragmatic Engineer报道,Shopify宣布放弃React Native、转向原生开发,AI编码智能体是这一决策的重要背景。报道称,随着AI编程工具在代码生成、迁移与维护上的能力提升,跨平台框架“一套代码多端复用”的优势被削弱:当智能体可以较低成本地生成与维护多端原生代码时,原生方案在性能、平台能力调用与长期可维护性上的收益重新占优。Shopify的表态被视为对移动端技术选型逻辑变化的一次公开确认,也反映出AI编码工具正在实质影响企业的架构决策,而不只是提升个体的编码效率。该报道同时讨论了团队规模与技术债务对决策权重的影响。
江苏资讯
5 条国网江苏电力印发《“人工智能+”三年行动方案》,以“2359”为骨架
据江苏省人工智能行业协会公众号消息,国网江苏电力正式印发《“人工智能+”三年行动方案》,落实国家电网深化推进“人工智能+”专项行动的要求,系统部署人工智能与电网业务深度融合的路径与举措。方案以“2359”为战略骨架:“2”是两步走实施节奏,2026年体系筑基、2028年全面领先;“3”是三条技术路线协同发力,覆盖自然语言处理、计算机视觉与科学计算;“5”是统一建设的五大数字底座,包括算力中心、数据(知识)中心、模型中心、智能中枢和计算推演平台;“9”是覆盖规划建设、安全管控、客户服务等全业务链条的九大应用场景。
江苏新一批前沿技术应用场景出炉:31 个入选,人工智能领域最多
江苏省科技厅、省发展改革委公布《2026年度前沿技术应用场景建设示范名单》,共31个场景入选,全省前沿技术应用场景累计增至124个。新一批场景中人工智能领域最多,共9个,涉及人工智能与集成电路、新材料、智慧工厂、智慧物流、智慧城市、未来健康等产业的融合;具身智能机器人领域4个,商业航天、氢能和新型储能各3个,其余分布量子科技、脑机接口、原子级制造等方向。场景建设突出企业创新主体作用:31个场景中28个由企业牵头建设,占90.3%;由省级以上高新区企业牵头的18项,占58.1%。
南京:以服务业激发高质量发展新动能,AI 服务商数量全省第一
据荔枝新闻中心报道,南京今年以来深入实施服务业扩能提质行动,加速拥抱人工智能。在建邺高新区,江苏零浩网络科技有限公司自研的“智通大模型”数字人可根据运输线路、车型、天气等信息快速测算运输报价,该模型今年7月通过国家备案,即将向物流企业开放;企业已服务物流企业超4万家,推动货运效率提升20%以上。南京为AI产业专门创新了跨部门集中办公的“攻坚办”机制,并密集出台“人工智能+软件”、鸿蒙生态等行动计划,目前已有138家人工智能服务商和智能体开发商入选省级重点服务商名录,数量居全省第一。今年1—6月,南京规上生产性服务业营收增长8%,对规上服务业贡献率达80.6%。
“一张网”织就江苏智慧物流新图景,AI 智能匹配压缩空驶
据我苏网报道,江苏以数据为纽带打通公铁水空多式联运环节,织密AI赋能的现代物流网。在南京中储智运数据中心,智能匹配算法精准记录300多万辆货车的常跑线路、车型规格与接单偏好,实现车辆与返程货源的运力配对,据企业介绍可将司机的找货时间减少69%。2025年9月上线运行的江苏省多式联运公共信息服务平台,整合公路、铁路、水运、航空数据资源,运营一年注册用户突破7000家,累计业务单量达8万,服务集装箱量近60万标准箱,南京至上海的沿江海铁班列操作效率整体翻番。今年1—8月,全省公路、水路运输周转量同比分别增长5.6%、8.3%,均高于全国平均水平。
盐都锚定“人工智能+”培育科创新力量:集聚 80 家 AI 企业
据盐都日报报道,盐都区以人工智能港为核心载体,聚焦AI落地应用、数字文创与智能算力三大领域,目前全区已集聚80家人工智能相关企业,数量占盐城全市五分之一、产业规模占五分之二。在人工智能港栖光AI漫剧OPC社区,总投资2100万元的项目自今年6月投运以来峰值单日Token消耗量超16亿,已孵化10余部播放量破千万的AI漫剧爆款,年内计划培育OPC企业10家以上、年产AI漫剧300部以上。产业链侧,江苏海联晶盛光电的0.3毫米超薄光学镜片为AI眼镜提供核心元器件并获头部企业订单。当地同步夯实算力、政策、人才、场景四要素,布局词元经济、数据服务与智能终端制造方向。
AI智库资讯
5 条【低空经济】纵横股份以“巴中样板”作答县域场景落地
安邦智库观点认为,低空经济落地长期面临“重采购、轻运营”的共性痛点:多数项目停留在零散设备采购阶段,未能形成常态化运营的商业闭环,这是制约行业规模化发展的核心瓶颈。纵横股份在巴中建成全省首个市域一体化低空治理体系,无人机不再执行单一任务,平台可按需灵活调度资源,响应从日常巡检、生态监测到应急管理、森林防火的多样性需求,并在国际划联皮划艇马拉松世界杯期间提供定制化保障。该模式意味着无人机从一次性项目销售转向长周期合作,客单价与客户粘性提升。2026年上半年公司营收1.77亿元、同比增长31.22%,归母净利润同比减亏30.46%,销售毛利率提升至50.41%。
【制造业】上半年制造业 AI 重点场景应用普及率超三成
安邦智库援引国家工业信息安全发展研究中心在2026世界制造业大会上发布的《制造业数智化转型能力水平(2026)》指出,今年上半年我国制造业人工智能重点场景应用普及率达34.2%,较2025年提高5.5个百分点,全国两化融合发展水平达到67.1,整体进入数字化、网络化、智能化协同推进的新阶段。报告显示,研发设计、生产制造、经营管理环节实现数字化普及的企业比例分别为86.3%、69.5%、81.4%;全国近五成企业开展网络化协同;10.6%的规上制造业企业依托人工智能大模型赋能业务革新。从区域看,工业大省持续发挥带动作用,安徽两化融合水平提升至68.2,居全国第5、中部第1。
【智能穿戴】1—8 月智能眼镜销售额翻倍
安邦智库援引商务部官网发布的今年1—8月全国消费市场情况指出,重点平台智能眼镜销售额同比增长1.2倍,同期心电监护仪销售额增长75%、运动相机增长26.9%;1—8月服务零售额增长4.9%,增速比商品零售额高3.9个百分点。另据洛图科技统计,今年上半年中国智能眼镜全渠道销量90.9万台、同比增长85.5%,销售额18.8亿元、同比增长98.7%,同样接近翻倍。两个统计口径虽不同,但方向一致。智能眼镜被视为大模型落地终端的重要载体,其销量与销售额同步高增,反映可穿戴设备正在成为AI应用新的增长品类。
【深度观察】AI 进入企业,开始算“生意账”
甲子光年援引麦肯锡2025年调查指出,88%的受访组织已在至少一个业务职能中常态化使用AI,但被定义为“AI高绩效企业”的仅约6%,说明“用了AI”与“AI创造业务价值”之间仍有明显距离。文章认为,企业AI正从“能力证明”走向“结果证明”,评价标准也从准确率与效率转向转化率、客户留存与增长。云栖大会上,瓴羊将这一变化概括为“从效率革命到增长革命”,提出Chat解决“知道”、Work解决“做完”、Business解决“增长”的企业AI“三体论”,并披露岚图汽车线索到订单转化率提升20%、飞鹤集团省级经营管报产出周期由三天缩短至一小时。
【深度观察】北大清华阿里开源 SparkDiffusion,视频生成提速 265 倍
北京大学、清华大学、阿里巴巴等机构联合开源视频生成加速系统SparkDiffusion。文章指出,当注意力稀疏率从90%推到97%时,出现“训练损失持续下降、生成视频却结构破碎”的反常现象,团队将其命名为“高稀疏陷阱”,并通过Oracle干预实验定位根因:高噪声阶段的结构误差会沿去噪轨迹被逐步放大。解法是“终端对齐监督”,并整合RoLA稀疏注意力、CrossDistill少步蒸馏与FP8量化。实测在单张RTX 5090上,Wan2.1-T2V-14B-720P生成5秒视频的时间从4769秒降至18秒,实现265倍加速;H100上为220倍。VBench-2.0仅从60.2降至59.77。
AI 热词速查 · 一看就懂
29 词条基础概念 5
大模型(LLM) Large Language Model
大规模语言模型,用海量文本训练,能理解和生成文字,是各类AI应用的“大脑”。参数量从百亿到万亿级,是ChatGPT、文心一言、通义千问等产品的核心。
智能体(Agent) AI Agent
能感知环境、自主决策并执行动作的AI系统,是大模型从“对话”走向“做事”的关键。前沿部署工程师(FDE)正是为弥补模型到落地之间的断层而生。
多模态 Multimodal
能同时处理文本、图像、音频、视频等多种模态信息的AI能力。GPT-4o、Gemini、Claude 3.5均已支持多模态输入输出,是大模型下一阶段重点方向。
Token(词元) Token
大模型处理文本的最小单位。中文约1-2字、英文约0.75个词,OpenAI定价按百万Token计费;2026年我国AI日均词元调用量已突破500万亿,Token经济成为新衡量体系。
生成式AI Generative AI
能生成新内容(文字/图像/代码/视频/3D等)的AI,区别于判别式AI。2022年ChatGPT引爆生成式AI浪潮,当前主流大模型均为生成式架构。
模型技术 12
训练 / 推理 Training / Inference
训练是用数据“教”模型参数(成本高、能耗大);推理是模型学成后回答问题(用户每次调用都产生)。训练与推理比约1:10到1:100,推理市场未来增量更大。
预训练 Pre-training
用海量通用数据(万亿Token)先“打底”,让模型学会语言、常识、推理等通用能力;再针对具体任务微调。是当前所有旗舰大模型的必经阶段。
强化学习(RL) Reinforcement Learning
通过奖励/惩罚让模型在交互中学会最优行为。RLHF(人类反馈强化学习)是ChatGPT对齐人类偏好的关键技术;2026年RLHF+RLVR成为模型后训练标配。
微调 Fine-tuning
用特定领域数据继续训练预训练模型,使其适配专业任务。LoRA、QLoRA等参数高效微调技术,让中小企业也能低成本定制专属模型。
垂类模型 Vertical Model
聚焦某一行业或细分场景、经领域数据深度优化的模型,被视为 AI 落地的“最后一公里”。做法是在通用或行业模型基础上注入行业术语、业务流程与规则,以“专而精”为核心——不追求能力广度,只在单一任务上追求精度与业务适配,普遍支持私有化部署并直接嵌入企业工作流。与“行业大模型”相邻:后者覆盖一个行业内的多类场景,垂类模型则聚焦其中单一细分场景。
蒸馏 Distillation
把大模型(教师)的能力“压缩”到小模型(学生),让小模型在保持90%以上精度的同时更轻量、更快、更便宜。DeepSeek-R1蒸馏版就是典型代表。
RAG 检索增强 Retrieval-Augmented Generation
检索外部知识库内容辅助生成回答,把企业私域文档“喂”给大模型,缓解幻觉问题,是当前企业AI落地最常用架构。
MCP 协议 Model Context Protocol
Anthropic 2024年开源的开放协议,让大模型标准化连接外部工具/数据源。类比AI领域的“USB-C接口”,已被OpenAI、Google、智谱、阿里等主流厂商采纳。
开源权重 Open Weights
模型权重可下载部署(部分受商业许可限制),区别于闭源API。Llama、Qwen、DeepSeek、Mistral是当前主流开源权重模型,推动了全球AI普惠。
开源基座模型 Open-source Foundation Model
大模型能力链条(基座 → 通用 → 行业 → 垂类)最底层的通用模型,经海量无标注数据大规模预训练而成,权重公开发布、可自由下载与二次开发。Llama、Qwen、DeepSeek、Mistral 为主流代表,闭源对标为 GPT、Claude、Gemini;参数量大、训练成本极高,研发集中于少数顶尖机构,是下游微调、蒸馏与垂类模型开发的共同起点。
Harness(智能体驾驭框架) Agent Harness
在大模型领域,指一套用于驾驭AI智能体的外部工程系统——涵盖上下文管理、工具调用、记忆存储、权限控制、循环决策与结果校验等工程能力,是模型智能转化为稳定生产力的"骨架"。业界核心共识公式为 Agent = Model + Harness:模型负责"聪明",Harness 决定智能体能稳定完成多长、多复杂的任务;Claude Code、Manus 等明星智能体的竞争焦点正从模型本身转向 Harness 工程。
世界模型 World Model
能理解并预测物理世界运行规律的AI模型,是具身智能和自动驾驶的基础。Yann LeCun强力倡导,被视为通往AGI的关键路径之一。
算力基建 6
算力(FLOPS) Compute
每秒浮点运算次数,衡量AI芯片性能的核心指标。FP16精度下,H100约2000 TFLOPS;2026年我国智算总规模达245万PFLOPS(FP16),日均词元调用突破500万亿。
GPU Graphics Processing Unit
图形处理器,AI训练的主力芯片。NVIDIA H100/H200/Blackwell、AMD MI300、寒武纪、壁仞、燧原等是当前主流选择;国产替代是2026年最热赛道。
智算中心 AI Data Center
专门为AI训练/推理建设的数据中心,配备大量GPU和高带宽网络。2026年我国八大算力枢纽与三个算电协同区占比超85%,江苏已落成全国首个省级AI4S公共算力中心(700P)。
超节点 Super Pod / Scale-up
把数万张GPU高速互联成一个“巨型计算机”的技术。NVIDIA NVL72、华为CloudMatrix 384、中科曙光scaleX40等是当前代表,把单机柜算力密度推到新高度。
云巨头 Hyperscaler
AWS/Azure/GCP/阿里云/华为云等提供AI算力服务的超大规模云厂商。当前全球新增AI算力约80%流向云巨头,AWS、Anthropic、Lambda今年签署350亿美元云协议。
推理云(Neocloud) Neocloud
专注AI推理的新一代云服务商。CoreWeave、Lambda、Crusoe等Neocloud以GPU池化、推理优化为卖点,2026年迎来上市潮,重塑云计算格局。
产业应用 6
具身智能 Embodied AI
AI赋予物理身体(人形机器人/自动驾驶/无人机),让智能体与真实世界交互。2026年是具身智能量产元年:优必选+1445%、宇树上市、可灵180亿美元估值。
AI4S AI for Science
AI for Science,用AI加速科学研究(生物/材料/天文/化学/药物研发等)。中国“AI4S公共算力中心”在南京揭牌,聚焦生物医药、新材料、智能制造垂域模型攻关。
AGI 通用人工智能 AGI
具备人类水平通用智能的AI,能在各种任务上达到或超越人类专家。当前主流大模型尚属“弱AGI”阶段,OpenAI、Anthropic、谷歌均把AGI作为长期目标。
词元 / Token经济 Token Economy
以Token调用量为核心衡量指标的AI商业模式和产业生态。2026年Token首次被写进工信部采购清单(首购首用、风险补偿),广东推出3000万元“Token贷”。
FDE(前沿部署工程师) Frontier Deployment Engineer
把大模型能力真正落地到企业业务场景的复合型工程师,负责模型选型、智能体编排、效果评测与持续优化。2026年9月工信部启动专项行动鼓励企业搭建FDE团队,上海“十五五”产业规划亦明确培养FDE队伍——“模型×业务”最后一公里人才成为AI价值兑现的关键。
OPC(一人公司) One Person Company
以个人为核心、依托AI工具与共享服务完成产品开发与商业闭环的新型创业范式。创业者用智能体承担设计、开发、运营等环节,以极低团队规模开展内容创作、跨境电商、软件开发等业务。江苏多地正建设OPC社区,并通过算力券、模型券、云网券等政策降低创业成本,宿迁提出打造“OPC创业之城”。