国内·AI要闻
10 条小红书开源dots3-note preview:280B总参数、激活16B,攻长程Agent
8月14日,小红书dots实验室开源dots3-note preview——这是dots3系列首个开放权重模型。总参数280B、每次激活仅16B,支持512K上下文,可处理文字、图片、视频与音频。它主攻长程Agent:能在陌生环境里探索规则、调用工具、写代码,把重要信息存进记忆再依新情况调整行动。训练方法TEMPO专门解决长任务反馈太晚的问题:把十几个小时的任务拆成多阶段,让模型中途自评再继续强化学习。开源后短短几天,SemiAnalysis、vLLM、SGLang等海外AI社区和机构开始讨论,Terminal-Bench 2.1上以75.1分领先其他美国开源权重模型。
智谱发布GLM-5.3:纯后训练把编程能力拉高50%,登顶开源安全模型
8月14日智谱发布新一代基座模型GLM-5.3,基座与5.2完全相同,全部提升来自极致后训练Scaling:数十倍的长程任务环境、更丰富的环境类型与超长后训练时间。编程能力较GLM-5.2提升50%,在Terminal Bench 3.0等公开基准取得开源第一,整体逼近Claude Fable 5;安全能力成为新亮点,CyberGym白盒代码审查得分84.5%,高于GPT-5.6 Sol,成为最强开源安全模型。发布前两周智谱联合清华、南开及众多企业开展密集红队测试,累计发现漏洞2404个(含1088个中高危),完整权重将在两周后开放。
百度文库网盘GenFlow启用中文名《库库AI》:AI办公MAU超2500万
8月14日百度AI开放日上,百度文库网盘通用智能体GenFlow正式启用中文名「库库AI」,并推出PC客户端、网页端、小程序及企业版等独立产品形态。4月GenFlow月活用户已突破1亿,其中办公用户规模指数级增长;目前AI办公MAU(月活跃用户)超2500万,位居通用AI办公赛道行业第一。库库AI主打「跨设备、跨时空」端云任务接力,用户关电脑也能用小程序继续处理任务、远程操控多台电脑与文件夹;针对股票盯盘等长周期任务可全天候自动化运行。首期面向金融场景专项优化,内置上市公司资料、股票行情、财报、研报等数据,可生成Word研报、金融PPT、财务模型Excel等专业办公内容,同时支持多模态内容一站式生成与编辑。
华为昇腾0Day适配小红书dots3-note开源大模型
8月16日,华为宣布昇腾Atlas 800 A3、Atlas 900 A3 SuperPoD超节点已完成小红书dots3-note preview开源大模型的全量适配,并基于vLLM Ascend开源推理引擎提供完整部署与推理能力。该模型总参数280B、激活16B,具备文本、视觉、语音全模态感知理解能力,在推理、Agent及多模态感知上全面优化。华为在模型发布当天即完成0Day推理部署适配与性能优化:通过FlashComm通信优化消除多卡重复计算、FUSED_MC2通算融合降低MoE推理延迟、MTP投机解码攻坚增量解码瓶颈,显著提升生成效率。
国务院部署国家AI应用中试基地,上半年智能算力达去年同期2.8倍
国务院《意见》提出布局建设一批国家人工智能应用中试基地,国家发改委有关负责人表示,此举将沉淀共性能力、大幅降低应用创新门槛,通过在制造、医疗、交通、金融、能源等重点领域布局,汇聚行业资源、推广应用成果、孵化创新主体。发改委新闻发言人介绍上半年AI自主创新成效:首个全国产10万卡人工智能超集群正式投用,截至6月底全国智能算力规模达去年同期2.8倍;建成高质量数据集超12万个,开源大模型全球累计下载量突破100亿次;相关行业保持30%以上高增长,规上制造业企业AI技术应用普及率超30%。
市场监管总局发布338项国家标准,AI医疗器械等高新技术标准加速落地
市场监管总局(国家标准委)近日批准发布338项重要国家标准,其中强制性国家标准15项、推荐性国家标准323项,涉及高新技术、传统产业、安全生产、百姓生活等。高新技术领域亮点突出:发布人工智能医疗器械质量要求和评价术语国家标准,为AI医疗器械产品开发、测试及质量控制提供依据,推动建立人工智能医疗器械国家标准体系;发布立体显示器件、柔性显示器件等新型显示国标,完善显示技术质量评价体系;发布光路板、纤维光学互连器件等光电子领域国标,规范器件性能指标与试验测量方法,为人工智能终端、智能制造等产业发展筑牢标准底座。
千问办公首发上线GLM-5.3与DeepSeek V4 Pro,办公Agent聚合路线开打
36氪获悉,8月15日,阿里巴巴旗下Agent产品「千问办公」首发上线GLM-5.3和DeepSeek V4 Pro两款前沿模型,用户可在产品首页「前沿模型」档位直接选用,加上此前首发上线的Qwen3.8-Max,已支持三款国产旗舰模型。同日百度GenFlow启用中文名「库库AI」并推出独立桌面端,腾讯WorkBuddy、字节TRAE Work也已内置多家第三方大模型。分析认为,国内头部厂商办公Agent正不约而同走向模型聚合模式:先把不同模型放进同一工作台,让真实工作流进入Agent积累任务拆解、工具调用与用户纠错反馈,形成数据飞轮,竞争从「谁家模型更强」转向「谁能积累真实工作数据」。
华为云携产学研共探具身智能:实景实训专项行动加速产业化
华为云携手产学研伙伴共探具身智能产业高质量发展新路径。信通院工物所介绍,今年6月工信部与国务院国资委联合启动实景实训专项行动,聚焦工业、服务、特种等领域,目标年底凝练100个以上高价值场景、带动万台级规模落地。业界指出,模型每迭代一代数据需求增长约1000倍,而物理交互数据原生供给几乎为零,形成百万倍级数据缺口;企业自研肌电采集技术通过采集肌肉表面生物电信号,构建从大脑指令到物理执行的完整映射,计划四季度在生产制造、物流、零售等场景规模化落地。
申万宏源周报:华为Atlas 950超节点构建国产算力新范式
申万宏源计算机行业周报聚焦华为超节点进展:华为全栈自研打造Atlas 950 SuperPoD超节点,硬件端推出Ascend 950PR、950DT芯片分别适配推理与训练场景,搭配自研灵衢UB统一总线搭建三级全Mesh互联体系,单柜算力、互联带宽对标英伟达GB200 NVL72,1024卡集群采用800G光模块实现低时延跨柜互联,计划四季度上市;上一代Atlas 900超节点已商用750余套,获科大讯飞、美团等头部企业深度适配验证。同期周报关注智谱GLM-5.3后训练Scaling与DeepSeek V4 Pro发布对国产算力链的拉动。
IT之家:2026国产AI算力芯片推理选型,SRAM/全栈自研/通用GPU三条路线
IT之家发布2026国内AI算力芯片推理选型分析,梳理三条技术路线的决策权重:SRAM专用路线以高能效比、低延迟切入云端大模型推理加速,适合国产供应链背景下追求低延迟的大型互联网企业与算力基础设施用户;华为昇腾全栈自研路线采用达芬奇架构,910B FP16算力达320 TFLOPS,CANN算子库全面开源,覆盖训练推理全场景;寒武纪、海光、曦望科技走通用GPU路线,寒武纪思元370采用7nm chiplet、INT8算力256 TOPS,海光深算三号CUDA兼容超95%、支持千亿级模型训练推理。
全球·AI动态
10 条OpenAI预览GPT-5.6 Sol「Ultrafast」超高速模式:14倍速、750 token/秒
OpenAI发布GPT-5.6 Sol全新服务层级Ultrafast(超高速模式),由Cerebras晶圆级芯片驱动,输出速度最高达750 token/秒,较标准处理提升14倍,且不降低模型智能水平。该模式率先在OpenAI API面向部分客户有限预览,瞄准事故响应与可靠性分析、金融研究与安全、客服与语音交互、电商实时问答以及实时研究实验等对速度极为敏感的业务场景。OpenAI表示,Ultrafast指向「每秒完成更多有价值工作」的新方向——当速度不再需要牺牲智能,AI就能进入商业中时间最敏感的环节。Cerebras在HLE测试中,GPT-5.6 Sol超快模式仅用11小时11分钟完成全部题目。
谷歌发布Gemini 3.7 Flash:编程与智能体能力大幅跃升,价格砍半
8月13日谷歌发布Gemini 3.7 Flash,距3.6 Flash发布仅三周,定位「迄今最智能的主力工作模型」,重点强化编程与智能体能力:编程基准FrontierCode 1.1 Main从34.4%升至43.6%,软件工程基准DeepSWE从48.6%升至65.3%,多步操作AutomationBench从17.0%升至30.4%。2026年底前API价格仅为3.6 Flash原价一半(输入0.75美元/输出3.75美元每百万token),支持100万token上下文,单次最多输出6.4万token,可处理文字、图片、音频和视频,已接入Google AI Pro和Ultra用户的Gemini Spark及开发者平台。
SpaceX完成600亿美元收购Cursor,马斯克称9月AI收入超其他业务总和
8月14日,SpaceX提交监管文件宣布完成对AI编程工具公司Cursor(Anysphere)的600亿美元全股票收购,Cursor股东获得合计约3.89亿股SpaceX A类普通股,对应隐含股权价值600亿美元。这是史上最大的科技并购之一,Cursor团队将获得SpaceX全球最大规模GPU集群使用权,马斯克预测9月AI收入将超过SpaceX所有其他业务总和。分析认为,这笔交易将模型、算力与开发工具纵向打通——Anthropic有Claude Code、OpenAI有Codex,而SpaceX直接拥有安装量最大的第三方编码环境。
Anthropic拟60亿美元收购以色列AI效率公司Decart
据彭博报道,Anthropic正洽谈以约60亿美元收购以色列AI基础设施初创公司Decart AI,较其5月40亿美元估值溢价50%,若达成将成为其史上最大收购。Decart专注提升芯片运行效率,其Decart Optimization Stack(DOS)跨NVIDIA GPU、Google TPU、亚马逊Trainium等芯片统一优化,AI推理速度达行业平均8倍,使Anthropic毛利率从29%提升至44%。正值Anthropic筹备10月IPO、估值或达2万亿美元之际,分析认为这笔收购将让Anthropic从模型公司转型为AI基础设施平台。
OpenAI企业营收首超消费业务,年化营收达400亿美元
OpenAI首席财务官萨拉·弗莱尔8月14日向投资者披露,企业业务营收已首次超过由ChatGPT主导的消费者业务,提前数月完成此前预测的交叉。OpenAI年化营收已达400亿美元,7月环比增长20%,其中企业客户营收增长更快、环比增32%。弗莱尔表示「token堆量」时代结束,企业客户转向关注「单位智能成本」;新一代模型在Agent编程任务上效率提升54%,并下调了开发者API价格。分析指出,两家头部AI公司合计年化营收正逼近1000亿美元,企业端已成为大模型厂商最稳定的现金牛。
Anthropic二季度营收超115亿美元,首度实现经营利润转正
据彭博获得的融资文件,Anthropic在2026年二季度首次实现调整后经营利润转正,初步营收超115亿美元,同比增长14.6倍,较一季度47.3亿美元翻倍以上;年化营收5月已突破470亿美元,公司并向投资者展示2028年营收有望达1900亿至2000亿美元的预测。6月公司已向美国证券交易委员会秘密递交IPO文件,华尔街预期其估值未来有望超2万亿美元。Anthropic的快速增长主要受益于企业AI业务扩张——Claude Code等编程工具与办公智能体吸引大量企业客户。
xAI发布Grok 4.6:追平GPT-5.6 Sol,价格仅为竞品四分之一
xAI发布Grok 4.6,在Grok 4.5基础上重点强化长时间运行的Agent任务与交互式视觉工作能力,50万token上下文。Artificial Analysis智能指数61分,与GPT-5.6 Sol持平;知识工作基准GDPval-AA(1753分)、AA-Briefcase(1577分)领先竞品,弱项集中在纯终端操作。定价输入2美元/输出6美元每百万token,约为Claude Opus 4.8的四分之一,并强调token效率高出约4倍。模型已同步接入Cursor、Grok Build、Grok Bot及API,发布首周用量翻倍,OpenRouter、Vercel、Cloudflare等合作方同步上线。
Google DeepMind大规模换帅,布林施压全力追赶Gemini
同花顺8/14报道:当地时间8月5日,谷歌宣布对DeepMind进行大规模管理层调整——创始人戴米斯·哈萨比斯卸任CEO转任董事长与Alphabet首席科学家,副手科雷·卡武克丘奥卢升任高级副总裁接手日常运营,直接向皮查伊汇报;Gemini项目两位原技术联合负责人同天宣布离职并联合创办AI初创公司。8月13日DeepMind紧接发布Gemini 3.7 Flash,重点强化编程与Agent能力,距离Gemini 3.6 Flash仅三周。路透社披露,布林近几个月持续敦促AI团队全力投入Gemini研发并推动资源向「递归自我改进」方向倾斜,原因是新一代旗舰Gemini 3.5 Pro编程能力持续落后于OpenAI与Anthropic,发布推迟约两个月。哈萨比斯同期转向领导AI制药公司Isomorphic Labs。
Anthropic为Claude生成内容嵌入隐形水印,合规欧盟AI法案
为遵守欧盟AI法案透明度条款(8月2日生效),Anthropic将为8月2日后发布的Claude模型所生成文本嵌入不可见、仅机器可识别的隐形水印,复制粘贴及轻度编辑后仍保留;图片等文件附C2PA标准数字签名溯源元数据,机制全球适用、覆盖Claude全系产品及API、Claude Code、AWS等云渠道。Anthropic将发布水印检测API,并已将该机制扩展至更早模型。欧盟AI法案要求聊天机器人披露机器身份、深度伪造标注、合成内容携带机器可读水印,违规最高可处1500万欧元或全球营业额3%的罚款。
AI写作横向测评:Gemini强在研究型写作,Grok依托X实时信源
Crypto Headlines发布2026年度AI写作能力横向测评:Gemini凭借Docs、Drive、Gmail与NotebookLM的深度集成,成为「研究型写作」首选,尤其擅长从大量源材料中查找、组织与连接信息;刚于8月12日发布的Grok 4.6依托X实时信息流,在科技、市场、政经等题材上具备独特优势,但新模型长期写作表现仍需观察;Claude在水印机制落地后,其文本溯源能力成为新变量。测评提示,AI写作正从「质量竞争」转向「溯源与可信度竞争」,不同模型的适用场景差异正在拉大。
江苏资讯
6 条“机”聚南京“器”象万千:南京加快打造“机器人之城”
南京日报深度报道全市机器人产业发展:2025年工业机器人产量超5.4万台、同比增长35.4%,埃斯顿连续六个季度居自主品牌出货量第一、市场份额达10.6%;亿嘉和带电作业机器人已落地全国16个省市;集萃智造咖啡机器人畅销40余个国家;南京机器人产业已形成整机、关键零部件、系统集成全链条体系,集聚相关企业近300家,分布在江宁开发区、江北新区等六大板块,汇川技术南京基地形成年产12万台产能。市机器人产业攻坚办表示,将持续推动机器人产业与教育场景、产业需求深度融合,全力打造具有竞争力的机器人产业集群。
南京线控科技完成数千万元A轮融资,开创“空间具身”新品类
36氪独家获悉,南京线控机器人科技有限公司完成数千万元A轮融资,由江宁科创基金领投、老股东云时资本跟投。线控科技2023年成立于南京,是全球唯一实现重载线控机器人产品化落地的企业,以钢丝绳并联约束替代传统刚性机械臂结构,在超千平米空间内实现六自由度精确定位,产品覆盖50kg至5吨负载范围,已在南钢等龙头企业落地,客户通常在1-2年内收回投资。公司创始人杨海博士师从法国机器人权威,团队全栈自研运动学、动力学与张力分配算法,正推动从“单点项目”向“标准化复制”转型,补齐重工业自动化空白。
两岸(昆山)人工智能产业发展大会举行,30亿基金同台发布
8月16日,2026年两岸(昆山)人工智能产业发展大会举行,450余位两岸企业家齐聚一堂。立讯集团、沪光股份、沪士电子等龙头企业携手光合组织、两岸人工智能产业发展基金共同发起设立两岸人工智能产业发展联盟,将立足苏州昆山,围绕技术共研、资源共享、标准共建、市场共拓四大方向,促进两岸AI合作从“供应链互补”迈向“创新链共生”。总规模30亿元的两岸人工智能产业发展基金同台发布,重点投向AI服务器、具身智能、智能网联汽车等领域,助推关键技术攻关与产业市场拓展。
工业软件突围,苏州争当国产工业软件“支点”
首届AI赋能工业软件创新生态大会在金鸡湖畔举行,十余位院士、二十余所高校领导及三大工业软件国产替代链主企业代表与会。苏州数智科技集团与苏州人工智能实验室自主研发的“苏零”智能体曾在全球权威评测GAIA中排名第一,已建成700余套工业软件高质量测评案例;《工业软件中试验证测评体系与高质量案例集》现场发布。中国商飞、中石油等链主企业作为“出题者”开放真实痛点牵引攻关,同元软控、浩辰软件等苏州本土企业把制造业体量转化为工业大模型的“训练场”,探索从应用场景反哺核心技术的独特路径。
无锡数据集团携手渊澈太初,共建具身智能“物理世界神经数据基座”
8月14日,无锡数据集团与前沿感知领军企业北京渊澈太初智能科技有限公司签署战略合作协议,双方以肌电感知为支点,共同构筑具身智能与大模型时代极具稀缺性的“物理世界神经数据基座”,为无锡“千企百万小时”工业具身智能高质量数据采集行动计划再添技术伙伴。双方将联合推进高灵敏度肌电感知硬件的工程化迭代,率先制定物理感知数据在采集、清洗与标注等环节的行业规范;渊澈太初端侧采集设备将接入数据集团具身数据处理中台,相关技术成果优先赋能本地,在智能化转型与高价值数据要素运营中构筑技术护城河。
“创客中国”江苏新一代信息技术专题赛在盐城举行
8月13日,第十一届“创客中国”江苏省中小企业创新创业大赛新一代信息技术专题赛在盐城成功举办,经过省内各地市区域赛层层选拔,44个优质科创项目汇聚现场,围绕人工智能、半导体、车联网等前沿方向同台路演,项目涵盖大模型智能体、集成电路、智能机器人、低空卫星互联网等细分赛道。江苏隆丰电子的轻量化AUTOSAR软件平台、南京皓博机器人的具身智能装卸机器人、镁来得科技的MicroLED光引擎等硬科技项目引发关注。13个项目跻身大赛百强,其中盐城企业隆丰电子、镁来得科技占2席,彰显盐城科创实力。
AI智库资讯
5 条【安邦智库】量子:我国成功破解超导量子计算“速度与保真度”矛盾
安徽省量子计算芯片重点实验室8月7日消息,由本源量子与中国科学技术大学联合研究团队创新性提出的“参数空间扩展受控相位门(PSE-CZ)”方案,成功破解了超导量子计算领域长期存在的速度与保真度相互制约难题,让两比特量子门在保持高速的同时大幅提升精度。相关成果已发表于国际物理顶级期刊《物理评论快报》。研究团队在不延长脉冲时间的前提下,将脉冲中间区域的失谐量拆分为两个独立可调的参数,为系统增加了一枚“调节旋钮”,同步纠正泄漏和相位两类误差。依托“本源悟空”超导量子计算机,团队对20对两比特量子门开展测试,即使在30纳秒至40纳秒的极短门长条件下,PSE-CZ仍保持优于传统CZ门的稳定性能。该方案还可推广至离子阱、固态自旋等多种量子计算平台。(LQY)
【安邦智库】AI芯片:国产AI芯片今年国内市场份额有望接近90%
市场研究机构TrendForce发布的报告显示,2026年中国高端AI芯片市场中,中国国产解决方案的市场份额将接近90%,留给英伟达、AMD等海外方案的市场空间可能只剩一成左右。投行Bernstein同样预测,英伟达在中国AI半导体市场的份额可能从2025年的约40%下降到2026年的8%左右,华为可能超过50%。国产AI算力形成两条路线:一边是华为、寒武纪等国产AI加速芯片扩大供应,另一边是阿里巴巴、百度、腾讯等大型云服务厂商加快自研ASIC(专用芯片)。TrendForce去年12月预计2026年国产AI芯片份额约50%,如今迅速上调,背后是国内AI算力需求快速增长:截至今年3月底全国智能算力规模增至188万PFLOPS,四家大型云厂商今年资本支出合计将增长超80%。(LEQ)
【安邦智库】机器人:中国人形机器人占全球出货量超97%
据彭博8月10日报道,最新行业研究数据显示,2026年上半年,中国人形机器人制造商占全球出货量的97%以上,证实中国在这一新兴领域对美国竞争对手建立了早期领先优势。美国加州研究公司Smart Analytics Global数据显示,2026年上半年全球人形机器人出货量总计约1.91万台,是去年同期5100台的三倍多;今年全球出货量预计增长至约6万台,到2030年将达到50万台。市场份额方面,上海的智元机器人以8400台(占44%)超越杭州的宇树科技(5900台)夺得第一,远超特斯拉、Figure AI和Agility Robotics等美国头部企业。工业与商业应用占出货量比重已超70%,高于一年前约50%的水平。(LEQ)
UBI Research:中国人形机器人2026年产量有望突破10万台
UBI Research报告援引工信部数据:中国人形机器人产量预计从2025年约2万台增至2026年超10万台,一年增长约五倍,产业正从技术演示转向全面量产。依托电动汽车与工业自动化积累的电机、减速器、执行器、传感器、电池供应链,产能扩张迅速;特斯拉Fremont工厂Optimus产线筹备量产、比亚迪与XPENG等车企入局,为中国供应链带来新机遇。报告指出中国人形机器人产业正从整机生产商向全球机器人关键零部件主要供应商演进,并预测人形机器人向服务应用扩张将带动显示产业新增需求,OLED凭借轻量化优势有望受益。
老虎说芯:寒武纪半年报深度——从“国产AI芯片叙事”走向规模商业化
寒武纪2026年上半年营收59.96亿元、同比增长108.13%,归母净利润23.11亿元、同比增长122.61%,半年收入已达2025年全年约92%。分析指出,其真正拐点是进入规模商业化验证阶段:云端产品线贡献约99.9%收入,公司围绕DeepSeek、Qwen、混元等推进训练适配,推理端支持GLM、DeepSeek、Kimi等主流模型,国产替代已从“有没有芯片”进入“软件生态与客户迁移成本”之争。同时需警惕82.48亿元存货与客户、供应商集中度风险,判断寒武纪能否从供应链替代成长为长期产业基础设施,将是下一阶段关键。