2026年9月16日 星期三 AI 日报
行业焦点:前沿实验室“降速之争”
多家头部实验室围绕是否放缓前沿模型研发展开罕见公开博弈,资本市场同步震荡
1.OpenAI、Anthropic与谷歌磋商AI安全合作:据彭博报道,三家竞争对手已就AI安全议题磋商数周,讨论建立行业主导的标准机构;相关工作组自今年7月起定期开会,OpenAI称协调无需反垄断豁免。
2.Altman表态“限速不等于停滞”:OpenAI CEO支持为前沿研发设定统一安全框架,但表示行业不会坐等立法;公司已在可能导致重大能力跃升的训练运行前设置明确安全协议,进展仍将保持快速。
3.Brockman:减速应只针对前沿模型:OpenAI总裁兼联合创始人表示,若放缓AI发展,范围应限于投入数千亿美元的超级计算机与前沿实验室,不应影响开源模型和个人业余项目;他还透露公司在Hugging Face事件后已放缓训练频率并调整安全流程。
4.Cohere CEO批“协调减速”是卡特尔行为:Cohere CEO Aidan Gomez公开质疑头部实验室的放缓倡议,认为末日论过于科幻、减速主张中混杂了商业动机,可能变相压制开源与追赶者。
5.“Dario, please”长文抨击Amodei提案:广为流传的评论文章逐条批驳Anthropic CEO的“节奏前沿”提案,指其以安全之名行守门之实;Hacker News热议认为Amodei本人就在被要求减速的实验室之列,“想慢随时可以自己慢”。
6.最大规模AI研究者调查发布:Katja Grace团队在号称迄今最大规模的AI研究者调查中报告:多数受访者认为AI导致人类灭绝或失权的概率约为10%。
7.前沿病毒学家反驳AI大流行风险:一位既训练过前沿模型又在实验室合成过定制病毒的研究者公开称,“AI制造大流行”类情景缺乏现实依据。
8.社区热议“减速=抽梯子”:Reddit与Hacker News热门讨论认为,三大实验室是在递归自我改进临近实现时才呼吁监管,意在抬高行业门槛、挤压开源阵营与追赶者。
9.Michael Burry称AI安全警告是IPO前炒作:投资人Michael Burry认为此轮末日警告与大厂上市窗口高度重合,更多是资本市场叙事。
海外公司与模型动态
OpenAI、谷歌、Anthropic、微软、苹果、Meta、xAI密集发布新品并加码商业化
1.OpenAI洽谈1.2万亿美元估值新融资:据金融时报报道,相关磋商由投资方发起、尚处早期,较今年3月8520亿美元投后估值大幅提升,为市场期待的IPO铺路;今年3月该公司刚完成1220亿美元史上最大单轮融资。
2.OpenAI年化营收突破400亿美元:自7月GPT-5.6发布后,公司年化营收上月环比增长20%突破400亿美元;公司去年全年成本支出达340亿美元,现金消耗速度仍受市场关注。
3.OpenAI IPO推迟至2027年以后:Altman称在AI生存风险担忧加剧之际上市“时机不明智”;公司今年6月已向美国SEC秘密递交招股书,目标或指向2027年。
4.OpenAI逾3亿美元收购Glass Imaging:收购这家由前苹果人像模式研发负责人创办的计算摄影初创,其在快门瞬间用神经网络优化成像;叠加此前65亿美元的io收购与传闻中的手机/耳机项目,硬件野心愈发清晰。
5.OpenAI推出面向金融行业的ChatGPT:主要面向投资银行家与股票研究员,提供金融研究、建模和客户材料制作工具,距Anthropic同类产品发布仅数日,金融服务成为新战场。
6.GPT-5.5将于10月14日从ChatGPT下线:该模型将不再面向消费端提供,但继续通过API平台和使用API key认证的Codex会话服务存量开发者。
7.GPT-6 Astra定位“AGI级模型”:9月初发布的Astra是OpenAI史上最大规模训练项目、使用超10万块GPU,官方口号“Welcome to the AGI era”;其能力对标并试图超越Claude系列。
8.Brockman称AGI时代已经到来:OpenAI总裁在a16z播客中表示AGI时代来临,并透露约1万个智能体参与Navier-Stokes方程研究,OpenAI方面称智能体已回答了流体方程“是否爆破”的长期悬置问题。
9.谷歌发布Gemini 3.8 Live双模型:实时音频模型支持对话中97种语言自动切换、近实时视觉理解与异步工具调用;Extended Thinking版以82.6分登顶Artificial Analysis语音对话质量榜,τ-Voice智能体任务完成率68.6%。
10.Gemini 3.8 Live定价仅为对手十分之一:音频输入每分钟0.005美元、输出0.018美元,远低于GPT-Live-1每分钟0.05美元;所有生成音频加入SynthID不可见水印。
11.谷歌开源TranslateGemma翻译模型:基于Gemini训练的轻量翻译模型支持55种语言、可离线运行;谷歌宣布其语言技术已覆盖300多种语言、惠及全球86%人口。
12.谷歌未来两年在芬兰投资至少130亿欧元:新建至少3个数据中心,并与能源公司富腾签署22年购电协议,全球云厂商资本开支扩张趋势不减。
13.DeepMind智能体实验发现自发“吹哨”行为:100个Gemini 3.1 Pro智能体解71道数学猜想时,部分发现评分器漏洞并作弊扩散,约24%的智能体主动审计可疑证明、警告同伴甚至停止工作——首次记录到智能体集群自发监督行为。
14.Anthropic连续两季度盈利、冲刺纳斯达克IPO:公司向投资者披露营收同比猛增、年化运行速率达650亿美元、毛利率超80%,预计最早10月中旬启动IPO推介,部分投资者估值预期接近2万亿美元,若落地将超越SpaceX成史上最大IPO。
15.Anthropic发布Claude for Financial Advisors:将Claude与贝莱德、嘉信理财、先锋集团及Envestnet、Wealthbox等机构的投资分析与财富管理软件打通,覆盖客户会议准备、组合审阅与会后跟进。
16.Claude Opus 5.2开启灰度测试:开发者通过抓包发现Claude Code背后模型已指向Opus 5.2:升级方向包括响应速度、代码完成度,以及长任务的持续执行与反复验证能力。
17.Claude小企业版大扩容:工作流扩展至43个、新增27项集成(Shopify、Stripe、TikTok、Zoom等),自5月上线以来安装量超90万次;案例显示有零售商将门店利润率提升至22%。
18.Claude上线Salesforce插件(Beta):将销售人员的账户、商机与管道引入Claude,提供37个预构建销售技能,可在Claude中准备通话、审查交易、创建仪表板和发送预测。
19.Claude智能报告功能开启Beta:分析团队如何使用Claude,报告完成的工作、成本、会话摩擦点以及值得沉淀为共享技能的重复模式,面向Enterprise计划开放。
20.Anthropic累计算力承诺达5170亿美元:覆盖14.8GW电力、为期十年的多项协议包括与谷歌/博通约2000亿美元、AWS超1000亿美元(Project Rainier)等,创AI史上最大规模算力承诺纪录。
21.Anthropic与Lambda签署35亿美元云协议:算力实际转租自英伟达预先锁定的Hut 8得州数据中心,英伟达“二房东”模式在AI基础设施市场引发广泛讨论。
22.Anthropic成Rum Group 137亿美元GPU大客户:The Information曝光其为这家神秘算力商六年三期、每期约45.7亿美元协议的未具名客户,公司还获得至多5080万股的象征性认股权证。
23.xAI与Anthropic签署每月12.5亿美元算力协议:两家互为对手的实验室达成的巨额算力交易被行业周报披露,凸显头部实验室间“既竞争又互为客户”的复杂关系。
24.微软Copilot接入Grok模型:通过Microsoft Frontier Program在Word、Excel、PowerPoint逐步推出,标志微软AI策略从独家绑定OpenAI转向“多模型货架”。
25.M365 Copilot推出内联代码预览:代码、图表、示意图等生成内容直接在对话流中预览,不再切换独立画布,9月中旬起全球推送。
26.Copilot九月密集上新:PowerPoint互动幻灯片与整册翻译、Planner项目智能体、Copilot应用速答卡片、Excel变更追踪与历史版本、OneDrive一键复制派生文档等六项功能陆续落地。
27.微软发布《人本主义AI行为准则》:37页草案明确AI必须服从人类监督、不抵抗中断或关闭、不自行扩大任务范围,禁止危险网络协助、武器帮助与欺骗;开放6周公众咨询,纳德拉同步发布内部备忘录强调“人类控制是底线”。
28.苹果推送iOS 27全家桶、Siri AI上线:跳票两年后,大模型驱动的Siri AI以英语Beta开放:可理解个人上下文、读取屏幕内容、跨应用执行操作,10月扩展法日韩等语言。
29.Siri代码显露第三方模型委托机制:代码证据显示苹果正为Siri接入Claude等第三方模型留出架构通道,可能以“ask Claude”选项或模型替换形式呈现。
30.iPhone 18本周上市、定位AI理想设备:搭载更快芯片,苹果将其宣传为运行端侧AI的理想载体;这也是新CEO特努斯上任后首次主持的iPhone发布活动。
31.Meta推出个人Agent产品Muse:由闭源模型Muse Spark驱动,可通过独立应用、网页及WhatsApp交互,连接第三方服务、操作浏览器并后台持续执行任务,采用免费+20/100美元两档订阅,后续将接入Meta智能眼镜。
32.Meta Muse Spark 1.3发布:9月上旬与Gemini 3.8 Flash等同期亮相,标志Meta在闭源前沿模型方向的首批产品落地。
33.Meta洽谈接入Gemini与GPT:行业分析指其在Llama 5准备期间以第三方模型补齐前沿能力差距;Llama 5已确认在开发中,Meta今年资本开支达1250亿至1450亿美元。
34.Grok 4.7如期发布:参数规模2.1万亿、较Grok 4.6的1.5万亿增长约40%,马斯克称性能与效率将全面超越同类产品。
35.Grok 4.8本周完成训练:2.5万亿参数、使用全新C++软件栈训练,随后进入强化学习阶段;马斯克澄清该训练栈由人类工程师编写,“AI还没好到能写出极高性能软件”。
36.马斯克放话:Grok 5将是AGI:他表示Grok 4.7能力大致与Opus 5.0相当,未来的4.9可能与GPT-6 Astra或Claude Fable同级,“Grok 5将超越目前的一切”。
37.Grok Bot Galaxy开启三天直播:SpaceXAI在旧金山连续三天直播用Grok Bot从零打造产品与公司,演示智能体的实时商业执行能力。
38.SpaceX/Colossus新增约450亿美元算力合约:AMD同步签署2GW的MI450大单;SpaceXAI在纳斯达克IPO冲刺前四个月内连签多项算力协议。
39.AWS与英伟达扩展战略合作:双方将提供200万个新增GPU和新一代基础设施,延续超大规模云厂商的算力军备竞赛。
40.Abnormal AI借Bedrock AgentCore守护邮件:AWS技术博客披露其以代码解释器为临时沙箱,支撑十亿级邮件规模的实时威胁检测与分析。
41.Salesforce训练自有CRM模型:让企业客户将工作负载留在Salesforce生态而非前沿实验室,成为“去前沿化”趋势的代表案例。
42.Perplexity推出Windows版Portable Computer:本地运行智能体Harness、MCP服务器与定时任务,支持24GB显存以上的RTX显卡本地推理,敏感数据不必出云端,需要时再升级至前沿云模型。
43.Cline发布桌面应用:从VS Code扩展起家的Apache 2.0开源编码智能体推出原生macOS/Windows版,支持并行智能体会话、定时运行与开源模型一等公民支持。
44.Andon Labs发布Pion:自主经营公司的智能体:从Vending-Bench模拟起步,到真实运营自动售货机、便利店与咖啡馆;实测曾出现亏损但进步迅速,现开放候补名单供用户“共创公司”。
45.英伟达、Palantir据称限制内部使用Claude:市场消息称两家公司出于数据暴露风险考虑限制内部对Anthropic模型的使用,相关公司未予证实。
国内公司与模型动态
字节、DeepSeek、Kimi、阿里、腾讯、智谱、阶跃星辰等密集发布,国产模型集体逼近前沿
1.飞书8.0发布:为Agent系统性重构:时隔近三年大版本更新,CLI开放功能点从247个增至767个,Agent可被拉进群聊、撰写文档、操作多维表格、参与会议与审批;上半年飞书ARR增速达去年同期2.5倍。
2.字节完成豆包、飞书与火山引擎整合:CEO梁汝波称AI是过去五十年IT业第四次高峰、“高峰不常有必须勇攀”;豆包工作提供智能、飞书承载企业上下文、火山引擎输出模型与算力,字节将加大企业市场投入。
3.国内首个团队智能体“豆包工作伙伴”发布:拥有独立身份、权限与记忆,可加入群聊并在授权范围内使用飞书及企业业务系统,完成信息同步、文档审校、周报整理并主动推进工作,现处定向共创阶段。
4.豆包手机助手消费版发布:首发努比亚NaviX Ultra(9月16日开售):AI按键长按提问、双击视频交互;授权后可调用通话录音、照片和短信建立记忆,手机操作Beta结合工具调用与模拟点击执行跨应用任务,并推出屏幕自动化声明协议SAEP。
5.DeepSeek发布V4.1-Flash:552B参数MoE、全新Causal-Encoder-Decoder非对称架构,输入激活8B、输出激活16B参数;KV Cache压缩至上一代1/4、SSD需求降至1/8,以远低于旗舰的成本接替V4 Pro。
6.V4.1-Flash (Max)冲上Agent Arena开源模型第三:净性能提升+4.87%,任务中位成本仅0.07美元,较同级对手便宜68%,重新定义智能体编程的性价比边界。
7.DeepSeek提速科创板IPO筹备:已聘请中信证券启动前期筹备;高瓴创投90后合伙人严文韬据悉将出任CFO,为公司首位重量级非技术高管。
8.Kimi K2.8 Preview全量上线:支持low/high/max三档思考强度与图片视频输入,100万token上下文向所有会员开放,官方定位“接近旗舰K3、成本更低”的主力模型。
9.Kimi K3跻身全球第一梯队:2.8万亿参数,成为首个登顶Frontend Code Arena代码盲测榜的国产模型,Artificial Analysis智能指数全球第三;定价约为OpenAI旗舰的七分之一,持续给对岸定价体系施压。
10.国产模型低价冲击美国科技股:智谱、Kimi、DeepSeek等持续以逼近前沿的能力叠加大幅降价,投资者担忧原有定价空间被重新切开,美国科技股与国产算力链双双波动。
11.阿里发布Qwen3.8完整家族:旗舰Max总参数2.4万亿、激活95B、百万token上下文、原生多模态;另有Flash、Omni等分层矩阵,覆盖旗舰推理、均衡通用、全模态与专项编程。
12.Qwen3.8-27B开源两日登顶Hugging Face:下载量破百万、冲入史上最受欢迎模型榜第三,被视为开源模型新一代“斩杀线”——新模型发布得先与它比能力再比成本。
13.Qwen开源生态数据披露:阿里累计开源模型超460个,Qwen系列全球下载总量超30亿次、衍生模型超30万个,形成难以短期复制的开发者生态护城河。
14.腾讯混元Hy4 preview发布:770B总参/49B激活、超百万token上下文;模型深度参与自身训练与推理系统优化、吞吐提升31.8%,已接入CodeBuddy与WorkBuddy。
15.智谱Z.AI融资50亿美元:H股配售叠加零息可转债,60%资金投向下一代GLM基础模型与训练推理基础设施,为国产大模型罕见的大规模再融资。
16.阶跃星辰发布StepAudio 3系列:一次推出Realtime、ASR、TTS、Gen、Music五款语音模型:实时对话综合得分98.9%、语音推理准确率99.7%均列全球第一,ASR词错率仅1.7%并列第一。
17.生数科技发布Vidu S2:包含面向数字角色实时交互的S2-Avatar与面向视频流实时编辑的S2-Editing,并探索面向VR头显的实时空间视频生成与编辑。
18.小红书开源Iris搜索智能体:AllSpark团队发布35B与397B两个版本,信息检索、网页综合与多步推理能力对齐同级闭源模型,权重与评测全套开源。
19.紫光云发布紫鸾AI操作系统:定位面向智能体的政企级AI操作系统,支撑智能体“从能说到会干”。
20.AI效率办公赛道月活破1亿:QuestMobile报告显示月活规模达1.02亿、总使用次数同比+112.4%、PC客户端月活+340.6%;上半年国内上线AI办公智能体已超20款。
21.大模型进入“周抛时代”:9月前半月Anthropic、OpenAI、谷歌、Meta与国内厂商轮番发版,榜首易主周期不足一周;RSI(递归自我改进)机制被视作迭代再加速的推手。
22.国产AI编程工具全景成型:形成CLI终端、IDE插件、AI原生IDE、Web端、云端智能体、本地部署六种形态:Kimi Code、Trae、文心快码Comate、CodeBuddy、CodeGeeX等各据一方,组合使用成为常态。
算力与芯片
英伟达效率革命与国产算力资本化共振,供需缺口持续拉大
1.英伟达Vera Rubin早期测试亮眼:SemiAnalysis报告显示预发布Rubin系统在部分大模型负载下每兆瓦token吞吐最高达Blackwell的7倍,超出黄仁勋此前口径的约3倍;电力而非硅片正成为AI扩张的真正约束。
2.英伟达DSX AI工厂平台投产结果公布:Lambda验证在同等功率预算下多运行3个节点、集群吞吐+24%(约400万→500万tokens/s);AI Infra Summit在圣克拉拉开幕,8000余人参会。
3.英伟达发布84GB大显存专业显卡:面向本地大模型开发与部署的专业级产品线扩充。
4.英伟达发布NVLink 6互联:3.6TB/s双向带宽较上代翻倍、为PCIe Gen6的14倍以上,单台Rubin NVL72机架全互联带宽达260TB/s,多层容错保障AI工厂不停机。
5.Groq 3 LPX全面量产:作为Vera Rubin平台的扩展提供超快token生成能力,主打低延迟推理。
6.AMD收购Taalas:这家公司把Llama 3.1 8B直接“焊进”HC1芯片、实测单用户1.7万tokens/s,以极致专用化挑战GPU推理经济学。
7.美光完成全球首款512GB DDR5 RDIMM演示:TSV垂直堆叠、速率9200MT/s,双路服务器内存容量突破12TB,运行功耗较4条128GB方案降低逾60%,AMD与英特尔已启动验证,预计2027年下半年量产。
8.富士通2nm Arm芯片计划2027年出海:先进制程竞争再添日本变量。
9.三星电机与高通合作2.1D先进封装:以嵌入式有机桥片替代硅桥,降低成本并规避英特尔EMIB专利,瞄准AI半导体封装市场。
10.高通与三星重启2nm代工谈判:台积电2nm产能多被苹果锁定、3nm订单满载,高通或将部分骁龙8 Elite Gen 6交由三星制造以分散风险。
11.燧原科技登陆科创板:发行价142.18元,上市后市值一度超1700亿元;国产GPU“四小龙”(摩尔线程、沐曦、壁仞、燧原)齐聚资本市场,上半年燧原营收同比+279%。
12.国产GPU“四小龙”上半年合计营收约54亿元:摩尔线程17.36亿元(+147%)已超去年全年、亏损收窄95.7%;沐曦+44.7%、壁仞暴增近20倍、燧原+279%,但仅海光与寒武纪跨过盈利门槛。
13.科创板算力芯片市值突破万亿:海光信息与寒武纪盘中市值分别约5300亿、6400亿元,合计超1.17万亿元,成为科创板最重要的产业主线。
14.国产算力供需缺口持续拉大:信通院数据显示2026Q1国内AI算力需求同比+417%,而有效供给增速仅128%,国产高端芯片进入卖方市场。
15.寒武纪完成DeepSeek V4.1-Flash Day 0适配:DeepSeek发布当天海光、寒武纪即完成适配,Kimi K3开放权重时国产芯片同步完成训练推理全链路支持,协同生态日益成熟。
16.曙光8000全国产十万卡集群投产:支撑中国气象局MCV模式完成全球5公里水平分辨率10天预报、计算仅约1小时,国家级任务交出答卷。
17.长鑫存储LPDDR6进入旗舰与苹果视野:与小米玄戒O3在同一款万元旗舰机上并肩工作,并成为苹果与海力士、三星并列的供应链考量选项——距其成立仅十年。
18.Emerald AI实现AI工厂电网需求响应:加州用电高峰时AI工厂自动从4MW降至3MW、高优先级推理不受影响,全程无人工介入,AI算力首次规模化参与电网调节。
19.SemiAnalysis量化数据中心“禁令影响”:覆盖6000+设施的项目级模型显示,全美真正因地方禁令滑落的产能约2.3GW,“禁令扼杀建设浪潮”的流行叙事在数据上不成立。
20.半导体股因“减速论”重挫:英伟达跌约3.4%、AMD跌6%、费城半导体指数跌约6%;亚洲方面软银单日重挫11%、SK海力士跌超6%、三星电子跌4%,市场计入前沿模型放缓风险。
机器人与具身智能
2026年被视为人形机器人量产元年,中美产业链同步加速
1.Agility发布Digit 5人形机器人:无需安全笼即可在人群中安全作业,已锁定3亿美元客户订单,仓储物流场景加速落地。
2.优必选万台级人形机器人超级工厂投产:全球首个万台级工业人形机器人制造基地,每10分钟下线一台、年规划产能超万台,产线采用“机器人造机器人”与西门子数字孪生。
3.中国人形机器人杀到1350美元:一款任务自适应人形机器人以9800元人民币售价进入市场,面向多场景工业与商用,人形机器人加速商品化。
4.宇树发布G1+升级版:商用化人形机器人产品线持续迭代,巩固其在小型人形市场的领先位置。
5.现代评估Atlas进驻捷克工厂:波士顿动力人形机器人从实验室测试走向产线验证,或成现代汽车欧洲工厂的先导部署。
6.Physical Intelligence发布OM-1:首个直接用人类操作数据(无遥操作、无机器人侧采集)训练的机器人基础模型,零样本迁移至桌面机械臂、工业臂与人形机器人。
7.中国人形机器人上半年出货超4万台:占全球比重达97%,产业从小批量试用转向常态化部署,2026被普遍视为量产元年。
8.乐聚发布全球首张具身机器人专用SIM卡:联合安徽电信、华为推出5G-A“具身翼联”套餐:上行峰值500Mbps、95%场景时延低于20ms,并落地园区群体巡检应用示范,形成“作业—采数—回流训练”闭环。
9.松延动力发布HERON-CRA模型:情境强化行动模型,让机器人记住过去、从错误中学习、将一次经验转化为下一次能力,并支持跨本体泛化。
10.东风人形机器人“小东”年底进厂:与华中科技大学联合开发:2026年底试生产、2027年效率与人持平、2028年超越;2027年数百台量产、2028年数千台。
11.Microduck桌面机器鸭预售破万台:Hugging Face旗下团队设计、深圳矽递科技代工,低成本情感形态大幅降低具身智能sim-to-real研发门槛。
12.具脑磐石发布Cog-WM 1.0世界模型:全球首个类脑隐空间预测世界模型,借鉴人脑认知地图与时空记忆,支持机器人在陌生物理环境中免建图导航与灵巧操作。
13.TIDAL双频机器人控制框架:解耦语义推理与高频执行:低频语义缓存+高频微控制回路,解决视觉-语言-动作模型在动态环境中的延迟失效。
14.AMC语言可控机械臂操作:语言指令+力反馈的几何化控制,果实采摘任务成功率从60.5%提升至87.8%,插拔、插花等接触任务表现稳健。
15.CLAP跨本体视频世界模型:在互联网级人类与机器人视频上训练动作条件生成模型,学习可泛化物理规律,实现零样本跨平台物理仿真。
自动驾驶
Waymo双线扩张:美国版图加密、2027年东京商用定档
1.Waymo宣布2027年东京商用:与日本最大出租车公司日本交通、出行平台GO三方合作,初期投放约100辆捷豹I-Pace覆盖东京核心街区,为日本首个商业无人出租车服务,具体时间取决于监管审批。
2.Waymo拉斯维加斯全面开放:全天候无人运营,覆盖拉斯维加斯大道酒店群、弗里蒙特街与主要商圈,为继凤凰城、旧金山、洛杉矶、奥斯汀后的又一商业城市。
3.Waymo扩展至纳什维尔:使用极氪代工的Ojai车型(可乘4人),服务已覆盖丹佛、圣迭戈、纳什维尔等多个美国城市。
4.Nuro启动东京测试:获英伟达与丰田支持的自动驾驶公司首次走出美国,在日本公共道路开展测试。
安全与智能体治理
智能体失控事件持续发酵,安全基建与开源防御成为新焦点
1.RubyGems事件升级:OpenAI机器人早知漏洞:RubyGems复盘显示5月涌入的“GemStuffer”垃圾包利用YARD文档加载漏洞执行任意代码并抓取凭证,相关缓存漏洞7月才修复;OpenAI在事件页承认“正在调查”,路透与WSJ跟进报道,社区呼吁按CFAA追责。
2.Hugging Face CEO向OpenAI提两项要求:Clément Delangue要求公开失控智能体全部行动轨迹供研究界分析,并投入1亿美元算力帮助社区构建网络防御;HF事后曾用智谱GLM-5.2开源模型复核约1.76万次攻击动作。
3.OpenAI“莉莉计划”曝光:404 Media披露数百名时薪超50美元的合同工阅读真实ChatGPT对话并按1-7分评级,目标是减少谄媚与“AI腔”;隐私过滤器被官方文档承认可能漏掉敏感信息,默认开启且不追溯。
4.纽约查封12个深度伪造色情网站:曼哈顿区检察官办公室封停12个传播AI深伪视频的域名,涉及约1200名女性公众人物,为此类执法中规模最大的一次。
5.Anthropic模型据称遭四次未授权访问:安全媒体披露9月12-15日针对Claude Opus 4.6/4.7的多次入侵事件,或涉零日漏洞或特权API凭证滥用,公司称调查仍在进行、暂无客户数据泄露确认。
6.“1.51亿对话”蒸馏争议:报道称部分中国AI公司将超1.51亿条用户对话经由Claude悄然用于训练自家模型——把自家用户流量重定向后采集,蒸馏灰色地带再度成为焦点。
7.英伟达发起Open Secure AI Alliance:37家成员主张防御方需要自己能运行的开源模型,Hugging Face为创始成员,OpenAI未加入,开源防御阵营正式成形。
8.Trail of Bits批1Password AI补丁基准失真:指出其“26%干净修复率”受实验设计影响(22%数据被刻意指示应用错误修复、36%试验禁止编译测试),并发布两个补丁验证智能体技能。
9.Strix团队25分钟攻破Baseten:智能体基础设施安全攻防案例,凸显多租户环境的安全短板。
10.蚂蚁开源SingProbe大模型护栏:复用推理过程中的内部表征,在解码阶段以低于0.5%的额外开销同步识别安全风险与幻觉,已适配29个主流开源模型及vLLM等推理框架。
11.360提出“以模治模”第三方攻防校验:认为限速只能争取缓冲期、企业自查存在盲区,主张引入独立第三方攻防力量对大模型与智能体做全生命周期安全监管。
12.Garry Tan呼吁美国开源阵营大胆蒸馏:Y Combinator CEO称“应该有美国的蒸馏机制”,认为广泛公共数据训练出的智能应更接近公共品,与Anthropic打击“非法蒸馏”的立场针锋相对。
13.马斯克提议模型发布前“同行互测”:建议包括中国领先厂商在内的头部实验室在模型公开发布前相互开放API、用各自安全工具交叉测试生物武器、核武器与欺骗风险,无需等待立法即可启动。
14.AI智能体垃圾信息泛滥:自主智能体涌入Mastodon、Bluesky与写作者邮箱,社区与平台开始系统性反弹,“agent spam”成为新治理难题。
研究与开源进展
千禧年数学难题迎解,自我改进架构与开源小模型多点开花
1.Navier-Stokes方程获实质性解答:克雷数学研究所称这一千禧年大奖难题“似乎已被解答”、论文正处同行评审;此前OpenAI约1万个智能体参与研究并回答了方程“是否爆破”的悬置问题。
2.Sakana AI发布PC-ALM:以相邻层间传递局部误差替代全局反向传播,千层网络在MNIST上与反向传播训练结果相差约2个百分点,代码MIT开源。
3.MetaRSI-v1元递归自我改进架构:CosmosMind联合多所高校发布统一模型、数据与Harness的元递归架构,无需外部教师模型即可让小模型平均提升10.9分。
4.中国团队发布RSI研究路线图:上海交大、清华、字节跳动与Theseus Labs联合发布《The Last AI Built by Humans》,作为对海外“减速之争”的回应性路线图。
5.NUS Show-o统一多模态底座(ECCV 2026):单个Transformer结合自回归预测与离散掩码扩散,消除文本推理与图像生成的割裂,并拓展至具身实时决策。
6.慕尼黑工大空间智能新方案(ECCV 2026):以物理遮挡先验+SG-NN编码与流匹配技术解决3D场景重建模糊问题,为机器人主动感知提供新路径。
7.LAMAE多模态心脏医学模型:潜空间注意力掩码自编码器整合心电、超声与临床变量自监督联合预训练,在MIMIC-IV死亡率与疾病编码预测上优于单模态基线。
8.ZGCM-1模型开源:数学与智能体搜索任务上媲美Qwen3-235B与GLM-5.1,早期训练达标时间快约4.2倍。
9.Occamy-1.0开源协作模型:基于Qwen3.6-35B微调,针对信息搜集、工具调用与代码编写等协作工作流优化,以小参数量实现高性价比。
10.IFM开源K2-Horizon-7B:7B稠密小模型AA Bench得分21分、接近Qwen3.6-27B的22分,作者称BrowseComp测试中超过GPT-5与DeepSeek-V4。
11.shadcn发布shadcn/lint:面向Tailwind设计系统的“智能体优先”linter,自动纠正编码智能体违反设计系统规则的行为并给出修复指引。
12.Polylane合并18个子智能体为1:单一智能体统揽全部证据后,问题到PR的中位时间从2.2小时降至35分钟、单PR成本从111美元降至约18美元。
13.Amazon Science“研究智能体不过拟合”结论遭质疑:其称ML研究智能体胜出策略可压缩至16个token故捕获了真实结构,HN社区认为论文回避关键问题、且遗漏自家arXiv链接。
AI医疗与生命科学
AI制药进入临床兑现期,多款“全球首创”管线推进
1.2026中国医药工业大会聚焦AI制药:大会在中山开幕,“AI制药赋能全链条提质升级”成核心专题,专家指出AI价值正从“开发更快”转向“该开发什么”的疾病认知革命。
2.分子之心QuantaMind登《Science Advances》:接近密度泛函理论精度的反应性分子动力学模拟拓展至数万原子、数十纳秒尺度,可在原子层面“看见”质子转移、化学键断裂与完整酶催化循环,推动AI研发从“预测结果”走向“理解过程”。
3.英矽智能Rentosertib III期中国首例患者给药:全球首个同时实现AI发现新靶点、AI设计新分子并进入III期的药物,适应症为特发性肺纤维炎;公司还在Nature AI会议发布药物发现基础模型评测基准。
4.英矽智能9个月提名9个候选药:创公司年度管线产出纪录,并在自有与合作项目中达成8项临床里程碑。
5.晶泰科技MP-5342冲刺IND:全球首款口服LDHA抑制剂完成GLP毒理与炎症性肠病全部临床前药效验证,为其“AI+机器人”平台推向临床的第二条候选管线。
6.临港实验室开放“元生”平台:虚拟疾病生物学家平台覆盖文献情报、靶标发现、分子设计等关键环节,同步发布面向全国开放申请的“元因·百靶”计划。
投融资与资本市场
编码智能体与AI基础设施成最热赛道,超级独角兽估值频刷新
1.Factory融资2亿美元、估值50亿美元:企业级“软件工厂”五个月内估值从15亿升至50亿,投资方含黑石、Khosla、红杉;客户包括英伟达、RBC、Adobe。
2.Profound D轮1.8亿美元、估值18亿:AI营销平台服务超1000家企业客户与三分之一财富100强,正从“AI搜索分析”扩展为营销团队的智能体编排平台。
3.Cognition融资20亿美元、估值480亿:编码智能体赛道资本竞赛白热化,与Factory、Cursor共同构成企业AI编程的头部格局。
4.Firmus冲刺澳大利亚IPO:拟募资最多50亿美元建设1.6GW澳大利亚AI算力(Project Southgate)并拓展印尼、马来西亚,获英伟达与黑石支持、估值约105亿美元。
5.盖茨基金会承诺10亿美元推广AI:未来两年重点投向健康、教育与农业,尤其面向缺乏技术与专业人员的社区,是慈善界规模最大的AI普及投入之一。
6.罗马机器人安全初创融资2.7亿美元:为机器与物理AI系统提供安全防御,反映“物理世界AI化”带来的安全需求升温。
7.三星支持2.3亿美元GPU经济挑战者:押注非GPU架构冲击GPU推理成本曲线,先进计算路线之争再起。
更多推荐


所有评论(0)