跳转至

AI行业每日快讯 - 2026-08-24

覆盖过去 24 小时国内外 AI 行业热点,信息来源已核实,未包含营销软文与低质量水文。


🚀 重大行业动态

1. 阿里巴巴港股配售募资 800 亿港元,100% 投入全栈 AI 能力建设

8 月 23 日,阿里巴巴(9988.HK)公告配售 7.1 亿股、募资约 800 亿港元(约 102 亿美元),配售价 112.70 港元/股,预计 8 月 26 日交割。所得款项将全部用于全栈 AI 能力建设,包括算力基础设施扩容、大模型研发迭代与 AI 商业化落地。此前 Q1 财报显示 AI 相关产品 ARR 突破 495 亿元,资本开支同比 +75%。这是国内大厂以股权融资锁定 AI 长期弹药的最强信号之一,也印证头部云厂商"AI 算力投入三年回本"的扩张逻辑。

来源:阿里巴巴官方公告 / 证券时报(8月23日)

2. 大模型集体调价:国内涨价、海外降价,"价格战"转向"智力战"

DeepSeek 自 8 月 23 日起调整峰谷计费规则,周末全天统一按低谷价计费;此前 8 月 17 日 DeepSeek 已全面涨价,V4 Pro 高峰时段涨幅最高达 1100%。年内阿里云、腾讯云、百度智能云、智谱 AI 先后上调 API 价格,摩根士丹利统计 2026 年 Q2 国内大模型平均 API 输入价 4.9 元/百万 Token(同比 +48%)。与之相反,OpenAI 于 8 月 21 日将 GPT-5.6 Sol API 价格下调超 20%。一涨一降背后是同一逻辑:国内付费意愿已验证、厂商追求盈利兑现;海外则降价换量抢占市场。

来源:每日经济新闻 / 腾讯新闻(8月23-24日)

3. 中国大模型调用量连续 17 周领跑全球,神秘模型"牛来"(Ox Alpha)上线 4 天冲至第二

据 OpenRouter 数据,上周(8/17-8/23)全球大模型总调用量 93.3 万亿 Token(环比 +23.9%),其中中国模型 40.48 万亿、美国模型 9.66 万亿,中国连续 17 周居首,全球前五中占四席:DeepSeek-V4-Flash 正式版连续三周第一,代号 Ox Alpha 的匿名模型(中文社区称"牛来")8 月 20 日上线即冲至第二,周调用量 11.6 万亿 Token,支持文本/图像/视频输入且预览期免费。独立测评显示其在软件工程基准 DeepSWE 上通过率约 80%,高于 Claude Fable 5 的 65%。该模型厂商身份成谜,技术指纹指向智谱 GLM 系列,也有谷歌 DeepMind 研究员暗示其为 Gemini 新版。

来源:每日经济新闻 / OpenRouter(8月24日)

4. 英伟达 AI 服务器涨价超 15%,云厂商加速自研芯片替代

据彭博社 8 月 23 日报道,英伟达已通知核心客户 2027 年出货的 AI 服务器将至少涨价 15%,NVL72 单台询价达 500-700 万美元,主因 DRAM 成本大幅上升。压力之下云厂商自研替代提速:谷歌 TPU 占比已达 70% 并与 Marvell 签 7 年定制协议,亚马逊 Trainium 占比 40%,阿里平头哥真武 M890 已服务超 650 家客户。伯恩斯坦预测 2030 年定制芯片出货占比将从 38% 升至 49%。

来源:彭博社 / 伯恩斯坦(8月23日)


🧠 技术&论文

1. 普林斯顿刘壮团队开源全开放文生图配方 i1,五项基准平均领先 29.5 个百分点

团队投入 300 多组控制实验、超 70 万 TPU v6e 小时,系统研究文生图扩散模型的模型与数据设计,最终训练出 3B 参数的 i1,并在 GenEval、DPG-Bench 等五项基准上平均领先此前最好的全公开模型 29.5 个百分点,接近 20B 的 Qwen-Image。论文、代码、模型、数据集全部开放(arXiv:2606.11289)。这是文生图领域少有的"从训练代码到数据完全可复现"的基准性工作,为后续消融研究与社区复现提供了统一起点。

来源:机器之心 / arXiv(8月23日)

2. 腾讯 ARC Lab 联合港大、港科大开源 SCoPE:用射线空间重写视频模型位置编码

视频世界模型通常以 (u,v,t) 网格组织位置,相机移动后网格地址与场景位置对应会混乱。SCoPE 直接根据相机运动为每个视频 token 计算观察射线并注入视频 DiT,新增参数不到原模型的 0.1%,即可改善相机控制、跨视角一致性与 revisit 一致性,且无需游戏引擎或三维重建,能从单张静态图生成可交互相机控制的视频(arXiv:2606.27345)。这为视频世界模型的几何理解提供了一条轻量新路径。

来源:新浪科技 / 机器之心Pro(8月24日)

3. DeepSeek 上线 V4 系列首个视觉模型 V4-Flash-Vision-Exp

8 月 21 日,DeepSeek API 官方文档上线实验性多模态模型 deepseek-v4-flash-vision-exp,文本能力与 V4-Flash 持平,多模态 Agent 基准接近 Claude Opus 4.8;支持 base64、URL 及全新免费 Files API 传入图片,单图最多计 384 token,定价完全沿用 V4-Flash 不额外收费。图文输入纳入统一 API,意味着调用方可零成本扩展视觉能力,进一步压低多模态 Agent 的接入门槛。

来源:DeepSeek API 官方文档 / 环球网(8月21日)

4. OpenAI 以 Apache 2.0 全面开源 Codex Harness,Agent 运行时成为新战场

8 月 19 日 OpenAI 官方博客宣布将驱动 Codex 智能体的底层执行框架 Codex Harness 全面开源(含 Codex CLI、App Server、官方 SDK 三组件),国内媒体 8 月 22 日集中报道。内部数据显示 Codex 5 个月生成约 100 万行代码、完成 1500 个 PR;GPT-5.6 Sol 接入 Harness 后 ARC-AGI-3 得分从 13.3% 跃升至 38.3%。此举被业内视为对一周前 DeepSeek 开源 Harness 的正面回应——Agent 运行时基础设施正从各家内部能力走向开源竞争。

来源:OpenAI 官方博客 / AIBase(8月19-22日)


📜 政策监管

1. 法国指定 Mistral 为政府"主权 AI"安全测试供应商,明确排除 OpenAI

法国预算部长 David Amiel 宣布,政府将聘请 Mistral 等本土"主权 AI"供应商对公共服务进行漏洞测试,并明确排除 OpenAI。背景是法国税务机构 DGFiP 此前遭遇入侵、约 70 万纳税人数据泄露。这一决定是欧洲在敏感政府场景推动 AI 主权的最新落地动作,也凸显欧洲对美国大模型在政府安全场景的信任门槛。

来源:aibriefing.dev / 外媒综合(8月23日)

2. Anthropic 将为未来 Claude 引入隐形水印,满足欧盟《AI 法案》可追溯要求

Anthropic 披露计划为后续 Claude 模型加入隐形水印,以满足欧盟《人工智能法案》对生成内容可追溯的要求;同期其内部 Model 2 能力被指略强于 Mythos 5。合规能力正成为前沿模型发布的标配环节。国内方面,近 24 小时无重大新规出台,但《人工智能拟人化互动服务管理暂行办法》正持续落地(EVE、MoMood 等平台已强制实名认证),且《人工智能法》已写入国务院 2026 年度立法工作计划,体系化 AI 立法在提速。

来源:每日极客日报 / 中国青年网 / 桂林市科技局(8月24日)


✍️ 每日研判

信号 1:中国开源模型生态完成"从跟随到基座"的跃迁。 Qwen3.8-27B 开源两日下载破百万、登顶 HuggingFace 趋势榜;DeepSeek 调用量连续 17 周全球第一;OpenAI 投资的美国法律 AI 公司 Harvey 改用 Kimi K3 做后训练(8 月 20 日发布 Tenet 预览)。海外垂直商业场景开始以中国开源模型为底座,开源正成为中国 AI 的"默认选项"。后续关注:开源生态的商业化闭环能否持续反哺基座厂商。

信号 2:大模型定价逻辑转向,商业化进入兑现期。 国内厂商集体涨价(Q2 API 均价同比 +48%/+80%)、阿里配售 800 亿港元全投 AI、DeepSeek 首轮融资估值约 3500 亿元人民币;海外则用降价换市场(OpenAI 降价 20%)。摩根士丹利"告别价格战、打响智力战"的判断正在兑现——Token 涨价说明付费意愿强,资本开支扩张说明收入端有了支撑,AI 收入正从概念走向报表。

信号 3:算力成本上行倒逼"自研芯片 + Agent 基建"双线竞赛。 英伟达 2027 年服务器涨价至少 15%,谷歌、亚马逊、阿里自研芯片占比快速提升;同时 OpenAI 与 DeepSeek 竞相开源 Agent Harness、Anthropic 开放 Claude Platform 企业级 Agent 能力。短期看,算力涨价利好自研芯片与多模型路由;中长期看,Agent 运行时与执行框架的标准化,将决定下一代 AI 应用生态的话语权归属。


本简报由 AI 自动生成并推送,所有条目均基于公开可查的真实来源;信息以原报道为准。