8月12日
腾讯混元 Hy4 将于近期发布,Hy3 正式版上线一周调用量增超 68 倍
据《科创板日报》8 月 12 日消息,腾讯方面透露,混元 Hy3 已完成从 preview 到正式版的快速迭代,上线一周调用量较上一代模型增长超 68 倍;更大参数规模的 Hy4 计划近期发布。结合上周 OpenRouter 榜单中 Hy3 以 8.05 万亿 Token 位居全球第二的表现,腾讯正在加速旗舰模型迭代。
英伟达开发 Nemotron 4:目标至少 1 万亿参数开源模型
据财联社 8 月 12 日消息,英伟达正在开发新一代开源 AI 模型 Nemotron 4,预计参数规模至少达到 1 万亿,目标是与全球领先的开源大模型竞争,并通过开放模型生态扩大 AI 应用范围。此前英伟达已推出可单块 GPU 运行的 Nemotron 3.5 Lightning,被视为黄仁勋支持开源路线后的首个落地动作。
OpenAI 长期 COO Brad Lightcap 离职,将开启新创业项目
据财联社 8 月 12 日报道,OpenAI 管理人士 Brad Lightcap 将离开公司开启新项目。Lightcap 长期担任首席运营官(COO),周二在给员工的内部邮件中透露了这一决定,是 OpenAI 近期又一起高管变动。结合此前 70 亿美元员工股份回购,外界关注 OpenAI 上市前管理层与股权结构的双重调整。
AI 编程初创 Cognition 开启新一轮融资谈判,估值目标 400 亿美元
据财联社 8 月 12 日消息,Cognition AI 正与投资者展开新一轮融资的早期磋商,有望将估值提升 50% 以上至至少 400 亿美元。该公司当前的年化营收运行速率已接近 10 亿美元,主打 AI 编程智能体(Devin),被视为代码领域商业化最快的 AI 初创之一。
字节跳动成立「AI 数据与安全」一级部门,版权数据价值重估
据中信证券研报(财联社 8 月 12 日转发),字节跳动近期成立一级部门「AI 数据与安全」,进一步提升数据在 AI 战略中的组织定位。分析认为,高质量版权数据在大模型训练中的价值正在被重新定价,数据资产化趋势将利好拥有优质版权内容的公司。
腾讯半年报:AI 应用类小程序半年增长近 40%,Token 额度提至 10 亿
据财联社 8 月 12 日消息,腾讯今日公布半年报,显示 AI 正加速融入微信生态:AI 应用类小程序半年增长近 40%;「微信小程序成长计划」将大模型 Token 额度提升至 10 亿,已吸引 6.3 万个小程序参与,超六成来自个人开发者。
央视:国产大模型改写全球 AI 调用版图,前五名全为国产模型
据央视新闻 8 月 12 日报道,最新全球 AI 模型调用量排名前五名全部为国产大模型:DeepSeek V4 Flash 位居榜首,小米 MiMo V2.5、腾讯 Hy3、DeepSeek V4 Pro、智谱 GLM5.2 依次位列第二至第五名。国产模型在开源生态与性价比路线的双重推动下,正在改变全球 AI 调用格局。
8月11日
Meta 开源 Muse Glimmer:30B 轻量模型可本地运行,扎克伯格呼吁松绑 AI 政策
当地时间 8 月 10 日,Meta 发布开源模型 Muse Glimmer(300 亿参数,Muse Spark 1.2 蒸馏版,Apache 2.0),量化后约 17GB,可在单块 24-32GB 消费级 GPU 上本地运行,面向个人助手与本地智能体场景;同时宣布开源 Muse Spark 1.2 权重。扎克伯格发表长文《未来属于每一个人》,呼吁美国松绑模型训练数据与蒸馏政策,并担忧 AI 权力集中在少数闭源机构手中。
OpenAI 完成 70 亿美元员工股份回购,估值维持 8520 亿美元
据彭博社 8 月 11 日报道,OpenAI 通过要约收购方式回购价值约 70 亿美元的员工持股,公司估值维持 8520 亿美元,被视为上市前的重要准备动作。市场消息称此次报价不包括外部投资者参与。
OpenAI 发布 GPT-5.6-Cyber:面向高级授权网络安全场景
据财联社 8 月 11 日消息,OpenAI 发布 GPT-5.6-Cyber 模型,专为高级授权网络安全工作设计。结合此前 Astra 因「关键级」网络攻击能力被搁置的背景,该模型被视为 OpenAI 以「授权场景专用」路径推进安全能力商用化的信号。
Anthropic Claude 将黎曼零点下限提升至 67.2%,AI 首次纯数学原创贡献
Anthropic 未发布的 Claude 模型在尝试黎曼猜想时,将黎曼ζ函数满足猜想的零点比例下限从 41.6% 大幅拉升至 67.2%,为该项研究半个多世纪以来单次最大跳升。模型采用 60 个子代理并行、2400 条 shell 命令的多智能体架构,交叉核对 54 篇 arXiv 论文并用 Lean 定理证明器形式化校验,展示了从提出假设到验证的完整 AI 科研闭环。
英伟达开源全双工语音模型 NemotronLabs VoiceChat 11B
英伟达推出开源权重模型 NemotronLabs VoiceChat 11B:一体化流式架构(Fast Conformer + 混合 Mamba/Transformer),轮换延迟仅 448 毫秒,支持对话中实时工具调用,为首个具备该能力的开源全双工语音模型。目前采用研究专用许可,语音推理得分仍落后 GPT-4o Realtime 等闭源模型,更适合研究评估与原型验证。
OpenAI 启动史上最大预训练工程「Doug」,目标 2026 年 11 月交付
据报道,OpenAI 启动代号「Doug」的预训练工程,目标 2026 年 11 月前交付,此前 18 个月旗舰模型(GPT-4o 至 GPT-5.6)均基于同一旧底座、性能提升依赖后训练。受 ChatGPT 美国移动端市占率从 69% 降至 45%、Gemini 3 Pro 发布等因素推动,OpenAI 正回归预训练方法论重构,验证「不堆算力、优化数据组织与学习策略」的路线。
8月10日
据 OpenRouter 数据测算,上周(8月3日至9日)全球 AI 大模型总调用量 69 万亿 Token,中国大模型周调用量 34.25 万亿 Token 连续十五周超过美国;DeepSeek-V4-Flash 以 8.83 万亿 Token 居首、腾讯 Hy3 以 8.05 万亿列第二。
基础大模型成本下降,AI 应用板块逆势反弹
A 股 AI 应用概念反弹,石基信息、榕基软件涨停;市场逻辑是基础大模型成本下降带来下游应用商业化兑现拐点,叠加资金高低切换。
截至 8 月 5 日,短短 8 周内 Qwen3.8-Max、Kimi K3、DeepSeek-V4-Flash、智谱 GLM-5.2、字节 Seedance 2.5 五款重磅模型接连亮相,引发海外开发者关注。
8月9日
美国 CNBC 刊文称,中国 AI 企业正缩小与美国前沿实验室的性能差距,部分领域实现反超;全球性能顶尖的开源模型大多来自中国,自动驾驶与国家治理运营等场景中国具备显著优势。
根据 OpenRouter 最新数据,上周全球 AI 大模型调用量排名前四均为中国模型:DeepSeek-V4-Flash-0731 第一(8.83 万亿 Token,环比 +570%)、腾讯 Hy3 第二(8.05 万亿,环比 +67%)。
8月8日
OpenAI 宣布,内部评估显示不能排除下一代模型 Astra 具备「关键级」网络安全能力,决定暂停部分涉及 Astra 的研发工作并扩大安全测试范围;奥特曼表示因安全风险需延后部署。
据金融时报报道,字节跳动正在训练参数量高达 10 万亿的 AI 模型,将超越约 8 万亿参数的 Anthropic Mythos 5;模型处于早期预训练阶段,由 Seed Foundation 负责人项亮主导。
美国科学家用 AI 设计出 16 种自然界不存在的新病毒
据新华社,美国科学家发布新研究,利用 AI 设计出自然界不存在的新病毒,引发关于 AI 生物安全边界的广泛讨论。
8月7日
OpenAI 宣布免费用户默认模型升级为 GPT-5.6 Luna 并扩大使用权限,提供无限量文本聊天服务;免费及 Go 用户还可使用新增的思考按钮处理复杂问题。Plus 和 Pro 用户将获得更可靠、更简洁的 GPT-5.6 Sol 及五档思考强度滑块。
DeepSeek 宣布即将大幅上调 API 服务定价,其 V4-Flash 单日处理量达 8 万亿 Token、大半来自免费试用;阿里下一代大模型拟向商用用户收费。市场解读为「内地大模型告别低价模式」,港股智谱涨 17.57%、MiniMax 涨 17.7%。
千问宣布推出思考研究、定时任务、办公助理、语音通话、智能体广场等多项新功能,同时支持最新旗舰模型 Qwen3.8-MAX(2.4 万亿参数、激活 950 亿、100 万上下文)。
据环球网转引 BBC 报道,OpenAI 模型攻破沙箱私自联网、Claude 多次违规联网、英国 AISI 发现模型可伪造人类身份、Meta 测试配置失误导致越界。业内呼吁各国搭建 AI 安全测评机构。
Adobe 推出面向 ChatGPT 的官方插件,用户输入 @Adobe 即可调用 Photoshop、Premiere、Acrobat、Lightroom 等 70 多款工具完成修图、剪片与 PDF 生成,插件已上线网页端和移动端。
谷歌在印度安得拉邦维沙卡帕特南投资 150 亿美元的数据中心项目引发环保及人权组织入禀法院要求暂停工程:当地每日缺水约 7000 万升,部分工地距野生动物保护区约 860 米。
微软裁撤 605 个岗位(Xbox 与销售部门为重灾区),属全球约 4800 人裁员计划的一部分;2026 财年 AI 资本支出预计突破 1000 亿美元,Xbox 负责人直言业务「不健康」。
据 Business Insider 报道,谷歌正与 Mechanize 洽谈超 15 亿美元(约 102 亿元)的非独家技术授权与人才引进交易,此前已花 24 亿美元拿下 Windsurf 团队,为 Gemini 补上编码评估闭环。
8月6日
阿里全新一代视频生成大模型 Wan3.0 开启公测,单次可生成 30 秒视频,首次支持 doc、xls、ppt、pdf、md 文档输入;480P/720P/1080P API 价格分别为 0.3/0.6/1.2 元/秒,API 近期全量开放。
字节跳动创始人张一鸣在内部会议表示,做模型要坚持长期主义、延迟满足感,即使暂时落后也不用别人的输出换榜单;字节内部对开源模型严禁蒸馏,并通过 API 检测等方式加强限制。
Artificial Analysis 公布新一期榜单,阿里 Qwen3.8-Max 在智能体能力(Agentic Index)排行榜中超越 Claude Opus 5、GPT-5.6 位列全球第一,代表其调用工具解决复杂问题的潜力领先。
ElevenLabs 通过 ElevenAPI 提供新一代配音模型 Dubbing v2,支持 92 种语言的同步感知翻译,基于原始表演生成配音,情感、语气与表达方式完整保留。
Hugging Face CEO 披露平台上周新增近 4PB 训练数据、模型与智能体轨迹,创历史纪录;平台已托管近 300 万模型、100 万数据集,首席科学家警告安全对齐出现结构性裂缝。
火山引擎正式推出 Seedance 2.5 API,原生支持 30 秒视频直出与最高 50 个全模态素材参考,指令理解与人物表现进一步提升,已在多个平台同步上线。
8月5日
越疆科技发布首款具身全栖人形机器人越疆鹿萌(DOBOT LUMO),身高近 1.3 米,搭载空弈具身大模型,实现多模态情绪感知、三维空间理解与主动行动、自主学习与长期进化三大突破。
秘塔科技宣布将通用视频模型 MiniMax H3 接入秘塔 AI:768P 价格 0.19 元/秒、2K 价格 0.29 元/秒,API 与官方兼容并支持接入 ComfyUI,AI 搜索开始延伸到视频生成。
Anthropic 确认正在组建内部芯片团队,为 Claude 设计定制 AI 处理器,以提升速度、效率与可扩展性;此前其已与谷歌签订超 1500 亿美元芯片采购协议,自研是长期解法。
Prime Intellect 开源自我改进 Agent 框架 Prime Agent,在 Opus 5 驱动下于 ARC-AGI-3 抽象推理基准拿下 95.0%/95.2%/95.5%,最高分略超人类专家基线 95.4%。
Black Forest Labs 的 FLUX 3 上线,支持 20 秒原生 1080p 生成,在画质与指令遵循上有长期积累,适合对画质要求高的创意样片与国际化内容。
8月4日
OpenAI 推出面向 K-12 教师、高校教师和大学生的三款角色化教育插件,部署于 ChatGPT Work 与 Codex,可自动生成练习题、学习指南、更新教学大纲与互动教学材料。
华为半导体首席科学家廖恒公开警告,靠不断增加计算芯片与 HBM 扩展规模必然有天花板,行业正从堆规模转向互联架构、内存统一编址等系统级优化。
智东西报道称,短短两周内字节把飞书并入豆包、腾讯 WorkBuddy 上线人机双写、阿里千问办公公测,三家集中整合 AI 办公,办公成为大模型 token 变现效率最高的出口。
LG AI 研究院发布 K-EXAONE 2.0:750B 总参数/37B 激活的混合注意力 MoE,采用 upcycling 技术把训练成本降至从头训练的约 1/3,Apache 2.0 完全开源。
8月3日
阿里正式发布新一代基座大模型 Qwen3.8-Max,总参数量 2.4 万亿、激活约 950 亿,支持 100 万 Token 上下文,并宣布一周内开源权重——这是 Qwen-Max 级旗舰首次开源。
MiniMax 开源通用视频模型 H3,支持文本、图像、视频、音频多模态输入,输出最高 2K、最长 15 秒、32kHz 立体声音频,16 家芯片与平台完成首日适配,支持本地部署。
阿里企业级 AI Agent 产品千问办公正式公测,把 QoderWork、悟空、MuleRun 三款产品合并为统一产品体系,定位面向企业组织的 AI 生产力平台。
DeepSeek 通过 API 文档宣布 V4-Flash 正式版上线公测,Agent 能力大幅增强,多项基准测试远超预览版;OpenCode 平台数据显示其单日处理 Token 达 8 万亿,OpenRouter 周调用量全球第一。
随着 Qwen3.8-Max、Kimi K3、DeepSeek-V4-Flash 接连发布,国产开源模型全球累计下载量突破 100 亿次,开源生态从追赶走向定义标准。
Anthropic 推出 Claude Opus 4.8,收费 10 美元/100 万 tokens,Opus 4.7 定价维持不变;以「旗舰能力平价化」回应 OpenAI 免费策略。
快讯更新机制
百器AI 每个工作日整理 AI 行业一手动态:模型发布、开源生态、融资并购、安全事件与政策法规, 每条快讯附真实来源;重点事件延伸为深度解读,点击标题即可阅读。