物界前沿日评·全球AI软件动态日报
AI SOFTWARE DAILY REPORT
2026.08.04 · 周二
第 006 期
每天5分钟,掌握全球AI软件、大模型最新迭代变化
2.4万亿
Qwen3.8-Max参数规模
激活95B·100万上下文
12/36元
Qwen3.8 API国内定价
每百万tokens·下周开源权重
8月5日
Claude Opus 4.1明晨退役
须迁移至claude-opus-4-8
10.46T
小米MiMo-V2.5周调用量登顶
全球前五全是中国大模型
今日头条 3 条 · 双专家深度点评 | 板块精选 10 条 · 一句话解读 | 快讯 分板块一行速览 | 明日关注
今日三大主线:Qwen3.8-Max上岗办公、Grok看懂视频识破AI假视频、德国法院给AI音乐划出版权红线——分别回答:去哪用、怎么用、用完守什么规矩。
8月3日,阿里正式发布千问家族迄今最强模型Qwen3.8-Max:基于Qwen3.5架构构建,参数规模2.4万亿、激活参数95B,支持100万tokens上下文,编程、办公、科研与长周期任务能力全面提升,可实现数千轮长程交互。下周将开源Qwen3.8-Max模型权重,并同步开源Qwen3.8-27B——这是千问系列首个开源的旗舰模型。API定价:国内输入12元、输出36元/百万tokens。同日,企业级Agent产品「千问办公」(QwenWork)开启公测:整合Qoderwork、Mulerun、悟空三大产品,已初步打通钉钉,网页版与PC客户端开放体验,后续将上线独立App并推出国际版。
大模型专家|2.4万亿总参只激活95B,是把「大模型能力、小模型账单」的路线走到底——按官方定价,输入端成本比同级海外旗舰低一个量级。更值得关注的是「首个开源旗舰」:过去Qwen最强模型一直闭源,下周权重放出后,开发者第一次在旗舰档拿到可自部署的中国模型。真正待验证的是长程Agent的稳定性,「数千轮交互不衰减」还需第三方复现。
软件专家|普通用户今天就有动作:去「千问办公」官网申请公测,优先试两类活——长文档批处理(合同、周报、标书)和钉钉里的日常审批流。已在用钉钉的团队迁移成本几乎为零;但公测期先拿非敏感任务跑一周看稳定性,核心生产数据别一次性迁入。有开发能力的团队可等下周开源权重,再评估私有化部署。
来源:财新 / 腾讯新闻(九派财经)/ 新智元(2026-08-03)
当地时间8月2日,Grok正式上线视频交互功能:用户可像传图片一样在对话框上传本地视频或粘贴视频链接,让模型总结全篇内容、识别画面人物与物体、拆解动作细节、围绕任意细节连续追问。相比旧版仅提取音频文字生成摘要,新版可联动连续帧画面、音频与上下文做全维度理解。马斯克在X平台上演示:上传一段以已故球星科比为原型的AI合成视频,Grok逐帧解析画面、提取台词后,结合背景事实综合判定该视频为深度伪造(Deepfake)内容。
大模型专家|视频理解各家都有,这条的含金量在「判定」而非「描述」:模型把画面、台词和「科比2020年已离世」的背景事实做了交叉推理,才给出Deepfake结论——这是多模态从「看得见」走向「想得通」的信号。但一次演示不等于稳定能力,官方演示样本通常是挑过的,真实识破率要等第三方基准测试。
软件专家|普通人今天就能用的三个场景:会议录屏自动生成纪要、网课视频切章节出摘要、刷到可疑视频先让它验一验。建议把「上传视频问三个问题」直接加进日常工作流。提醒一句:假视频鉴别只能当辅助参考,重大判断别只信一家模型,用两个工具交叉复核更稳。
来源:快科技 / 中关村在线(2026-08-03)
慕尼黑地方法院7月31日宣判,德国音乐著作权协会(GEMA)诉AI音乐生成平台Suno案胜诉,周末持续发酵。法院认定Suno使用GEMA曲库训练模型并存储、复制相关作品,违反德国与美国版权法,驳回其合理使用抗辩,覆盖模型训练与输出生成两个环节;Suno须停止涉案侵权使用、披露收入信息并支付赔偿(金额待定),可考虑上诉。涉案六首歌曲包括《Rasputin》《Forever Young》《Mambo No. 5》等。这是欧洲首次认定「模型记住了歌」本身即构成复制。
大模型专家|判决的技术含义比赔偿金额更重要:法院接受了「模型中可复现受保护表达即构成复制」的论证,等于否定了「模型只存数学参数、不存作品」的经典抗辩。这个逻辑一旦推广,文本、图像等所有生成式模型的训练数据合规都要重估,欧洲市场会陆续出现同类诉讼,「先训练后补票」的窗口正在关闭。
软件专家|对用AI做内容的用户,三条实操建议:一,商用项目(广告、短视频配乐)优先选已公布版权授权链路的工具;二,别把付费订阅当版权护身符——它只给使用权,不保证生成物不侵权;三,正在用Suno做商单的,建议排查存量项目,重大商业用途等上诉结果明朗再扩量。个人娱乐用途暂不受直接影响。
来源:Variety / Billboard / GEMA官方声明(07-31宣判、08-01起报道)
10条高价值动态,每条配套一句话专业解读。
大模型DeepSeek-V4-Flash正式版登陆国家超算互联网
DeepSeek-V4-Flash-0731经大量后训练,智能体能力与指令遵循大幅增强,多项基准测试性能媲美当前最强闭源模型;用户无需配置环境即可一键调用API,也可在社区下载模型文件,用可信Notebook环境一站式完成微调、部署、适配。
一句话点评|不折腾显卡和环境,打开网页就能用上旗舰档开源模型,中小团队的接入门槛再降一档。
来源:界面新闻 / IT之家(2026-08-02/03)
大模型Claude Opus 4.1明晨(8月5日)正式退役
Anthropic官方要求:仍调用claude-opus-4-1-20250805的应用须迁移至claude-opus-4-8,退役后Anthropic自营平台相关请求将失败;Amazon Bedrock与Google Cloud的时间表需单独确认。
一句话点评|今天是最后一天自查API代码里的模型ID;改完务必回归测试提示词、工具调用与成本。
来源:Anthropic官方文档(6月5日公告,8月5日生效)
大模型OpenRouter最新周榜:全球调用量前五全部为中国大模型
小米MiMo-V2.5登顶,单周token调用量达10.46T,是当周唯一突破10T的模型,5月以来增长约616%;DeepSeek、腾讯混元等亦位居前列。央视报道指出,国产开源模型正凭性能与成本优势在海外开发者群体快速普及。
一句话点评|你用的海外工具里,「默认模型」底层越来越可能是中国开源模型;做工具选型比价时,记得把国产模型加进候选清单。
来源:IT之家 / 央视(2026-08-02/03)
AI编程腾讯CodeBuddy国内版全面支持DeepSeek-V4-Flash正式版
IDE、插件、CLI三端模型列表同步更新,官方称Agent能力大幅提升;同列表还包括Hy3、GLM-5.1/5.2/5v、Kimi-K2.6/2.7/3、MiniMax-M3、DeepSeek-V4 Pro等。
一句话点评|用CodeBuddy的开发者可把主力模型切到V4-Flash正式版,Agent任务可用性明显好于预览期。
来源:AIBase(2026-08-04)
AI办公Claude Cowork扩展至移动端与网页版
会话与文件跨设备同步,支持后台工作、定时任务、共享聊天与项目、手机端审批;Max用户先行,后续逐步开放,双倍用量额度限时到8月5日。
一句话点评|出差路上也能派活给Claude干了;想用双倍额度的,明晚之前把重活排上。
来源:Anthropic官方博客(7月下旬公告)
AI办公腾讯元宝升级图片理解,主打「遇事拍一张」
拍照即可识别复杂场景、提取关键数据,并推荐下一步自动化处理指令,覆盖生活全场景,进一步降低C端使用门槛。
一句话点评|不会写提示词也能用了——先拍后问,这是长辈和新手最容易上手的一版元宝。
来源:AIBase / aipulse(2026-08-03)
图像视频商汤开源SenseNova U1.5-Lite-Preview:8B规模原生4K生图
基于NEO-Unify架构,8B-MoT单一模型贯通视觉理解、推理、生成与编辑,多项主流评测超越U1、比肩商用闭源模型;代码与权重已在GitHub、Hugging Face、魔搭社区开放。交付级创作模型SenseNova U1Pro邀测中。
一句话点评|本地部署4K生图第一次进入8B量级,消费级显卡也有机会跑;做海报、信息图的可直接下载试用。
来源:IT之家 / 商汤官方(2026-08-03)
图像视频谷歌暂停Google Earth AI图像生成功能
该功能上线不足48小时即被暂停,官方称为加强安全防护,恢复时间未定。
一句话点评|生成式功能「先上线再补安全」的节奏在收紧;手里有靠该功能出图的工作流,记得留好备用工具。
来源:AIBase(2026-08-03)
AI软件华为诺亚开源MindMemOS:给Agent装上「带得走的记忆」
面向AI Agent的可迁移、自演进记忆操作层,MIT协议开源,提供API、SDK、CLI与插件等接入方式,云服务已开放注册试用。
一句话点评|做Agent应用的开发者不必每个项目重造记忆模块;普通用户暂无需动作,等上层应用接入后自然会感知「AI记得你了」。
来源:量子位(2026-08-02/03)
AI软件灵光App闪应用创作者突破400万人
官方称绝大多数为无编程背景的普通用户,普通人正成为AI应用创作主力。
一句话点评|「不会代码也能做应用」已是规模化事实;想做自己小工具的,从模仿热门闪应用开始最快。
来源:AIBase(2026-08-03)
AI大模型
● 月之暗面回应媒体传闻:「最早于本月内提交香港IPO申请」消息不实(AIBase,8月4日)
● DeepSeek:V4-Pro正式版将「尽快」发布,V4-Flash正式版API公测进行中(IT之家,8月2日)
● Qwen3.8 API定价:国内输入12元、输出36元/百万tokens,隐式缓存命中1.5元;海外输入2美元、输出6美元(千问官方,8月3日)
● 摩尔线程宣布闪电适配MiniMax H3多模态大模型,国产算力适配提速(AIBase,8月3日)
● OpenAI未发布模型Astra数学能力引热议,第三方分析指部分公开解读超出实测依据(AIBase,8月3日)
AI软件与办公工具
● 千问办公后续将上线独立App并推出国际版,实现多端联动(九派财经 / 第一财经,8月3日)
● OpenAI官方:Atlas浏览器将于8月9日退役,由ChatGPT Chrome扩展接替,重任务迁移至ChatGPT桌面应用(OpenAI,7月9日公告)
● OpenAI官方:o3将于8月26日退出ChatGPT,API不受影响(OpenAI帮助中心)
● Anthropic:Claude Sonnet 5优惠价每百万tokens 2/10美元8月31日截止,之后恢复3/15美元(Anthropic官方)
● Anthropic:旧版Workbench与三个实验性prompt API将于8月17日停止访问,数据可提前导出(Claude开发者平台,7月17日公告)
图像视频与行业安全
● 商汤交付级创作模型SenseNova U1Pro处于邀测阶段,面向专业创作者与企业用户(IT之家,8月3日)
● IBM报告:约四分之一数据泄露事件由AI驱动的攻击造成,单笔损失高出均值20%(AIBase,8月3日)
① 8月5日 · 明晨:Claude Opus 4.1正式退役,API仍调用旧模型ID的应用今天必须完成向claude-opus-4-8的迁移与回归测试
② 8月5日 · 明止:Claude Cowork双倍用量额度截止,Max用户想把重活跑完的今晚排期
③ 下周:Qwen3.8-Max与Qwen3.8-27B开源权重放出——千问首个开源旗舰,私有化部署评估可以准备起来了
④ 8月9日:OpenAI Atlas浏览器退役,迁移至ChatGPT Chrome扩展
⑤ 8月17日:Anthropic旧Workbench及实验性prompt API停止访问,记得导出数据
⑥ 8月26日 / 8月31日:OpenAI o3退出ChatGPT;Claude Sonnet 5优惠价截止
📖 完整日评 · 论坛全文
物界前沿日评 · 2026-08-04
数界工坊 · 全球AI软件动态日报