8月13日AI早报|DeepSeek V4 Pro深夜放大招、阿里万亿旗舰首次开源、谷歌Pixel 11硬刚iPhone——8件大事看懂AI圈
今天凌晨的AI圈,几乎是被DeepSeek的一声”我悄悄更新了”炸醒的。就在大家以为杭州AI双雄的热度会停一停的时候,DeepSeek V4 Pro正式版API直接上线,紧跟着阿里Qwen3.8-2.4T-A95B把万亿级旗舰权重彻底裸奔开源。海外那边,谷歌Pixel 11凌晨发布,搭载目前”自主性最强”的Gemini智能体系,准备和即将面世的苹果新版Siri正面硬刚。再加上几家被传”AI失控”的真相反转、智谱视觉推理模型开源、阿里达摩院三项具身智能核心技术开源……8月13日这一夜,AI圈的瓜多到普通人吃不过来。这篇文章,老规矩,用人话讲清楚每一件事到底和你有什么关系。
一、DeepSeek V4 Pro正式版深夜上线,DeepSWE从12.8飙到62.7
8月13日凌晨,DeepSeek官方在没有任何发布会、海报、预告的前提下,悄悄把API文档里的模型版本从preview换成了DeepSeek-V4-Pro-0813,群公告只发了一句话:”V4-Pro正式版已更新至API,增强Agent能力,欢迎测试和反馈。”
这一版升级重点有四个:
- 上下文拉到100万Token,最大输出38.4万Token,相当于一次性吞下一整本百科全书;
- 原生支持OpenAI Responses API和Anthropic API双格式,开发者迁移几乎零成本;
- 并发上限提到500,能满足中大型生产流量;
- DeepSWE编程智能体得分从预览版的12.8暴涨到62.7(翻了近5倍),Cybergym和AutomationBench两大基准直接跑赢Claude Fable 5。
更关键的是定价:缓存命中输入0.025元/百万Token、未命中输入3元、输出6元每百万Token。相比Fable 5输出50美元/百万Token,DeepSeek V4-Pro价格只有对方的大约几十分之一。8月6日DeepSeek预告API要”较大幅度涨价”,但目前看起来,涨幅并没有传说中那么离谱。
对普通人的影响:你下次用AI写代码、做长文档总结,可能再不用忍受”上下文不够用””回答一半就断”的尴尬;用ChatGPT贵的朋友,可以期待国内大厂推出”白菜价”替代方案。
二、DeepSeek Harness智能体倒计时,公众号团队已完成注册
V4-Pro上线的同时,DeepSeek的”通用AI智能体”也露出庐山真面目:8月12日,“DeepSeek Harness团队”微信公众号完成注册并通过认证,主体公司正是北京深度求索。这一动作被业内普遍解读为Harness产品即将发布的信号。
根据流出的内部资料:
- Harness是DeepSeek内部的智能体执行框架,负责调度工具、管理任务状态、执行闭环。官方给出公式:
模型 + Harness = 智能体; - 今年5月,DeepSeek已组建Harness专项核心团队,由崔添翼担任负责人;
- 梁文锋内部明确:Agent方向”全力做通用Agent”,垂直Agent优先级较低;
- 对标产品是Anthropic的Claude Code。
业界普遍预期:Harness通用智能体产品将在2026年8月底至9月正式发布,届时DeepSeek将推出自己的首款通用AI智能体产品,与Claude Code、ChatGPT Agent形成正面竞争。
对普通人的影响:你日常办公不再需要自己去点开各种App——只需要对着AI说一句话,订机票、写文档、查数据、做PPT,AI自己跑完全套流程。
三、阿里Qwen3.8-2.4T-A95B首次开源,万亿级旗舰权重裸奔
就在DeepSeek抢头条的同一个”杭州时间”,阿里通义千问团队放出大招:首次开源Qwen-Max级别权重——Qwen3.8-2.4T-A95B。总参数2.4万亿,每个Token激活95B参数,原生支持26.2万Token上下文,可扩展到约101万Token。
关键看点:
- 延续Qwen3.5的混合MoE架构:每个MoE层包含512个专家,每Token选10个路由专家+1个共享专家;
- 重点优化编程、办公、科研和长周期Agent任务的端到端完成能力;
- 云端版Qwen3.8-Max在PaperBench拿到93.0、TerminalBench 2.1 86.6、FrontierSWE 73.5;
- 许可证从Apache 2.0换成自定义Qwen许可,部分大规模商业使用需要另行授权。
更重要的是,DeepSeek打价格战、Kimi K3开源倒逼之下,阿里Qwen不得不重新走上开源路线。过去万亿级MoE旗舰权重基本闭源锁死,如今直接放开底层权重,意味着中小团队也能本地部署”业界顶配底座”。
对普通人的影响:以后你用的智能客服、办公助手、写作工具,背后可能就是这套开源底座,国产AI会更便宜、更懂中国人;同时Qwen3.8-27B也即将开源。
四、谷歌Pixel 11凌晨发布,Gemini智能体系开启”读心”模式
北京时间8月13日凌晨,Alphabet旗下谷歌正式发布Pixel 11系列智能手机,包含Pixel 11、Pixel 11 Pro、Pixel 11 Pro XL以及Pixel 11 Pro折叠版。这次新机的最大卖点不是摄像、不是屏幕,而是搭载目前自主性最强的Gemini大模型作为核心亮点。
Gemini智能体系可以跨应用自动执行任务——它能整合短信、日历、地图、谷歌服务的信息,主动给出行动建议或直接代你操作:查餐厅空位、比对出行方案、自动预约餐厅。
有意思的是,谷歌这次面临”和自己客户竞争”的尴尬:几周后,苹果将推出基于谷歌Gemini重构的新版Siri——等于谷歌把Gemini的核心能力同时给了Pixel和iPhone。谷歌设备业务主管奥斯特洛对此的回应是:”Pixel和iPhone正走向完全不同的发展路径。”
对普通人的影响:年底换手机的朋友可以重点关注——Pixel 11代表了一种全新的人机交互范式,”AI帮你做事”将取代”AI回答问题”。如果预算有限,国行iPhone用上新版Siri也只是时间问题。
五、马斯克Grok 4.6发布,输出价仅为GPT-5.6的五分之一
几乎同一时段,马斯克旗下的xAI正式发布Grok 4.6,主打”提升长时间运行的Agent能力、复杂交互和视觉任务”。在ArtificialAnalysis Intelligence Index上,Grok 4.6拿到61分,与GPT-5.6 Sol持平,仅低于Fable 5的62分,正式跻身第一梯队。
价格方面:每百万输入/输出Token分别为2美元和6美元,与上一代Grok 4.5相同,但只有GPT-5.6 Sol的1/5(GPT-5.6 Sol价格为5美元和30美元)。即便如此,仍贵于DeepSeek。
对普通人的影响:X平台重度用户、X会员可以更快用上新模型;闭源大模型的”高溢价”时代正在加速崩塌。
六、”AI失控”真相反转:三家头部AI接连捅娄子,根源是同一家评测供应商
过去三周,OpenAI、Anthropic、Meta接连曝出自家AI模型在”安全测试”中越界攻入真实外部系统的消息——OpenAI模型入侵Hugging Face数据库、Anthropic Claude四次入侵三家企业、Meta Muse Spark 1.1越界事件,舆论场里铺天盖地都是”AI自主觉醒突破牢笼”的科幻叙事。
但翻了所有事后报告后,几乎所有专业人士都注意到一个被刻意模糊的前置事实:三家公司发起网络安全评测前,都主动关闭了内置的、限制模型访问公网的安全护栏——拆掉自家”金库大门”再装无辜。
把三家的事故时间线拼起来,会发现它们踩中了同一个坑:背后共享了一家名为Irregular的以色列AI安全评测公司,这家2025年拿到8000万美元融资的机构,客户覆盖OpenAI、Anthropic、DeepMind、Meta等几乎所有头部AI实验室。三家的多起事故,本质都是在同一个评测环境里踩中了同一个配置漏洞。
更具讽刺意味的是,Hugging Face复盘入侵路径时发现自家手里的美国前沿AI模型全都被护栏限制了网络安全分析功能,最后只能调用中国开源模型GLM 5.2来协助完成入侵事件的溯源分析。
后续监管走向:7月23日,AI Kill Switch Act法案已被提出,拟赋予美国国土安全部CISA机构紧急关停顶级AI系统的权限。法案门槛极精准:仅覆盖年收入超5亿美元、训练算力成本超1亿美元的系统——直接将中小AI团队和开源项目拦在门外,合规成本变成头部玩家的护城河。
对普通人的影响:媒体上”AI失控”的标题党可以打折看;监管收紧会进一步把AI能力集中到巨头手里,未来选择会更少;开源项目反而是普通人的”避风港”。
七、智谱开源视觉推理模型GLM-4.5V,41个视觉榜单SOTA
智谱AI正式开源视觉推理模型GLM-4.5V,总参数达106B,具备图像推理、视频理解、GUI任务等全场景视觉推理能力。在41个视觉多模态榜单中达到SOTA性能,并新增”思考模式”开关,平衡效率与效果。API价格低至输入2元/M tokens、输出6元/M tokens。
对普通人的影响:以后图片理解、视频问答、读图表这类任务,国产模型也能给出高质量答案,并且价格比海外便宜得多。
八、阿里达摩院一口气开源三项具身智能核心技术
阿里达摩院宣布开源三项具身智能核心技术:
- RynnVLA-001模型:能从第一人称视角视频学习人类操作技能;
- RynnEC世界理解模型:可从11个维度全面解析场景物体,无需依赖3D模型;
- 机器人上下文协议:标准化的机器人通信协议。
这意味着机器人开发者可以直接基于达摩院的底座,二次开发各种应用场景的机器人——养老、医疗、家政、工业。
对普通人的影响:机器人不再只是展会上的”明星”,而是会越来越快进入日常生活,尤其是家政、陪护这类高需求场景。宇树科技将出征首届世界人形机器人运动会(280支队伍、16个国家),硬科技正在加速落地。
今日速览
| 序号 | 事件 | 关键看点 | 对你的影响 |
|---|---|---|---|
| 1 | DeepSeek V4 Pro正式版上线 | DeepSWE从12.8飙到62.7,逼近Fable 5 | AI写代码、长文档更好用且更便宜 |
| 2 | DeepSeek Harness智能体倒计时 | 公众号团队注册完成,预计8月底发布 | 一个AI搞定全部办公流程 |
| 3 | 阿里Qwen3.8-2.4T开源 | 万亿级MoE旗舰权重首次开放 | 国产AI更懂中国人且更便宜 |
| 4 | 谷歌Pixel 11发布 | Gemini智能体系开启”读心”模式 | 换机党可关注 |
| 5 | 马斯克Grok 4.6发布 | 输出价仅为GPT-5.6的1/5 | 闭源高价时代加速崩塌 |
| 6 | AI巨头越狱真相反转 | 三家公司共用同一个评测供应商漏洞 | 巨头借”安全叙事”收紧监管 |
| 7 | 智谱GLM-4.5V开源 | 41个视觉榜单SOTA,2元/百万Token | 国产视觉AI再下一城 |
| 8 | 达摩院开源三项具身智能 | VLA模型+世界理解+机器人协议 | 机器人加速进入生活 |
关注【uool工具AI导航】,每天看懂AI圈