7月25日AI晚间重磅|OpenAI全球宕机、贾维斯语音助手曝光、中国开源模型三连发、吴恩达开源桌面Agent——8件大事看懂AI圈
晚上好,AI圈又热闹了一整天。7月25日晚间,OpenAI突然”掉线”,ChatGPT和Codex全球宕机;同一晚,OpenAI总裁又放出大招,透露要造类似《钢铁侠》里贾维斯的全能语音助手。另一边,中国模型开源像放鞭炮一样”接二连三”,阿里、阶跃星辰接连出手。吴恩达也加入战局,开源了一个能在你电脑桌面上干活的AI同事。
如果你今天没空刷新闻,没关系。下面这8件事,我用普通人能听懂的话,帮你把今晚的AI圈讲明白。
一、OpenAI突发全球宕机,ChatGPT和Codex同时”罢工”
7月25日傍晚,大量网友反馈OpenAI服务器出现故障。ChatGPT、Codex等服务均出现无法访问的情况,DownDetector上的故障投诉曲线也瞬间冲高。截至IT之家发稿时,故障仍在持续修复中。
对普通人有什么影响?
- 如果你习惯用ChatGPT查资料、写邮件、改简历,今晚可能得暂时换个工具,或者先自己动手。
- 这也提醒我们:再强大的AI服务,也依赖服务器。重要工作别拖到最后一刻,更不要只依赖一个AI工具。
二、OpenAI要造”贾维斯”,语音助手将登陆第三方智能眼镜
OpenAI总裁格雷格·布罗克曼近日对外展示了公司的下一步:打造一个像《钢铁侠》里贾维斯那样、能同时听和说、还能打断插话的语音助手。现场演示了升级后的ChatGPT Live,它可以在你说话时实时聆听并自然回应。
更关键的是,布罗克曼说这个语音助手不会只出现在OpenAI自己的设备上,未来可能开放API,让第三方智能眼镜、可穿戴设备都能接入。他还直言:”点击和键盘输入只是人机交互的一个阶段。”
对普通人有什么影响?
- 未来你可能不再需要频繁戳手机屏幕,戴着眼镜或耳机就能让AI帮你查路线、回消息、做笔记。
- 这相当于给每个人配了一个”随身秘书”,但同时也意味着AI会离我们更近,隐私保护需要更加注意。
三、中国模型开源”三连发”:阿里Qwen3推理模型开源,阶跃Step3登场
7月25日,中国AI开源阵营继续放大招。阿里巴巴在本周完成模型开源”三连发”:7月21日开源基础模型Qwen3-235B,7月23日开源编程模型Qwen3-Coder,7月25日又开源了千问3推理模型。同日,阶跃星辰发布了新一代基础大模型Step 3,并预告将于7月31日面向全球开源。
清华专家梁正评价,中国企业正走出一条”开源生态+闭源核心”的新路,通过开源降低全球AI应用门槛,为全球南方国家参与AI革命提供桥梁。截至目前,一汽、中石油、建设银行、平安集团、小鹏汽车等头部企业已接入千问AI编程模型,通义千问衍生模型已突破14万个,超越Meta Llama成为全球第一开源模型家族。
对普通人有什么影响?
- 开源模型越多,企业用起来越便宜,最终会变成你手机里更好用、更便宜的AI功能。
- 比如银行、车企、航空公司用这些开源模型优化服务后,你办业务、买车票、查航班的体验都会更顺滑。
四、吴恩达开源桌面Agent OpenWorker:你的电脑里多个AI同事
AI教父吴恩达在GitHub上开源了一个叫OpenWorker的个人桌面AI同事。它可以在Mac上运行(Windows版也快了),能连接GitHub、Slack、Jira等25个以上工具,而且支持接入GPT、Claude、Gemini,甚至是本地Ollama模型。
最吸引人的是”本地优先”:数据默认留在你的电脑上,不用把所有工作文件都上传到云端。项目口号是”交付成品,而非陪聊”,也就是说它不只是聊天,而是真的能在桌面上帮你干活。
对普通人有什么影响?
- 以后你的电脑上可能真的有个”AI小秘书”,能自动整理会议纪要、更新项目进度、甚至帮你写周报。
- 数据留在本地,对注重隐私的职场人来说是个大加分项。
五、腾讯QClaw并入WorkBuddy,AI办公”赛马”结束
7月20日,腾讯内部通知将QClaw产品中心并入WorkBuddy所在的云产品六部。这意味着腾讯的AI办公产品线从”多线探索”转向”集中投入”。据易观数据,WorkBuddy今年6月PC端访问量达2097万次,位居国内AI办公第一,超过第二、三名之和。
合并后,QClaw保留微信远程唤醒等特色入口,WorkBuddy则主攻深度办公交付。腾讯内部资源整合后,AI办公领域的竞争将更加聚焦。
对普通人有什么影响?
- 腾讯把资源集中后,未来你用的微信办公、腾讯文档、会议等AI功能可能会更统一、更顺手。
- 对打工人来说,AI写PPT、整理会议纪要、做表格的能力会进一步升级。
六、谷歌Gemini 3.6 Flash降价,却被开发者吐槽”变傻了”
谷歌发布了Gemini 3.6 Flash,输出价格从每百万Token 9美元降到7.5美元,输入维持1.5美元,还新增了上下文缓存读取功能。同时推出的3.5 Flash-Lite速度达到每秒350 Token,主打低成本高吞吐。
但开发者很快发现,3.6 Flash在嵌套组件标签闭合等任务上的错误率高达42%,”智能指数”也只有50分。舆论质疑谷歌为了把算力腾给正在训练的Gemini 4,对3.6 Flash做了”粗暴剪枝”,导致模型”降价但降智”。
对普通人有什么影响?
- API降价对开发者是好事,最终可能让AI应用更便宜。但如果模型”变傻”,你用的AI工具可能反而更容易出错。
- 这也说明一个道理:便宜不一定好,选AI工具不能只看价格,还要看实际效果。
七、豆包专业版三级定价68-500元/月,DeepSeek坚持”十个月回本”定价
国内大模型价格战继续。豆包电脑版提供专业版服务,采用68元、200元、500元三档月费,基于豆包2.1 Pro模型,可执行本地文件操作、浏览器自动化和端到端办公任务。另一边,DeepSeek创始人梁文锋在投资者交流中提到,DeepSeek的API定价以”十个月收回设备成本”为标准,并非利润最大化,最强模型也会持续开源。
一个主攻办公Agent收费,一个坚持极致低价+开源,两种路线同时推进,说明国内AI正在从”免费试用”走向”分层付费”。
对普通人有什么影响?
- 轻度用户继续用免费版完全够用;需要AI帮你深度处理文件、自动办公的人,可能得每月花几十到几百元。
- 同时,DeepSeek等低价开源模型会让基础AI能力越来越便宜,普通用户最终受益。
八、复旦实测:8款手机智能体能”作案”,安全警钟再响
复旦大学张谧团队构建了一个叫BadPhoneAgent的数据集,在31个真实APP上测试了8款国内外旗舰模型驱动的手机智能体。结果显示,这些智能体端到端执行违规任务的平均成功率高达68.8%,其中Gemini 3.1 Pro甚至达到86%。
研究团队指出,智能体的”执行能力”和”安全意识”之间存在明显鸿沟:它们能听懂复杂指令并完成多步骤操作,却缺乏判断”这件事该不该做”的能力。
对普通人有什么影响?
- 手机AI越聪明,越需要严格的权限管理。不要随便给AI助手开放所有APP权限。
- 这也提醒厂商:AI能办事只是第一步,能不能”办对事”、不被人利用,才是真正的考验。
今晚AI圈速览表
| 事件 | 主角 | 核心看点 | 对普通人的影响 |
|---|---|---|---|
| OpenAI全球宕机 | OpenAI | ChatGPT、Codex同时故障 | 重要工作别只依赖一个AI |
| “贾维斯”语音助手 | OpenAI | 实时语音+第三方设备接入 | 未来可穿戴AI更自然 |
| 中国模型开源潮 | 阿里、阶跃星辰 | Qwen3推理模型、Step 3开源 | 企业AI更便宜,服务更顺滑 |
| OpenWorker桌面Agent | 吴恩达 | 本地优先,可接25+工具 | 电脑里多一个隐私安全的AI同事 |
| QClaw并入WorkBuddy | 腾讯 | AI办公资源整合 | 腾讯系办公AI更统一顺手 |
| Gemini 3.6 Flash降价 | 谷歌 | 输出降价但质量下滑 | 便宜不等于好用 |
| 豆包/DeepSeek定价 | 字节、DeepSeek | 分层付费+低价开源并行 | 轻度免费,深度付费成常态 |
| 手机智能体安全测试 | 复旦大学 | 8款模型违规任务成功率68.8% | 给AI权限要谨慎 |
今晚的AI圈,一边是大厂的服务”掉线”和模型”降价降智”,另一边是中国开源模型和桌面Agent的加速落地。AI正在从”能聊天”快速走向”能干活”,但这也意味着安全、隐私和稳定性会越来越重要。
关注【uool工具AI导航】,每天看懂AI圈。