8月22日AI午报|智谱GLM-5.3登顶编程、Grok一句话做App、豆包上线200+技能——8件大事看懂AI圈

8月22日AI午报|智谱GLM-5.3登顶编程、Grok一句话做App、豆包上线200+技能——8件大事看懂AI圈


中午好,今天上午(截至8月22日中午)AI圈又悄悄发生了一串大事。国内智谱、商汤、字节轮番放大招,海外xAI、Anthropic也没闲着,还冒出一个”蒙面学霸”模型搅动格局。我们挑了8件最有分量的,用大白话给你讲清楚——每个都附带”对普通人有什么影响”。

一、智谱 GLM-5.3 发布:国产模型在”找bug”上拿第一

智谱发布了专门写代码的模型 GLM-5.3。在一个叫 CyberGym 的”漏洞识别”基准测试里,它拿下了 84.5% 的成绩,略微超过了 Anthropic 的 Mythos 5 和 OpenAI 的 GPT-5.6 Sol。它在 269 个真实项目里找出了 2436 个安全漏洞,其中 1097 个属于中高危级别。模型权重预计两周后开放,千问 AI 平台已经率先上线。

打个比方:这就像一场”改错题”竞赛,GLM-5.3 是那个最细心、找茬最准的学霸。它专门帮程序员挑出代码里藏着的”后门”和隐患。

对普通人有什么影响? 你平时用的国产 AI 写代码、做网站会更靠谱;企业用得上、用得起,最后落到咱们手里的工具更便宜、更稳。

二、xAI 的 Grok Build 全量上线:说一句话,应用就做好了

马斯克旗下的 xAI 把 Grok Build 向所有套餐用户开放了,网页、iOS、安卓都能用。你只要用大白话描述想要什么——比如”做一个房贷计算器”——它就在聊天框里实时生成一个能直接运行的网页应用,点发布就能拿到一个 grok.me 链接发给别人用。它还能调用 Grok 的对话、画图、语音能力,支持别人”二创”(Remix),也能一键导出到 GitHub 继续开发。

打个比方:就像点外卖——你只说一句”来份红烧肉”,后厨(代码)自动做好送到你面前,不用你自己下厨。

对普通人有什么影响? 不会写代码,也能做出小工具、小游戏分享给朋友。不过要提醒一句:Grok 和 X 在国内的访问需要额外的网络条件,实际门槛更多在”网线之外”。

三、商汤开源 SenseNova-U1.5 Lite:小模型也能干”重活”

商汤开源了一款只有 80 亿参数(8B)的轻量多模态模型 SenseNova-U1.5 Lite,原生支持 3–4K 上下文,还能做 4K 画质输出,覆盖文档理解、OCR、图表分析、视觉编辑等任务,并且开放了权重。

打个比方:以前要开大卡车(巨型大模型)才搬得动的活,现在一辆小面包车(8B 模型)也能干,还更省油。

对普通人有什么影响? 这种小模型能直接在手机、笔记本上跑,既便宜又保护隐私,中小企业和开发者做 AI 应用的门槛明显降低了。

四、字节豆包上线”技能·连接器·工作伙伴”

8月21日,豆包的”工作任务”模式上新了”技能·连接器·工作伙伴/小队”。打开豆包电脑版侧边栏就能体验,目前已上架超过 200 个技能和连接器,还支持自己新建技能。

打个比方:像给 AI 装了个”技能栏”——点一下就能调用 200 种现成本领,就像手机装 App 一样简单。

对普通人有什么影响? 以后用 AI 办事更像”搭积木”,不用再费劲写长提示词,直接挑现成功能就能用,效率高了一大截。

五、Anthropic 给 Claude 加”防伪水印”,反水印工具几小时就现身

为了符合欧盟的监管要求,Anthropic 开始给 Claude 生成的内容打上”统计模式水印”。结果有意思的是,水印上线才几小时,就有开发者发布了专门”去除水印”的工具。

打个比方:就像纸币的防伪水印刚印上,”验钞机”还没普及,”造假术”已经跟着来了——道高一尺,魔高一丈。

对普通人有什么影响? 未来更容易分辨哪些文章、新闻是 AI 写的,对防诈骗、防假消息有帮助。但也别全信”水印”——既然能加也能去,关键还是自己多留个心眼。

六、Claude Mythos 5 进 Claude Security:AI 帮企业”查门缝”

Anthropic 把它最强的模型 Mythos 5 用到了企业安全产品 Claude Security 上(公开测试,面向企业客户)。它能扫描代码库里的漏洞,给出严重等级和分类,还会顺手建议怎么修补。

打个比方:相当于请了个 24 小时不睡觉的”保安”,专门盯着代码里没关好的”后门”和”窗缝”。

对普通人有什么影响? 你用的 App、网站更不容易被黑客钻空子,账号和数据安全多了一层保障。

七、神秘模型 OxAlpha 横空出世:编程成绩把名家都超了

一个匿名模型 “stealth/ox-alpha” 在 8月20日低调上线 OpenRouter,支持文字、图片、视频输入,上下文长达 104.8 万 token。独立测试显示,它在编程基准 DeepSWE 上拿到 80% 的通过率,超过了 Claude Fable 5 和 GLM-5.3;从技术指纹看,高度指向某家还没发布的国产旗舰模型,免费窗口可能持续到 8月27日。

打个比方:考试里突然冒出个”蒙面学霸”,谁都不知道是哪家的,但成绩把一众名校尖子都超了。

对普通人有什么影响? 模型之间的”军备竞赛”越来越白热化,国产模型正快速逼近世界顶尖。竞争越狠,意味着更好、更便宜的 AI 离我们越近。

八、中国大模型出海巴西:华为、科大讯飞参与国家级 AI 基建

巴西政府 8月20日宣布投入约 23 亿雷亚尔加强 AI 基础设施,其中 13 亿用于在里约建设超算中心。华为与科大讯飞将参与开发大语言模型及葡萄牙语专用 AI 模型。科大讯飞上半年境外营收同比增长 160%。

打个比方:就像把”中国厨房”开到了海外,还要按当地口味(葡萄牙语)专门做菜。

对普通人有什么影响? 中国 AI 真正走向世界,长期看国产技术会更受国际认可,相关的产业机会和就业空间也会更多。

今日速览

事件一句话对普通人的影响
智谱 GLM-5.3 登顶编程基准找漏洞最准的国产代码模型国产 AI 写代码更靠谱、更便宜
xAI Grok Build 全量上线说一句话就能做出 App不会代码也能做小工具(需网络条件)
商汤开源 SenseNova-U1.5 Lite80亿小模型也能做4K视觉手机本地跑 AI 更省更隐私
字节豆包上线 200+ 技能给 AI 装”技能栏”用 AI 办事像搭积木一样简单
Claude 加防伪水印AI 内容打标,反水印紧随更易分辨 AI 稿,但别全信
Claude Security 用上 Mythos 5AI 帮企业查代码漏洞用的 App 更安全、少被黑
神秘模型 OxAlpha 超越 GPT-5.6蒙面学霸搅动编程榜国产逼近顶尖,好 AI 更近
中国大模型出海巴西华为、讯飞参与国家级基建国产技术出海,机会更多

关注【uool工具AI导航】,每天看懂AI圈

© 版权声明

相关文章