8月4日AI重磅|Grok能看懂视频还抓Deepfake、10美元做出《指环王》3D世界、欧盟强制AI”自曝身份”——8件大事看懂AI圈

8月4日凌晨,AI圈没有休息。Grok突然宣布能看懂任意视频,还能鉴别Deepfake;AI大神Karpathy只花了10美元,就让大模型写出一个可玩的《指环王》3D世界;谷歌地球因为AI生图造假风险,上线不到两天就紧急下架。与此同时,欧盟AI法案最重磅的透明度条款正式生效,中美AI价格战进入白热化,Hugging Face CEO公开承认中国在开源模型上已占据主导。今天的AI圈,技术狂奔、监管收紧、竞争加剧三条线同时上演,信息量极大。

一、Grok学会”看视频”:不仅能总结,还能揪出Deepfake

马斯克旗下xAI的Grok迎来重大升级——现在可以直接分析任意视频。官方放出的演示中,Grok能识别一段63秒的科比Deepfake视频,画面逼真到普通人几乎分辨不出真假;它还能在几十秒内给长视频生成摘要,甚至读懂没有字幕的数学科普动画。

更值得关注的是,Grok不仅能判断”这是不是假的”,还能尝试追溯这条Deepfake是用哪个模型生成的。这相当于给视频装了一个”AI基因检测仪”。

对普通人意味着什么? 以后你刷到的短视频、新闻画面、社交媒体上的”现场画面”,可能越来越真假难辨。Grok这类工具就像给你的眼睛配了一副”防骗眼镜”,帮你识别哪些画面是AI伪造的。不过技术人员也提醒,Grok目前主要依赖视频字幕和音频,逐帧画面理解还不够稳,偶尔会”看走眼”。所以短期内,它更像一个辅助判断工具,而不是绝对权威的鉴真官。

二、10美元让AI做出《指环王》3D世界:程序员的活儿也被抢了?

AI大神Andrej Karpathy做了一次惊人实验:他给Anthropic的Opus 5约100万Token的预算(成本约10美元),要求它用Three.js把《指环王》开篇文字做成一个可交互的3D场景。结果模型自主运行了近两小时,写出约5500行代码,完成了资产建模、坐标摆放和镜头动画。

成品虽然还比较粗糙,但真的能玩、能交互。Karpathy感叹:未来大模型可能会像”按需生成临时虚拟世界”一样,你描述一个场景,AI就帮你搭出来。

对普通人意味着什么? 这件事最直观的冲击是:做游戏、做3D场景、做虚拟展厅的门槛,正在被AI压到接近零。以前需要一个团队干几周的工作,现在10美元、两小时就能做出雏形。对创作者和小团队来说,这是巨大的机会;对纯执行型程序员和初级设计师来说,则需要尽快转向创意策划、产品定义这些AI暂时还替代不了的环节。

三、谷歌地球AI生图”翻车”:上线两天就下架

谷歌上周把Nano Banana 2图像生成模型接入了Google Earth网页版,用户输入一句话就能基于卫星和航拍影像生成逼真画面。但功能上线不到48小时,谷歌就紧急撤回了。

问题出在”造假风险”上。记者和BBC很快就用它伪造出核电站、难民营、倒塌的埃菲尔铁塔等虚假场景,看起来和真实地图截图几乎没有区别。虽然谷歌声称生成内容带有SynthID隐形水印,但截图转发后水印基本失效,外部检测工具也很难识别。

对普通人意味着什么? 这是一个非常重要的信号:当AI把虚构内容塞进”公共参考系”(比如地图、新闻、百科)时,危害不只是”有人信假”,更会让人逐渐不再相信真实。以后你看到任何地图截图、现场照片、新闻画面,都要多留一个心眼,尽量交叉验证来源。辨别真伪,正在成为数字时代的基本生存技能。

四、腾讯E-Bench发布:国产AI开始卷”靠谱度”

腾讯混元联合清华、东南大学推出了一个智能体评测基准E-Bench,专门考核AI在真实App里完成多步任务的能力。测试场景以王者荣耀、QQ音乐、腾讯会议等真实应用为原型,包含323个需要”改状态”的任务,覆盖7.6万余行数据。

测试结果很有意思:11个前沿模型的平均成功率只有54.56%,最强的也只达到73.79%。研究团队发现,当前AI智能体最大的瓶颈不是”会不会做”,而是“靠不靠谱”——在海量干扰信息下,模型最常见的失败模式是”过早行动”,还没搞清楚状况就急着点按钮。

对普通人意味着什么? 现在很多人期待AI能自动帮自己订外卖、回邮件、管日程,但E-Bench告诉我们:AI离”放心交给它办事”还有一段距离。腾讯混元的Hy3模型在这次评测中展现了很好的性价比,说明国产AI正在从”跑分好看”转向”真正好用”。对普通用户来说,这意味着未来一两年,手机里的AI助手会变得越来越可靠。

五、AI价格战白热化:OpenAI降价80%,中国模型逼宫硅谷

8月初,全球AI价格战进入新阶段。OpenAI把旗下基础模型ChatGPT 5.6 Luna的价格下调了80%,中端模型5.6 Terra降价20%。在此之前,谷歌已经推出更便宜的Gemini 3.6 Flash和3.5 Flash-Lite,Anthropic也在同价位用更强的Claude 5.0替换了原来的Opus 4.8。

这场价格战的直接推手是中国模型。月之暗面的Kimi K3、深度求索的V4 Flash等国产模型,以接近顶尖的性能和更低的成本,让西方巨头不得不跟进降价。报告甚至指出,埃隆·马斯克的xAI这类”AI布道者”也开始收缩技术应用、控制成本。

对普通人意味着什么? 高性能AI正在从”奢侈品”变成”日用品”。无论是企业采购还是个人使用,调用AI的成本都在快速下降。你可以用更少的钱,调用更强的模型、处理更多的内容。但也要注意,价格战背后是大厂利润被压缩,未来行业可能会加速洗牌,一些小厂商可能撑不下去。

六、Hugging Face CEO:中国已主导开源模型,年底或赶超美国

全球最大开源AI模型平台Hugging Face的CEO Clément Delangue在接受CNBC采访时直言:“中国目前在开源模型领域明显占据主导地位,以当前进展速度,我不会惊讶他们在今年底或明年初开始在前沿模型领域也占据主导。”

他认为,中国AI生态的优势在于开放协作、积极共享——大量模型被公开上传、改进和复用;而美国主要模型厂商则倾向于”各自在孤岛中开发”,资源和成果封闭在内部循环里。这种结构差异正在拉大双方在开源赛道上的差距。

对普通人意味着什么? 开源模型越多,普通开发者和创业者能用到的”免费高级AI”就越多。中国主导开源赛道,意味着中文AI生态会越来越繁荣,中文理解、本土场景适配都会更好。对普通用户来说,最直观的感受就是:国产AI工具越来越聪明、越来越便宜、越来越好用。

七、欧盟AI法案第50条生效:和AI聊天,它必须告诉你”我是机器”

8月4日,欧盟《人工智能法案》第50条透明度规则正式生效。这意味着,所有在欧盟市场提供AI服务的公司,都必须明确告知用户”你正在和机器互动”。聊天机器人、虚拟助手、生成式AI工具,都要在交互中给出清晰提示;用深度合成技术生成的内容,也必须进行标注。

这一规则不仅适用于欧盟本土企业,也适用于所有在欧盟境内提供服务的外国公司。包括OpenAI、谷歌、微软等在内的科技巨头,都需要更新产品设计和用户界面。

对普通人意味着什么? 这是全球AI监管的重要一步。以后你在欧洲使用ChatGPT、Gemini等产品时,会看到更明确的”这是AI生成”提示。这不仅能减少误导,也有助于建立公众对AI的信任。对中国用户来说,虽然法规不直接适用,但全球科技巨头往往会统一调整产品,未来我们可能也会看到更透明的AI标识。

八、商汤SenseNova U1.5-Lite开源:手机也能跑的”多模态小钢炮”

商汤科技开源了统一多模态模型SenseNova U1.5-Lite-Preview,基于NEO-Unify架构,规模只有8B-MoT(约80亿参数),却原生支持4K图像生成和编辑。相比上一代U1,新模型在纹理质感、中英文字渲染、复杂版式理解和图像编辑稳定性上都有明显提升。

多项基准测试显示,U1.5-Lite的效果已经能比肩一些商用闭源模型。而且因为它体积小,未来很可能直接跑在手机、平板等终端设备上。

对普通人意味着什么? 大模型正在从”云端大脑”变成”本地助手”。像U1.5-Lite这样的小模型,意味着以后你的手机可能不需要联网,就能生成海报、修图、做设计。隐私更好、响应更快、还不费流量。对内容创作者和电商卖家来说,随时随地用AI做图将成为常态。

📊 今日AI事件速览

事件核心看点影响评级
Grok视频分析能力可总结视频、鉴别Deepfake并溯源模型⭐⭐⭐⭐⭐
Karpathy 10美元生成3D世界Opus 5自动写出5500行代码,做出可玩3D场景⭐⭐⭐⭐⭐
谷歌地球AI生图下架上线不到两天,因造假风险紧急撤回⭐⭐⭐⭐
腾讯E-Bench发布国产智能体评测基准,暴露”过早行动”等可靠性瓶颈⭐⭐⭐⭐
AI价格战白热化OpenAI降价80%,中国模型逼宫硅谷⭐⭐⭐⭐⭐
Hugging Face CEO表态中国主导开源模型,年底或赶超美国前沿模型⭐⭐⭐⭐⭐
欧盟AI法案第50条生效AI必须明确告知用户”我是机器”⭐⭐⭐⭐
商汤U1.5-Lite开源8B小模型支持4K生成编辑,可跑终端⭐⭐⭐⭐

如果把今天的AI圈串起来看,三条主线非常清晰:第一,AI的能力边界继续扩张——从看懂视频到生成3D世界,从云端大模型到终端小模型,AI正在渗透越来越多的创作场景;第二,AI治理同步收紧——欧盟法案生效、谷歌地球因造假下架,说明技术跑太快时,安全护栏必须跟上;第三,中国AI的全球话语权持续上升——无论是开源模型主导、价格战倒逼巨头降价,还是评测标准的话语权,国产AI已经从”参与者”变成”规则影响者”。

关注【uool工具AI导航】,每天看懂AI圈。

© 版权声明

相关文章

暂无评论

暂无评论...