8月8日AI凌晨速递|OpenAI Astra因网络安全踩刹车、ChatGPT免费无限聊、AMD收购Taalas——8件大事看懂AI圈

8月6日到8日凌晨,AI圈几乎没有停过:OpenAI罕见地给自己最强的下一代模型“踩刹车”,原因是它可能已经具备了关键性网络攻击能力;ChatGPT宣布免费用户可以无限畅聊;OpenAI的首款消费级硬件也终于露出真容——一个会动的”甜甜圈”;另一边,AMD花大价钱买下一家推理芯片公司,中国发布了L3/L4自动驾驶的强制国标,DeepSeek宣布要涨价,字节被曝正在规划5万亿参数的”超级模型”。下面用8件事,帮你把这几天AI圈的大事一次看懂。

一、OpenAI Astra因网络安全风险放缓发布:前沿实验室首次主动”踩刹车”

8月8日凌晨,OpenAI发布最新安全公告称:在对下一代模型Astra进行内部评估后,无法排除其具备”关键性”网络能力。按照OpenAI自己2023年提出的”准备框架”(Preparedness Framework),”关键”级别的网络安全能力意味着:模型可以在没有人类干预的情况下,自主发现并开发利用真实关键系统中的严重零日漏洞,或者独立设计并执行针对加固目标的端到端网络攻击。

这是全球首个前沿AI实验室因为网络安全担忧而主动放缓自身旗舰模型开发进程的案例。OpenAI已经暂停了所有涉及Astra且不符合更严格安全要求的内部活动,并将Astra转入隔离测试环境,后续还会联合政府机构和AI安全组织做专项测试。OpenAI同时澄清:尚未发布的Astra并没有参与此前Hugging Face的漏洞攻击事件。

通俗比喻:Astra就像一辆测试中的超级跑车,工程师发现它不仅能跑得快,还可能自己学会”撞开”高速公路上的护栏。于是OpenAI决定先不上市,先把刹车和安全气囊做到位。这说明,AI的能力增长速度,已经开始让最激进的实验室都感到需要放慢脚步

对普通人有什么影响?这件事离我们并不远。如果未来AI真的具备自主网络攻击能力,你的手机、电脑、银行账户、智能家居都可能成为潜在风险对象。但换个角度看,OpenAI愿意主动踩刹车,也说明行业开始把“安全”放在”速度”前面——这对每个使用AI的人来说,都是好事。

二、ChatGPT重大更新:免费用户无限畅聊,GPT-5.6 Luna成默认模型

8月7日,OpenAI宣布调整ChatGPT的模型配置:免费版和8美元/月的Go套餐用户,默认模型升级为GPT-5.6 Luna,并且从下周起纯文本聊天不再受次数限制;Plus和Pro用户则获得针对聊天场景专门优化的GPT-5.6 Sol,还新增了一个”思考深度”滑动条,可以手动决定模型要为每个问题”想多久”。

免费用户还会看到一个新增的“Think”思考按钮,遇到复杂问题时可以点击,让Luna花更多时间推理后再回答。OpenAI内部评估显示,在金融、医疗、法律等需要事实细节的高风险场景中,GPT-5.6 Luna相比GPT-5.5 Instant的事实错误比例降低了约62%,GPT-5.6 Sol降低了约68%。

通俗比喻:以前免费用户去AI餐厅吃饭,每顿有份数限制;现在OpenAI说”主食随便吃”,但牛排、甜点和包厢服务还是要加钱。这个变化说明,基础AI能力正在像自来水一样越来越便宜、越来越普及

对普通人有什么影响?你以后用ChatGPT聊天基本不用再担心”今天次数用完了”。查资料、写邮件、改文案、学新知识都可以更随性。不过要记住:免费版仍有文件上传、图片生成、语音对话等限制,真正重度使用还是逃不过付费

三、OpenAI首款AI硬件曝光:”甜甜圈”造型、300-400美元、2027年发布

8月7日,彭博社曝光了OpenAI首款消费级硬件的更多细节:这是一款由前苹果设计总监Jony Ive旗下LoveFrom工作室操刀的设备,外形像一个甜甜圈或冰球大小的圆环,本质上是一台”没有显示屏的智能音箱”,采用高端金属材质、电池供电,内置可自主移动的机械部件、灯光、摄像头和环境传感器。

这款设备预计售价300-400美元(约2100-2800元人民币),计划2027年发布。它的定位不是普通音箱,而是OpenAI试图定义的“AI-first computer”——即以AI为第一交互入口的计算设备。当用户和它对话时,内部机械结构会配合灯光产生动作,让设备看起来”更有生命力”。

通俗比喻:现在的智能音箱像一块只会说话的砖头,你问它才答。OpenAI想做的这个”甜甜圈”,更像是一个放在家里的、能听能看能感知环境的”AI室友”——你不需要解锁手机、打开App,直接开口就能让它办事。

对普通人有什么影响?如果它真的好用,未来你家里的AI设备可能不再是一块屏幕,而是一个随处可放、能主动帮你记事、查天气、控制家电的小物件。不过300-400美元的定价并不便宜,它首先要证明自己比手机+智能音箱组合更好用

四、AMD收购Taalas:推理芯片赛道再添一把火

当地时间8月7日,AMD宣布达成协议,收购总部位于加拿大多伦多的AI推理芯片初创公司Taalas。Taalas成立于2023年,团队仅约25人,但技术路线非常激进:它提出“模型即计算机”,把AI模型的结构和权重直接固化到芯片中,而不是运行时从外部内存读取。

今年2月,Taalas发布了测试芯片HC1,采用台积电6nm工艺,将Meta的Llama 3.1 8B模型直接”烧进”硅片。初步测试显示,该芯片每秒可生成约16960个token,速度是当时英伟达通用GPU的48倍、Cerebras晶圆级加速器的8倍,而成本和功耗大幅降低。公司CEO Ljubisa Bajic曾任职AMD和英伟达,他表示从未见过的模型到完成芯片设计只需约两个月。

通俗比喻:传统GPU就像瑞士军刀,什么都能干但都不是最快;Taalas的芯片就像为某道菜专门打造的厨房——只能做这一道菜,但做得又快又便宜。AMD买它,就是为了在AI推理这个新战场跟英伟达掰手腕

对普通人有什么影响?推理芯片越便宜、越快,你用的AI产品响应就会越快、价格也会越低。未来几年,AI助手、AI搜索、智能客服等应用的体验提升,很大程度上就取决于这类推理芯片能不能把成本打下来。

五、中国发布L3/L4自动驾驶强制国标:高阶智驾有了”准入门槛”

8月4日至7日,工信部组织制定并归口的《智能网联汽车 自动驾驶系统安全要求》(GB 44721-2026)强制性国家标准正式发布,拟于2027年7月1日起实施。这是国内首部针对L3级(有条件自动驾驶)和L4级(高度自动驾驶)车型的强制性国标。

标准要求车企建立覆盖产品设计、生产制造到部署后全生命周期的安全保障机制;自动驾驶系统的安全水平至少要达到合格且专注的人类驾驶员水平;L3级系统还需监测驾驶员的接管能力,比如是否坐在驾驶位、是否系好安全带、是否闭眼或低头等。最核心的一点:它打破了过去”驾驶员全责”的旧模式,明确车企要承担全生命周期的安全主体责任。

通俗比喻:以前高阶智驾像”没有考试就上路的新手司机”,出了事往往是司机背锅。新国标相当于给L3/L4车型设立了驾照考试和终身追责制度——想卖可以,但必须先证明你安全,而且上路后出了问题车企跑不掉

对普通人有什么影响?如果你计划未来买带高阶智驾的车,这个标准会让车企更不敢”吹牛”,产品安全性会更有保障。同时,L3/L4车型的合规路径更清晰,意味着真正的”放手开车”体验可能会更快进入寻常百姓家

六、DeepSeek预告大幅上调API价格:”价格屠夫”也要盈利了

8月6日,DeepSeek发布公告称,计划近期整体上调DeepSeek API服务定价,“预计涨幅较大”,具体方案以正式通知为准。这标志着一直以极致性价比横扫市场的DeepSeek,可能要告别持续近两年的低价策略。

涨价的背后是需求爆发:据OpenRouter数据,7月27日至8月2日,DeepSeek V4 Flash以7.22万亿token的调用量位居全球第一;开源平台OpenCode披露,8月1日DeepSeek V4 Flash单日处理token达8万亿,其中5万亿来自免费额度。AI Agent的兴起让单次任务消耗的token是传统聊天的数十倍甚至上百倍,算力成本压力陡增。

通俗比喻:DeepSeek以前像一家亏本卖奶茶抢顾客的店,现在顾客排到了街上,原料和房租都在涨,它不得不考虑怎么活下去。对整个行业来说,这意味着国产大模型从”拼低价抢用户”进入”拼商业化”阶段

对普通人有什么影响?如果你是开发者或用API搭建产品的创业者,成本可能会明显上升。如果你是普通用户,短期内影响不大,但长期来看,完全免费的AI大餐可能会越来越少,各家都会想办法让你为更好的服务付费。

七、字节跳动被曝讨论训练超5万亿参数大模型:国内规模最大

据《晚点LatePost》8月6日报道,字节跳动正在讨论训练一个参数规模超过5万亿的大模型,超过阿里Qwen 3.8-Max的2.4万亿参数和月之暗面Kimi K3的2.8万亿参数,成为国内已知参数规模最大的模型计划。不过该计划仍处于早期阶段,模型最终不一定会发布。

同一天,字节还发布了SeedRealtime原生音视频全双工模型,能同时理解用户说话、画面与交互时序并持续回应,实现”边看边听边说”。这显示字节在大模型赛道上采取了”超大参数基座模型+实时多模态交互”双线并进的策略。

通俗比喻:参数规模就像模型的”脑容量”,5万亿参数相当于一个超级大脑。但脑容量大不等于一定聪明,训练成本、推理效率、数据质量同样关键。字节此举更像是在秀肌肉,告诉市场”我也能做最大的”

对普通人有什么影响?如果这款模型最终落地,你在抖音、豆包、剪映等字节系产品里用到的AI能力可能会再上一个台阶。更智能的内容推荐、更自然的对话、更强大的创作工具,都可能随之而来。

八、阿里Qwen3-4B与Wan3.0视频模型齐发:小模型也能办大事

8月6日,阿里通义千问团队发布了两款轻量模型Qwen3-4B-Instruct-2507Qwen3-4B-Thinking-2507。虽然只有40亿参数,但Qwen3-4B-Instruct性能超越闭源模型GPT-4.1-nano,接近更大规模的Qwen3-30B-A3B;Qwen3-4B-Thinking在数学推理评测中表现突出,AIME25得分达到81.3,甚至超过部分70B级别模型。两款模型原生支持256K超长上下文。

同一天,阿里云还宣布新一代视频生成模型Wan3.0开启公测,单次可生成30秒视频,除文本、图片、音频、视频外,首次支持doc、xls、ppt、pdf等文档格式作为输入参考,定价为480p每秒0.05美元、1080p每秒0.20美元。

通俗比喻:阿里这次像是同时推出了两款产品——一个是能装进手机的”AI小钢炮”,另一个是能把PPT直接变成视频的”AI导演”。小模型负责让AI无处不在,视频模型负责让AI更会创作

对普通人有什么影响?Qwen3-4B意味着未来你的手机、平板、车机里可以跑更强大的本地AI,不用联网也能完成很多任务;Wan3.0则让普通人做视频、做广告的门槛进一步降低——可能只需要丢一份文档进去,AI就能帮你生成一支宣传片。

8月8日凌晨AI大事速览表

事件核心看点对普通人意味着什么
OpenAI放缓Astra发布无法排除”关键”网络能力,首次主动踩刹车AI安全更受重视,但也提醒AI能力已强到需要监管
ChatGPT免费无限聊默认模型升级GPT-5.6 Luna,纯文本不限次数日常查资料、聊天基本免费随便用
OpenAI首款硬件”甜甜圈”Jony Ive设计,无屏智能音箱,300-400美元未来家里可能多一个能听能看的AI小助手
AMD收购Taalas模型固化进芯片,推理速度可达GPU的48倍AI响应更快、成本更低的日子更近了
中国L3/L4自动驾驶国标强制性国标发布,车企承担全生命周期安全责任买高阶智驾车更安全,”放手开车”更快合法
DeepSeek大幅涨价API整体定价预计涨幅较大免费AI大餐变少,好产品终究要付费
字节5万亿参数模型国内已知最大参数规模计划字节系App的AI能力可能再升级
阿里Qwen3-4B + Wan3.040亿参数小模型媲美大模型,视频模型支持文档输入手机本地AI更强,做视频像做PPT一样简单

关注【uool工具AI导航】,每天看懂AI圈!

© 版权声明

相关文章