ChatGPT 与 Gemini 月活均破 10 亿,OpenAI 增长放缓
Google CEO Sundar Pichai 在 X 上宣布,Gemini 每月活跃用户达到 10 亿,成为 Google 历史上增长最快的产品。此前,Google 在 2 月报告 Gemini 月活为 7.5 亿,7 月底财报电话会议中报告为 9.5 亿,上周达到 10 亿。OpenAI 的 ChatGPT 也在 8 月 6 日的博客中确认月活超过 10 亿,但该公司并未高调宣布,且外部数据指出其可能在 6 月就已达到这一里程碑。OpenAI 发言人 Lindsay McCallum 表示,ChatGPT 在 7 月已有 10 亿周活用户,但拒绝透露月活数据。这一对比显示,尽管 ChatGPT 仍是聊天机器人领导者,但其增长速度已明显放缓,而 Gemini 正在快速追赶。
Anthropic 为 Claude 模型全球添加 AI 文本水印,检测工具即将推出
Anthropic 宣布为旗下所有 Claude 模型添加 AI 文本水印技术,覆盖全球用户。该技术通过嵌入不可见标记来追踪 AI 生成内容,检测工具和相关文档将很快提供。不过,公司警告称,水印不能完全确认文本作者身份,也无法彻底排除 AI 使用的可能性。具体水印机制和检测工具的细节尚未完全公布。
Google Gemini 应用月活破 10 亿,63%用户使用语音功能
谷歌 CEO 桑达尔·皮查伊在 X 平台宣布,Gemini 应用月活跃用户数超过 10 亿,成为谷歌第 14 个达到该里程碑的产品,也是增长最快的产品之一。该数字仅统计 Gemini 应用,不包括其他渠道的 AI 用户。谷歌数据显示,63%的 Gemini 用户使用语音功能与助手对话,Gemini 每天生成超过 1.5 亿张图片,iOS 端活跃用户超 1 亿。这一里程碑紧随谷歌 2026 年第二季度财报电话会议,彼时月活超 9.5 亿,日活用户一年内增长三倍。Gemini 已整合进搜索、Workspace、Android 及独立应用,其中搜索 AI 模式月活超 10 亿。谷歌还推出 Gemini 3.5 Flash 等新模型,改进编码和自主 AI 代理任务。
Abbott 与 Google Health 合作,Lingo 血糖监测仪数据接入 Google Health
医疗设备公司 Abbott 宣布与 Google Health 达成多年合作,将其非处方连续血糖监测仪 Lingo 的数据接入 Google Health 应用。用户可在 Google Health 应用中查看代谢数据,并可选与 AI 驱动的 Google Health Coach 共享,以获取个性化的生活方式和营养建议。Lingo 明确面向不使用胰岛素的成年人。作为合作的一部分,双方将开展一项大型真实世界代谢健康研究,整合连续血糖、可穿戴设备、实验室和调查数据,探索活动、睡眠、幸福感与代谢健康之间的联系。该研究可能为个性化健康指导提供依据,但也可能促进 Lingo 设备及 Google Health Premium 订阅的销售。
Reddit 最新研究:美国半数消费者用其验证 AI 推荐,超两成搜索直接加 Reddit
Reddit 发布最新 Path to Purchase 研究,基于美国约 14000 名和英国约 6500 名受访者的调查。数据显示,美国一半的购物者现在通过 Reddit 验证 AI 聊天机器人的产品推荐,英国超过三分之一的人这样做。Reddit 在帮助人们更快做出购买决定方面位列所有社交平台第一,用户更信任 Reddit 来验证 AI 推荐,而非家人或朋友。超过五分之一的购物者在搜索查询中直接加入 Reddit,以获取真人观点。Reddit 表示,这凸显了其作为品牌植入和营销渠道的价值。
Hinge 第三次推出 No Ordinary Love 活动,首推有声书与音频广告触达 Gen Z
约会应用 Hinge 连续第三年推出品牌活动“No Ordinary Love”,讲述平台上真实情侣的爱情故事。今年活动首次推出有声书形式,这是为应对年轻受众对音频内容日益增长的兴趣。有声书将在 Spotify 和 Libby 等平台发布,由新老作家创作,包括播客联合主持人 Hunter Harris 和小说家 Rufi Thorpe。活动主题围绕在恋爱早期分享感受的价值,灵感来自 Hinge 2025 年 Gen Z D.A.T.E. 报告,该报告发现许多 Gen Z 单身人士害怕被拒绝和评判。为推广有声书,Hinge 制作了其首个音频广告,并在纽约和伦敦投放户外广告。真实情侣录制了画外音,将在 TikTok 和 Instagram 上发布,并在每则有声书故事结尾提供尾声。同时,书面故事仍保留在品牌的 Substack 上,因为去年故事的评论互动率很高。Hinge 希望通过多渠道内容提升品牌考虑度并塑造品牌形象。
美上诉法院驳回社交媒体平台基于 230 条款的诉讼豁免请求,数千起未成年人成瘾诉讼将继续推进
美国旧金山第九巡回上诉法院驳回了 Meta、TikTok、Snapchat 和 Google 等社交媒体平台试图依据《通信规范法》第 230 条豁免未成年人成瘾诉讼的请求。这些平台主张第 230 条的保护范围涵盖其未就成瘾性设计向公众发出警告的责任,但法院认为上诉时机过早,此类上诉通常应在审判后提出。这些由个人、州和地方政府及学区提起的数千起诉讼已合并为一项联邦诉讼,将继续推进。此前 Meta 已在两起类似诉讼中败诉,成为陪审团审判中首次因儿童安全问题被追究责任的平台。
YouTube 提高创作者变现门槛:需 8000 小时观看或 2000 万 Shorts 播放量
YouTube 周一宣布,自 2026 年 2 月 1 日起,新创作者加入 YouTube 合作伙伴计划的门槛将翻倍:过去一年需累计 8000 个合格观看小时,或过去 90 天内获得 2000 万次合格的 Shorts 观看次数。此前要求为 1000 订阅者加 4000 小时观看,或 1000 订阅者加 1000 万 Shorts 观看。现有成员不受影响。此外,Shorts 创作者需在 90 天内保持 1000 万次观看才能通过 Shorts 创作者池获得收入,低于该门槛的频道仍可在长视频中变现,但 Shorts 收入将暂停,直到重新达标。YouTube 称此举是为了适应平台增长,目前每日 Shorts 观看量超 2000 亿次,电视端日观看时长超 10 亿小时。新规将使新创作者更难进入变现体系,也可能减少成功变现的新频道数量。同时,YouTube 将 Premium Lite 订阅扩展到所有提供 Premium 的地区,创作者可按观看时长和浏览量分得订阅收入,其中长视频创作者分得 55%,Shorts 创作者分得 45%。
尼尔森 22 亿美元收购 DoubleVerify,广告独立测量市场洗牌引争议
尼尔森宣布以 21.5 亿美元收购广告验证与测量公司 DoubleVerify,距私募股权公司 Novacap 以 19 亿美元收购其竞争对手 Integral Ad Science(IAS)仅不到八个月。此次交易将使尼尔森的受众数据与 DoubleVerify 的广告质量和品牌安全验证工具结合,为广告主提供更统一的测量视图。同时,尼尔森还将获得 DoubleVerify 旗下的 Rockerbox,一款多渠道归因和营销组合模型平台,有望增强其结果测量能力。行业人士指出,媒体碎片化加剧使得独立测量需求迫切,但测量提供商的整合引发了对谁将成为“真相仲裁者”的担忧,可能影响广告主对跨平台效果的客观评估。
Meta 发布开源模型 Muse Glimmer,本地运行 AI 代理,推进扎克伯格个人超级智能愿景
Meta 于 8 月 10 日发布开源模型 Muse Glimmer,该模型为开放权重,参数量达 300 亿,支持文本和图像,训练覆盖 100 多种语言,可在配备单张消费级 GPU 的 Mac 或 PC 上本地运行 AI 代理。Glimmer 能执行多步骤任务,如调用工具、编写调试代码、处理文件和截图,支持长时间工作流,并设计为始终在线,可在无网络连接时运行。其权重基于 Apache 2.0 许可证发布,开发者可自由下载和修改。Meta 表示,Glimmer 可用于管理日程、起草消息、整理文件等涉及个人数据的任务,通过本地处理增强隐私保护。该模型被视为 Meta 最强大的封闭模型 Muse Spark(4 月发布)的开源版本,反映了 CEO 扎克伯格关于广泛分发超级智能、使个人获得 AI 能力的愿景。
OpenAI 推出 GPT-5.6 Sol 助力金融工作,自动生成可追溯 PPT 和 Excel
OpenAI 发布 GPT-5.6 Sol 模型,面向金融专业人士,支持从研究分析到制作可编辑、可追溯的 PowerPoint 演示文稿和 Excel 工作簿的完整工作流程。该模型能处理复杂财务数据,自动生成结构清晰的报告和图表,帮助用户快速完成金融分析任务。OpenAI 尚未公布具体价格和可用区域,但预计将通过 API 向开发者开放。
苹果智能手表未来或推无屏幕机型及更多尺寸,陶瓷版 2026 年回归
苹果正计划对 Apple Watch 进行重大改版,但尚未确定具体方向。即将推出的 Series 12 和 Ultra 4 不会有太大变化,但苹果正在探索多种设计方案,包括无屏幕设备、不同类型的屏幕和多种尺寸,以应对 Whoop 等无显示屏穿戴设备的竞争。此外,苹果可能扩展产品线,推出比 Ultra 和 Hermès 更高端的型号,同时推出比 Apple Watch SE 更便宜的入门款。Gurman 预计,陶瓷表壳版本将在 2026 或 2027 年回归,并带来新的颜色、表带以及健康和健身功能升级。下一代 Apple Watch 还将更好地整合升级版 Siri。
沃尔玛、亚马逊等六大零售商 AI 购物助手带动销售,客单价与转化率提升
沃尔玛、亚马逊、Kroger、Albertsons 等六大零售商正加速布局 AI 购物助手,帮助消费者发现、比较和购买商品。沃尔玛 CEO 在 5 月表示,使用其 AI 助手 Sparky 的顾客平均订单价值比不使用的高 35%。Sensor Tower 数据显示,7 月份使用亚马逊 AI 助手 Alexa for Shopping 的 App 会话中,44% 产生了销售,高于 2025 年 7 月使用旧助手 Rufus 时的 34%。Kroger 和亚马逊已在 AI 助手中嵌入广告,显示零售媒体与 AI 搜索结合的趋势。这些数据表明,AI 搜索正推动比传统搜索更大的订单规模。
Zoox 获 NHTSA 批准 8 月 10 日起商业运营无人驾驶出租车,Uber 承诺千亿美元布局自动驾驶
亚马逊旗下自动驾驶公司 Zoox 获得美国国家公路交通安全管理局(NHTSA)的豁免批准,允许其从 8 月 10 日起在拉斯维加斯和旧金山开始为无人驾驶出租车服务收费,并在迈阿密和奥斯汀启动早期乘客计划。该豁免允许 Zoox 在两年内运营最多 2500 辆没有方向盘和踏板的定制车辆,为其他开发无传统控制装置的自动驾驶汽车公司铺平道路,特斯拉的 Cybercab 可能成为受益者。同时,Uber CEO 达拉·科斯罗萨西在财报电话会议上表示,公司将在未来几年承诺投入 100 亿美元,部署 12 万辆无人驾驶车辆。此外,非洲金融科技公司 Moove 已转型为大型叫车车队所有者,拥有 4.2 万辆车,并成为 Waymo 在凤凰城、迈阿密、拉斯维加斯和未来伦敦的车队运营商。
AgentRadio 测试:四个 Claude Code 智能体实时协作,企业编码任务准确率接近翻倍
Coral AI Labs 与多所大学的研究人员提出 AgentRadio,一种异步消息传递层,让 AI 智能体在任务执行间隙实时通信,无需中断主任务。在 SWE-Atlas QnA 基准的 124 个长期任务测试中,使用 Claude Opus 4.6 的四个 AgentRadio 智能体准确率达到 62.1%,是单个 Opus 4.6 智能体(32.3%)的近两倍,也超过了使用更强 Opus 4.8 模型的单个智能体(57.2%)。AgentRadio 通过 create_thread、send_message 和 wait_for_mention 三种原语实现被动感知,使智能体在后台监听消息而不阻塞工作。在 MinIO 案例中,AgentRadio 让智能体实时共享关键日志证据,将分数从 0 提升到完美的 16/16,而对比的非异步多智能体系统因无法中途沟通而失败。该框架在 GitHub 上以 Apache 2.0 许可开源,但平均 API 成本从单智能体的 2.96 美元升至 19.45 美元。
斯坦福运行 3.7 万 AI 智能体构建虚拟生物科技公司,默克独立验证其药物设计
在 VB Transform 2026 大会上,斯坦福大学教授 James Zou 介绍了其团队的 AI 智能体系统:从模拟实验室扩展到包含数万个专业智能体的“虚拟生物科技公司”(Virtual Biotech)。该系统由首席科学官智能体监督,下设靶点发现、分子设计、临床试验等部门,并使用 Paperclip 平台将非结构化数据和数据库映射为 AI 原生虚拟文件系统,使智能体通过标准文件操作访问数百万论文,成本和时间比传统方法降低一个数量级。团队用 3.7 万个临床试验智能体分析碎片化试验数据,发现与药物获批相关的单细胞特征——拥有这些特征的靶点药物上市可能性高 50%。该系统还自主设计了一种针对 CD276 蛋白的抗体偶联药物,用于肺癌治疗,仅使用 2025 年 1 月前的数据;数月后,默克公司独立开发并验证了相同设计,该设计随后获得 FDA 突破性疗法认定。Zou 强调,当智能体规模达数万时,工程重点应从设计固定工作流转向构建开放环境,通过基础设施、激励和护栏促进协作,而非微调单个模型。
Cloudflare 发布 Kitesurf:面向 AI 代理的云托管浏览器,替代 Chromium 降本增效
Cloudflare 于 8 月 7 日发布 Kitesurf,一款专为 AI 代理设计的云托管浏览器,而非面向人类用户。与注重视觉元素的传统浏览器不同,Kitesurf 专注于上下文窗口、性能、token 成本和可扩展性,并考虑提示注入等安全威胁。它运行在 Cloudflare 的 serverless 平台 Workers 上,开发者可通过 Browser Run 免费试用 beta 版,以编程方式控制无头浏览器。该公司称 Kitesurf 在常见代理任务(如截图和 HTML 提取)中,CPU 和内存消耗显著低于 Chromium,从而降低成本。该浏览器基于模块化渲染引擎 Blitz、Firefox 的 CSS 解析器 Stylo 和 Rust 引擎 Boa JS 构建,已通过超过 21.5 万项 Web 平台测试,并可正确渲染 Wikipedia、Hacker News 等网站。Cloudflare 表示仅用 12 周便构建了 Kitesurf,灵感来自开源 Rust 无头引擎 Obscura。
Airbnb 称 AI 助其将功能上线时间缩短 60%,将测试 AI 搜索功能
Airbnb CEO Brian Chesky 在 2026 年第二季度财报电话会上表示,AI 正在帮助公司大幅提升产品开发效率。得益于 AI,Airbnb 将功能从概念到上线的时间缩短了 60%,与去年同期六个月内相比,今年上线的功能和改进数量增加了近 80%。AI 还被应用于搜索、注册、结账和支付等领域,并帮助房东加快入驻流程。在消费者端,Airbnb 计划开始测试 AI 搜索功能,用户可通过开关切换到 AI 搜索,以自然语言输入查询,结果将以可视化且类似聊天机器人的方式呈现,产品描述页的亮点也会实时个性化生成。此外,Airbnb 已将其 AI 客服机器人扩展到 50 多种语言,并计划今年晚些时候支持语音通话,目前约 45%的客户问题在 AI 代理介入后无需人工干预即可解决,支持成本同比降低 16%。
新墨西哥州法院再判 Meta 赔偿 5.67 亿美元,并要求限制未成年人使用功能
新墨西哥州法院于 8 月 7 日裁定 Meta 在该州因社交平台危害和成瘾问题需额外支付 5.67 亿美元罚款,加上 3 月裁定的 3.75 亿美元,总额达 9.42 亿美元。法院还要求 Meta 改变平台在该州的运作方式:移除点赞计数,仅在对 18 岁以下用户的父母或监护人批准后才显示此类指标;在晚上 10 点至早上 7 点间暂停向未成年用户推送通知,并将未成年人的每月使用时长限制在 90 小时(约每天 3 小时)。法院认为 Meta 的平台在新墨西哥州造成了重大“公共妨害”,构成性剥削风险、干扰教育并导致不良心理健康结果。Meta 表示将上诉,并称其在保护青少年方面有良好记录。新墨西哥州总检察长 Raul Torrez 表示,该判决让 Meta 为其伤害儿童的选择付出代价,并强制其在该州改变运营方式。此前,洛杉矶法院也在 3 月对 Meta 作出类似不利裁决。Meta 还面临其他多起诉讼,包括 33 个州在奥克兰联邦法院的联合诉讼。
Meta 因新墨西哥州儿童安全案再被罚 5.67 亿美元,被裁定构成公共妨害
新墨西哥州法院在第二轮审判中裁定 Meta 构成公共妨害,并判令其额外支付 5.67 亿美元,用于资助该州青少年网络安全项目。此前,陪审团已于三月份裁定 Meta 违反该州消费者保护法,并处以 3.75 亿美元民事罚款。法官 Bryan Biedscheid 将 Meta 的平台比作工厂,将广告和内容比作产品,将儿童心理伤害和性剥削比作排放的污染,并指出这些有害影响会蔓延到整个互联网和现实世界。Meta 须在 Facebook 和 Instagram 上实施青少年安全改进措施,包括默认私密设置、限制未成年人好友范围等,但 WhatsApp 不适用。Meta 曾威胁可能撤出该州,但被总检察长 Raúl Torrez 斥为公关噱头。
Meta 被新墨西哥州法院判罚 5.67 亿美元,并须对青少年账户实施强制限用措施
新墨西哥州首席地方法院法官 Bryan Biedscheid 裁定,Meta 须支付 5.67 亿美元罚款,因其平台对青少年心理健康危机构成重大助推。这笔罚款是该州总检察长 Raúl Torrez 提起的两阶段诉讼的第二部分;此前陪审团已于 3 月裁定 Meta 未能保护年轻用户免受儿童诱骗者侵害,并批准 3.75 亿美元民事赔偿,两笔合计达 9.42 亿美元。资金将用于支持、意识和预防措施。法官还要求 Meta 在 Facebook 和 Instagram 上实施多项青少年安全限制:将 18 岁以下用户个人资料默认设为私密,默认阻止成年人连接青少年;每晚 10 点至早 7 点及学年工作日早 8 点至下午 3 点,禁止向 18 岁以下用户推送通知;默认隐藏 18 岁以下用户的点赞数;每月使用时间上限为 90 小时。该框架可能成为其他州限制青少年社交媒体的监管范本。
OpenAI 与 Jony Ive 合作的 AI 智能音箱曝光:甜甜圈造型,售价 300-400 美元,2027
OpenAI 即将推出其首款自研硬件设备——一款 AI 智能音箱,被视为 ChatGPT 的“物理化身”。据 Bloomberg 报道,该设备采用甜甜圈造型,方便用户在家中移动摆放,比如床头柜或厨房台面。机身由高品质金属制成,外观高端,还带有神秘的“可动部件”。售价预计在 300 至 400 美元之间,明显高于亚马逊智能音箱 40-240 美元的主流价格带。该设备由 OpenAI 与 Jony Ive 创立的 LoveFrom 设计工作室合作打造,计划于 2027 年发布。目前 OpenAI 正面临苹果的商业机密诉讼,但 OpenAI 已否认不当行为。
OpenAI 与 Jony Ive 联手打造的 AI 设备疑似无屏智能音箱,2027 年上市
OpenAI 与前苹果设计师 Jony Ive 合作开发的 AI 设备是一款无显示屏的智能音箱,外观呈甜甜圈形状,大小与冰球相当,内置电池,便于单手在家携带。该设备预计于 2027 年推出,售价超过 300 美元,具备独特外观和可动部件,有些部件会自动移动以显示设备正在响应或与用户互动,还配备灯光、摄像头系统和其他传感器。其工作原理与 ChatGPT 语音模式类似,但采用更先进的模型以实现更人性化的交互,设计上不会像苹果产品。这可能是 OpenAI 计划中一系列设备中的首款。
Nielsen 215 亿美元现金收购 DoubleVerify,强化广告验证与品牌安全测量
尼尔森(Nielsen)宣布计划以 21.5 亿美元现金收购广告验证和品牌安全提供商 DoubleVerify,以填补其在数字广告验证领域的空白。尼尔森长期依赖线性电视和流媒体收视率等受众测量业务,此次收购将使其业务延伸至数字媒体,确保买卖双方之间的广告支出通过验证渠道触达真实用户和品牌安全环境。DoubleVerify 首席执行官 Mark Zagorski 曾于 2015 至 2017 年担任 Nielsen Marketing Cloud 的执行副总裁,其技术主要用于验证广告是否在数字环境中实际投放,以及是否出现在广告主认为安全的网站上。与此同时,DoubleVerify 公布第二季度财报,营收 1.938 亿美元,同比增长 3%,其中激活业务收入 1.077 亿美元,测量业务 6680 万美元,供给侧 1930 万美元。
ChatGPT 取消免费用户文本聊天限制,新增 Think 按钮与 GPT-5.6 Luna 模型
OpenAI 于 2026 年 8 月 6 日宣布,取消所有 ChatGPT 用户的文本聊天次数限制,包括免费和 Go 用户。新模型 GPT-5.6 Luna 将作为免费和 Go 用户的默认模型,取代 GPT-5.5,同时新增“Think”按钮,用于处理复杂问题并启用更高推理能力。文件、图片、语音和图像生成仍保留独立用量限制。Plus 和 Pro 用户将获得升级版 GPT-5.6 Sol,适合快速任务,如回答、研究、建议、规划、写作和决策,输出更简洁稳健,并新增“思考滑块”以调整模型的思考投入。OpenAI 内部评估显示,相比 GPT-5.5-Instant,GPT-5.6 Luna 的事实错误减少 62%,GPT-5.6 Sol 减少 68%。升级版 GPT-5.6 Sol 于今日向 Plus 和 Pro 用户推出,免费和 Go 用户的无限文本聊天和 Think 按钮将在下周上线。
Qwen 3.8-Max 与 Claude Opus 5 基准测试差异揭示:评价模型成本与效率的关键在于时间预算
阿里巴巴于本周发布 Qwen 3.8-Max 预览版,并宣称其编码能力仅次于 Claude Fable 5,但在独立测试平台 VulcanBench 上,其最佳努力设置仅处于中游,默认设置则垫底。差异源于时间预算:阿里巴巴的基准测试允许 5 到 12 小时的超时,而 VulcanBench 仅允许 45 到 60 分钟。价格对比已不可靠,因为推理模型消耗大量思考令牌,可能未完成就达到令牌上限。建议采用每次成功任务成本(总花费除以通过验收的任务数)作为衡量标准,并将时间或令牌预算纳入验收标准。Long-Horizon-Terminal-Bench 数据显示,79%的未解决运行是由于超时。VulcanBench 报告显示,Claude Opus 5 的低努力设置表现最佳,高努力因超时得分更低。HubSpot 的 Breeze 客户代理按解决对话收费 0.5 美元,Zendesk 按自动解决收费,Fin 按结果收取 99 美分。建议区分失败原因(超时、验证器失败、环境错误),并按努力级别计算成本。
OpenAI 为 ChatGPT 广告引入商品轮播格式,对标 Google 购物广告
OpenAI 于 2026 年 8 月 6 日推出 ChatGPT 广告产品轮播格式,该格式经截图确认,可在单个广告位中展示多个商品,位于用户对话底部,与现有单产品广告位置一致。目前该格式仅展示单个零售商的产品,但底层机制支持按相关性展示多个产品,未来可能加入竞争品牌。此功能距 OpenAI 推出产品目录批量创建广告活动仅三个月,此前广告主要依赖单一格式(标题、描述、图片和链接)。新轮播类似 Google 购物广告,可直接从零售商 feed 拉取产品信息,由平台决定展示单个或轮播。此举正值 Q4 假期购物季前,OpenAI 正在为广告商提供更多关于 feed 广告的指导,以确保产品在对话中可被发现。
Meta 发布编程代理 Muse Code,搭载 Muse Spark 1.2,定价低于 Anthropic
Meta 宣布推出编码代理 Muse Code 的早期 beta 版,这是一款终端工具,直接对标 Anthropic 的 Claude Code 和 OpenAI 的 Codex。Muse Code 由新模型 Muse Spark 1.2 驱动,官方称其在代码生成、复杂调试、代码库理解和端到端开发工作流上都有改进。它能完成编写代码、规划变更、验证结果等软件工程任务,并能管理多个子代理并行协作。定价方面,默认按 Token 计费,输入每百万$1.25、输出每百万$4.25;另设贡献者档,需用户同意提供反馈,价格低至输入每百万$0.10、输出每百万$0.20,远低于 Anthropic Sonnet 5 的$3/$15。这一价格策略可能吸引开发者和企业转向 Meta。
Meta 发布 AI 编程代理 Muse Code,面向大型代码库,可通过并行子代理完成完整软件工程任务
Meta 本周发布面向大型代码库的终端 AI 编程代理 Muse Code,目前处于测试版,开发者可通过单条命令快速安装,用于帮助程序员完成复杂软件工程任务。该代理由 Meta Superintelligence Labs 基于此前发布的 Muse Spark 模型打造,能够规划更改、编写代码并验证结果,完成跨大型仓库的完整软件工程任务。面对足够大的任务时,Muse Code 会拆分为多个子代理,在隔离的工作树中并行执行,不触碰用户当前工作副本;扎克伯格称内部测试中曾同时为游戏构建六个功能且无碰撞。Meta 表示希望借助成本优势与 OpenAI Codex 和 Anthropic Claude Code 竞争,其 AI 负责人 Alexandr Wang 向《华尔街日报》表示,从成本角度看它非常适合许多工作流程。这也是 Meta 加大 AI 投入的一部分:6 月刚推出面向企业客服的 AI 代理,如今进一步加码开发者工具市场,以追赶 OpenAI 和 Anthropic 在编码领域的领先地位。
Google 重组 AI 领导层:Hassabis 升任主席与首席科学家,Jeff Dean 出走创业
Google CEO Sundar Pichai 于 8 月 5 日宣布重大 AI 领导层调整。Demis Hassabis 将卸任 Google DeepMind 负责人,改任 DeepMind 主席和 Alphabet 首席科学家,同时继续领导药物研发公司 Isomorphic Labs。原 DeepMind CTO Koray Kavukcuoglu 升任 Google DeepMind SVP,直接向 Pichai 汇报,并继续担任首席 AI 架构师。另一项变动是,Google 第 30 号员工、DeepMind 首席科学家 Jeff Dean 与 Google Fellow Sanjay Ghemawat 离职,共同创立 AI 公益公司 Discovery Loop,Google 作为创始投资者参与。Hassabis 称将继续与 Pichai 合作处理 AGI 战略事宜。
Reddit 推出 AI 审核工具 Rules Hub,新社区可用,年内全面上线
Reddit 正在用 AI 辅助社区审核,推出基于大语言模型的自动化审核套件 Rules Hub。该工具让版主设定规则及触发动作,由 LLM 判断帖子或评论是否符合规则意图,以弥补现有 Automod 仅靠关键词和正则匹配的局限。过去几个月,Reddit 已在约 700 个社区测试,现在向所有新建社区开放,并计划 2026 年内全面可用,且新社区可选启用。Reddit 同时表示,未来 Rules Hub 结合 Post & Comment Guidance 等新系统,可能逐步取代 Automod 的执法工作流。此外,Reddit 宣布将逐步限制第三方应用使用公开 API,要求新应用迁移到其 Developer Platform,以应对滥用和商业爬取,但尚未给出硬性时间表。
Reddit 宣布现代化版主工具:AI 驱动的 Rules Hub 扩展测试,并限制公共 API 推动开发者迁移
Reddit 宣布启动基础设施和版主工具现代化计划。在审核方面,扩展测试 Rules Hub——这套由 LLM 驱动的工具可让版主自动执行规则,选择触发后发送到队列、过滤或移除,并支持预览、日志与效果洞察。Rules Hub 已在 700 多个社区进行早期测试,即日起所有新建社区可试用,计划今年晚些时候全面开放。此外,Reddit 升级了 Post & Comment Guidance,新增 Post Flair Guidance 和 Top Comment Check,并计划减少新用户对账号年龄和 karma 的依赖;开发者方面,将逐步限制公共 API 访问,要求第三方应用迁移到 Developer Platform,并推出 100 万美元 App 迁移计划。
Shopify:AI 搜索带动商户流量和订单三倍增长,是搜索补充而非替代
Shopify 在 Q2 财报电话会上表示,AI 搜索并未侵蚀传统搜索流量,反而成为电商增长的补充。公司称,第二季度 AI 驱动的流量和订单同比增长三倍,而传统搜索仍是最大买家来源之一,占店铺会话约三分之一,且过去两年增长 1.3 倍。Shopify 总裁 Harley Finkelstein 解释,AI 代理通过多次调用商品目录结构化数据,按买家具体意图匹配产品,而非仅靠关键词排名。AI 推荐会话中有一半直接落在商品详情页,是传统搜索的 2.5 倍;75%的 AI 归因购买发生在 Top 100 品类之外,即长尾商品。财报显示,公司该季度营收 36 亿美元,同比增长 36%,超出华尔街预期。Shopify 还已接入 Claude、ChatGPT、Perplexity、Manus 等 AI 工具与代理,便于商家构建 AI 购物体验。
蜘蛛侠新片放弃传统电视,凭借社交媒体营销创北美首周末票房纪录,全球超九亿美元
索尼与迪士尼共同出品的漫威电影《蜘蛛侠:崭新的一天》上映首周末在北美斩获 3.6 亿美元,超越《复仇者联盟 4:终局之战》的纪录,成为北美影史首周末票房最高影片,全球票房也累计达到 9.32 亿美元。该片与同档期的《奥德赛》一起贡献了 4.3 亿美元的北美周末总票房,创下历史新高,表明社交营销带来的观众热情同时推高了大盘。根据公开数据,这次破纪录的市场表现主要依靠社交媒体营销驱动,而非传统电视广告投放。影片将社交平台作为核心宣传阵地,通过话题传播、短视频片段和用户生成内容来制造热度,传统电视策略基本没有参与主要传播。这种“社交优先”的发行营销方式,与以往好莱坞大片依赖电视广告覆盖的做法形成鲜明对比。
Anthropic 启动自研 AI 芯片计划,组建定制硅团队,软硬件协同设计以提升性能和效率
人工智能公司 Anthropic 于 2026 年 8 月 5 日确认,正在组建一个专门设计自研 AI 芯片的团队,并计划通过软硬件协同设计,让定制芯片与其模型 Claude 深度配合,从而提升运行速度和整体效率。同时,Anthropic 在 2026 年 7 月接洽韩国三星电子,考虑将三星作为其芯片制造的潜在代工伙伴。目前,Anthropic 的算力资源主要来自与亚马逊云服务、谷歌、英伟达和超威半导体签署的现有合作协议,但 Claude 需求正在快速增长,仅依靠外部硬件已难以满足大规模扩展的需求。在 Anthropic 之前,OpenAI 已于 2026 年 6 月推出由博通代工的 Jalapeño 推理芯片,该芯片专门面向推理任务;谷歌 DeepMind 长期依赖 Alphabet 自研的张量处理单元(TPU);Meta 则正在开发自己的 MTIA 加速器。这一自研芯片的举措正值各 AI 公司争相签署基础设施交易、锁定算力供应之际,Anthropic 已为其“定制硅片团队”发布招聘信息,寻找有芯片设计经验的工程师。
出版商开始酝酿退出谷歌 AI 搜索,创作者却靠 AI 搜索获取更多品牌合作
出版商正在集体调整与 Google AI 搜索的关系。Cloudflare 宣布从 9 月 15 日起,其安全软件将默认阻止同时用于搜索索引和 AI 训练的爬虫,新出版商和免费用户默认开启,涉及 Financial Times、Condé Nast、The Atlantic 等;USA Today 和 Beehiiv 也表示准备从 Google 搜索中摘除,形成过去难以想象的反抗。与此同时,创作者却在反向利用 AI 搜索:Andrew Polo 在 HealthCentral 的采访被 ChatGPT 引用后,品牌问询增加 50%,社交粉丝小幅增长;Gigi Robinson 通过扩充播客嘉宾名单提高 AI 搜索引用量,获得了品牌合作。数据显示,YouTube 创作者出现在四分之一 AI 搜索答案中,而新闻出版商仅获得 ChatGPT 引荐流量的 3.2%和 Perplexity 的 7.4%;另据研究,人们花在 AI 模式上的时间比 Google 搜索多近 9 分钟,GrowthMemo 发现 75%的会话不会离开 AI 模式,且 Cloudflare 称超过 55%的网络流量来自 AI 代理。财务上,Google 首次出现约 59 亿美元负自由现金流,其搜索和广告业务仍增长 17%至 633 亿美元,凸显 AI 投资对传统业务的侵蚀。
SpaceX 季度营收结构逆转:其 AI 算力收入达 26 亿美元,首次超越太空业务收入总额
SpaceX 最新季度财报显示,AI 业务收入同比增长超过三倍至 26 亿美元,首度超过太空业务 9.62 亿美元,主要源于向 Anthropic(5 月签约)和 Google(6 月签约)提供 AI 算力。AI 部门本季度仍亏损 15 亿美元,但较去年同期略有好转。公司整体亏损收窄至 1.43 亿美元,资本支出则高达 183.7 亿美元,用于大规模扩建算力设施。SpaceX 在 IPO 文件中将 AI 视为最主要价值来源,其 Starlink 连接业务仍以 42 亿美元收入居首,太空业务仅排第三。此外,SpaceX 收购企业级 AI 产品 Cursor 尚未完成,且因 Grok 落后,公司此前已转向出租自建数据中心。
AI 安全报告:Z.ai 开源模型 GLM-5.2 能力逼近前沿,但安全缓解措施明显缺失
SaferAI 发布新报告,评估了中国 Z.ai 的开源权重模型 GLM-5.2。测试显示,GLM-5.2 在进攻性网络和双重用途生物学能力上已接近 OpenAI GPT-5.5 和 Anthropic Claude Opus 4.7,但安全缓解措施严重落后。SaferAI 通过 Z.ai 公共 API 测试,GLM-5.2 对全部攻击性网络和生物任务零拒绝;而 Claude Opus 4.7 因拒答一致,CyberGym 基准测试根本无法完成。Z.ai 未发布安全框架、预部署测试承诺或风险评估。开源权重模型下载后可删除防护、微调模型或修改系统提示,安全措施不可强制执行。Far.ai 还发现 Grok 4.5、Gemini 3.1 Pro 等前沿闭源模型存在数百个通用越狱,但闭源模型的防护手段在开源权重模型上完全无效。
人工智能公司 Anthropic 与 AI 云初创企业 Volta 正式签署一百亿美元算力合作协议,深化算力布局
人工智能公司 Anthropic 与 AI 云初创公司 Volta 达成一项价值 100 亿美元的合作协议。这是 Anthropic 近几个月以来一系列云合作伙伴关系中的最新一笔,过去数周内其已陆续宣布多项云基础设施合作,以应对快速增长的模型训练与推理需求。协议的具体条款、涉及的计算规模和技术方案尚未公开,市场普遍预期将涵盖大规模 GPU 集群供应、云平台托管以及模型推理部署支持。对于 Volta 这样一家成立不久的 AI 云初创企业,这笔交易意味着其将获得迄今金额最大的客户订单,并有望借助 Anthropic 的背书进入主流 AI 云服务市场。对 Anthropic 而言,该合作有助于分散对头部云厂商的依赖,并为其后续模型训练与产品服务锁定充足的算力资源。目前双方均未披露合作的时间表、地域范围与执行细节。
广告技术公司 Teads 起诉谷歌,指控其反竞争广告行为致对手损失数万亿展示
广告技术公司 Teads 在纽约南区法院对 Google 提起诉讼,指控其将 Google Ads 与广告交易平台 AdX 捆绑,导致竞争对手交易平台在 2017 至 2023 年间损失约 6.88 万亿次展示。Teads 称 Google 并未真正停止 First Look、Last Look 以及 Project Bernanke 等反竞争拍卖机制,尽管 Google 声称这些做法已取消。这是过去一年内第五家起诉 Google 的供应方平台(SSP),此前 Index Exchange、Magnite、OpenX 和 PubMatic 也已起诉,背景是 2025 年 4 月联邦法院认定 Google 在开放网络广告市场存在非法垄断。Teads 要求三倍赔偿和惩罚性赔偿,具体金额待审;Google 发言人回应称指控毫无根据。Teads 同时警告诉讼可能耗费资源,其股价已同比下跌约 68%。
Spotify 全球订阅用户首次突破三亿,提价后季度仍增 9%,AI 功能密集上线
Spotify 在周二公布,其全球订阅用户数首次突破 3 亿,较去年同期增长 9%;月活跃用户达 7.77 亿,同比增长 12%。尽管今年已在多个地区上调订阅价格,用户数仍在第二季度保持增长。公司季度营收为 48 亿欧元(约 55.2 亿美元),同比增长 14%。近期 Spotify 密集推出 AI 功能,包括基于不同来源生成个性化播客、类似 NotebookLM 的桌面实验应用、AI 问答与简报生成、与 ElevenLabs 合作的有声书创作工具,以及上月推出的对话式 AI 助手。此外,面对用户对 AI 生成音乐的不满,Spotify 为艺术家增加了验证系统,并自去年起为 AI 生成音乐提供可选标签,但检测工具缺失,部分用户转向 SoullessMusic.com 等替代服务。
Bending Spoons 以 12.8 亿美元现金收购 Airtable
Bending Spoons 上市后首笔收购落定,同意以 12.8 亿美元现金收购数据库与电子表格初创公司 Airtable。Airtable 成立于 2013 年,累计融资超 14 亿美元,2021 年巅峰估值超过 110 亿美元,今年早些时候二级市场估值约 40 亿美元。Bending Spoons 表示,计入当前净现金及等价物后,Airtable 估值约 22.5 亿美元;其年经常性收入同比增长超 20%,截至 2026 年 6 月约为 4.8 亿美元。Airtable 今年 1 月发布 Superagent 产品线,可编排 AI agent 团队;该公司称服务超过 50 万家组织,覆盖 80% 的财富 100 强企业。Bending Spoons 过往收购 Evernote、WeTransfer、EventBrite 和 Vimeo,通常会精简人员并推动产品盈利。
Reddit 发布首份美妆报告:眼影帖浏览量涨 56%、裸妆跌 81%,社区共创成趋势
Reddit 发布首份美妆报告《大众美妆指数》(The People's Beauty Index),基于过去一年社区内真实对话,总结美妆文化正从自上而下的处方式趋势转向参与式共创。数据显示,r/MakeupAddiction 的眼影盘帖子浏览量同比增长 56%,教程讨论增长 38%,而“裸妆”类提及浏览量同比下跌 81%。同时,“pre-shower makeup”等实验性妆容相关讨论在 r/MakeupAddiction 和 r/Makeup 等社区增长近 400%。报告还发现,纽约、洛杉矶、芝加哥、华盛顿特区等城市社区中,Botox、微针等医美项目成为高频搜索词,其中 Botox 在五个城市均排名前列。随着 AI 生成内容和精修信息流增多,用户转向 Reddit 寻求真人经验与完整故事,社区内分享的个性化建议正成为消费决策的重要参考。
据泄露备忘录,微软下一代 Xbox 主机可兼容历代 Xbox 与 PC 游戏,但需发行商授权
The Verge 获得的一份泄露备忘录显示,微软正在开发的新一代 Xbox 主机 Project Helix 将首次实现跨全世代兼容:从 2001 年初代 Xbox、2005 年 Xbox 360、2013 年 Xbox One 到 2020 年 Xbox Series 的游戏都能运行,同时支持 PC 游戏。不过这种兼容并非即插即玩,微软要求发行商对每个游戏单独授权,并自行决定定价和是否纳入 Xbox Game Pass。备忘录还提到 Helix 可能不配备光驱,因此微软提供光盘转数字方案,让实体盘玩家变成数字客户。微软以“休眠 SKU 重新变为可售商品”为卖点,说服发行商将老游戏再次上架。目前该项目仍处于规划阶段,具体发售时间和最终硬件配置尚未公布。
阿里巴巴发布旗舰大模型 Qwen3.8-Max,在智能体计算机操作基准上超越 GPT-5.6 和 Fable 5
阿里巴巴 Qwen 团队发布旗舰模型 Qwen3.8-Max,这是一个 2.4 万亿参数的 MoE 多模态大语言模型,面向自主软件工程和长周期企业任务。官方基准显示,该模型在 OSWorld-Verified 智能体桌面操作评测中得 86.1 分,超过 GPT-5.6 Sol Max 的 83.2 分和 Fable 5 的 85.0 分,在 PaperBench 上取得 93.0 分,同时在 TerminalBench 2.1 和 Vision2Web 等多项评测中领先。模型声称能自主完成超过 10 天的软件项目、复现数千行代码的科研论文,并通过多模态反馈进行迭代芯片设计优化。下周将开放 Qwen3.8-Max 和 Qwen3.8-27B 的权重,但许可证尚未披露,可能采用类似 Moonshot Kimi K3 的限制性许可。API 定价为每百万输入/输出 token 2/6 美元,约为 Claude Opus 5 总价的 1/3、GPT-5.6 Sol Max 的 1/4,将降低企业规模化部署智能体的成本。
OpenAI 首次办奢华网红团建,网友批其忽视 AI 数据中心环境代价
OpenAI 上周末在纽约州北部举办了首次网红品牌体验营“Summer Club”,邀请一批创作者参加农场到餐桌晚宴、养蜂等康养活动,以及学习如何使用 OpenAI 产品的课程。活动的主要目的是向创作者介绍新发布的 ChatGPT Work,帮助他们掌握起草文档、制作演示文稿等办公功能,以便他们之后向粉丝展示这些工具的用法。然而,活动在社交媒体上引发大量负面评论,不少网友批评网红为豪华待遇“出卖灵魂”,或反问能否制作视频解释 AI 数据中心的环境影响。争议还牵涉 OpenAI 计划在俄亥俄州建造的 5000 亿美元数据中心项目以及与国防部签订的 2 亿美元合同。有网红删除了自己发布的体验视频,也有参与者在 LinkedIn 上表示没想到会被视为争议。OpenAI 发言人回应称,创作者是社区的重要组成部分,活动以教育为导向,欢迎关于 AI 的辩论。
苹果新版 Siri AI 上线 iOS 27 测试版:与 Google Gemini 合作,能理解个人上下文
苹果在 iOS 27 消费者测试版中推出了 Siri AI,兑现了此前多次延迟的 AI 助手承诺。新版 Siri 支持自然多轮对话,可调节语音表现力和语速,也支持打字输入和独立 App,并能引用过往对话。它能理解个人上下文,帮助查找照片、邮件、联系人、短信和日历日程,例如根据模糊描述找出此前保存的收据或驾照照片上的号码。Siri 还能通过相机取景器识别现实世界物体、帮助分摊餐费,并可直接启动网站和应用。这些能力基于苹果与 Google 的合作,苹果使用 Gemini 技术训练和优化自研 Apple Foundation Models,模型运行在自研芯片和私有云上。目前功能仅限测试版用户,正式版预计随 iOS 27 在 9 月发布。
阿里发布 Qwen3.8-Max,称性能媲美 Claude 与 OpenAI,下周开放权重
阿里巴巴发布其迄今最大、声称最强的 AI 模型 Qwen3.8-Max,参数规模达 2.4 万亿。公司称其性能可对标 Anthropic 的 Claude Fable 5、OpenAI 旗舰及国内 Moonshot 的 Kimi K3。在 Arena 文本模型排行榜上,Qwen3.8-Max 仅落后于 Fable 5 和三个 Opus 模型;前端编码仅被两个 Claude Opus 和 Kimi K3 超过;视觉分析仅弱于 Fable 5。阿里表示将于下周开放模型权重,这是其今年初转向闭源后回归开源发布。该发布紧随 Moonshot 上周开源 Kimi K3,显示中国 AI 公司加速追赶美国。
OpenAI 推出全新的 GPT-Live 实时语音系统:无轮次、低延迟,支持连续对话,体验更自然
OpenAI 发布了 GPT-Live,一个专为实时语音交互打造的 AI 系统。与传统语音助手采用“一问一答”的轮次模式截然不同,GPT-Live 基于无轮次语音模型,意味着用户与 AI 对话时无需等待对方完全结束发言就能继续表达,AI 也会在持续接收音频流的同时动态生成回应,使得整个交互过程像人与人聊天一样自然、连续,可以随时被打断和补充。为了满足这种高实时性要求,GPT-Live 在架构上专门做了低延迟设计,覆盖音频采集、传输、模型推理以及语音合成多个环节,通过端到端优化将响应延迟压缩到极低水平,让用户几乎感觉不到等待,从而获得更快、更流畅的语音对话体验。据 OpenAI 介绍,这一系统是在短短六个月内从零构建完成的,反映出其团队在实时语音 AI 工程方面的技术积累和执行力。