
GPT Image 2 API 开始预览透明背景生成

DeepSeek 上线 V4-Flash-Vision-Exp 多模态视觉理解模型

9 家车企因应急机械拉手隐患召回约 427.6 万辆汽车

阿里二季度重组电商与 AI 业务架构

腾讯芯片负责人高剑林被曝离职创业,瞄准 RISC-V AI CPU

旺旺被曝启动裁员,并要求员工提交自评报告

LV 否认「起诉国家知识产权局遭驳回」

泡泡玛特拟在半年内回购股份

奇瑞旗下 AiMOGA 筹备 IPO,明年目标交付 1 万台机器人

AMD x86 客户端 CPU 出货份额首次突破 30%

李彦宏:文心大模型要重回基础模型第一梯队
🦿
雷鸟 iO 发布:34g、双目显示,首发 1996 元起

小红书开源 dots3-note preview,支持 512K 多模态上下文

百度秒哒接入支付宝支付 Skill

豆包工作任务加入技能、连接器和专业 Agent

商汤开源 SenseNova U1.5 正式版,原生支持 4K 图像生成

DeepSeek Harness 新增 Codex 与 Claude Code 子代理接口

同程旅行完成收购嘀嗒出行,后者保持独立运营

曝 YouTube 向头部创作者支付独占费用,阻止节目同步给 Netflix
周末也值得一看的新闻
带摄像头 AirPods 更多参数曝光,或配备拍摄指示灯

据 MacRumors 报道,苹果带摄像头的 AirPods 曝光更多参数,左右耳机或各配备一枚摄像头,可采集同步彩色静态图像,供 Visual Intelligence 分析,但目前不支持视频录制。
代码显示,该产品在主动模式下可采集 640 × 640 图像,并输出 1024 × 1024 处理结果;被动模式下则采集 320 × 320 图像,输出分辨率为 320 × 320 或 512 × 512。被动模式可能用于感知附近语音、环境音变化、头部转动和周围移动等情况。
相关框架还包含镜头畸变校正、双摄像头校准,以及摄像头与运动传感器校准功能,并支持在设备端判断画面中是否有人。代码同时提到硬件指示灯及亮度控制,暗示 AirPods 可能配备拍摄指示灯,用于提示周围人员设备正在采集图像。
目前曝光信息尚不能确认最终产品规格。此前曝光的 B790 版本据称已取消,苹果转而开发代号为 B798 的新一代摄像头 AirPods,预计明年推出。
GPT Image 2 API 开始预览透明背景生成

OpenAI 8 月 21 日宣布,GPT Image 2 API 开始预览透明背景生成功能。开发者可直接生成能叠加到不同背景上的可复用素材,用于产品图片、平面设计、网站原型和营销内容。
这项更新补上了 GPT Image 2 此前在 API 中不支持透明背景的能力缺口。官方模型页面显示,GPT Image 2 可通过图像生成与图像编辑端点使用,并支持灵活的图像尺寸和高保真图像输入。
同日,LMArena 上出现名为 luna-lisa-alpha 的匿名图像模型,部分测试者猜测它可能与 OpenAI 的下一代图像模型有关;OpenAI 尚未确认该模型身份,因此现阶段不能将其视为 GPT Image 2.5 的正式预告。
DeepSeek 上线 V4-Flash-Vision-Exp 多模态视觉理解模型

昨天,DeepSeek 上线实验性视觉理解模型 DeepSeek-V4-Flash-Vision-Exp,并将其开放至 API 平台。用户可通过 deepseek-v4-flash-vision-exp 模型名调用;官方称,其纯文本 Agent、推理与知识能力与 V4-Flash 正式版基本持平,同时补上图像理解能力。
官方公布的 4 项多模态 Agent 评测中,该模型在 Agents’ Last Exam 和 ZeroBench 上高于 Opus 4.8,在 ApexBench 与 Chartography 上略低。上述成绩均来自厂商测试,测试所用的 Agent 框架和任务设置也由官方给出。
API 支持 Chat Completions、Messages 和 Responses 三种调用格式,可接收 base64、外部 URL 与 Files API 三种图像输入。一张图片最多转换为 384 个 token,计费价格与 V4-Flash 相同。同步开放的 Files API 不收取存储费用,同一图片上传后可通过 file_id 跨请求复用。
9 家车企因应急机械拉手隐患召回约 427.6 万辆汽车
昨天,特斯拉、小米、小鹏、吉利、零跑、奇瑞、东风、北汽蓝谷和一汽向国家市场监督管理总局备案召回计划,涉及约 427.6 万辆汽车。主要问题是车内应急机械拉手与内饰颜色接近、不易识别和操作,严重碰撞导致低压系统失效时,可能影响乘员逃生和车外救援。
特斯拉涉及约 297.6 万辆国产及进口 Model 3、Model Y、Model X 和 Model S,是本轮规模最大的一家;小米涉及约 39 万辆 SU7,零跑涉及约 37.1 万辆 C01 和 C11,小鹏涉及约 26.5 万辆 G6、P7+ 和 X9。其余召回车型包括极氪 007、极氪 X、iCAR 03、风云 X3、纳米 06、风神 L8、eπ007、eπ008、极狐考拉、红旗 EH7 和天工 08。
各车企将按车型加贴或更换提示标识,部分车型还会通过 OTA 优化事故后降窗、中控解锁等策略。小鹏、一汽部分车型仅加贴标识,奇瑞则会同时更换改进后的应急机械拉手盖板。
隐藏式电子门把手由特斯拉带动普及,车辆断电后如果应急机械释放装置位置不清晰,可能增加逃生和救援难度。中国已决定从 2027 年起禁止隐藏式车门外把手;美国监管机构正在研究适用于所有车企的新安全标准,联合国欧洲经济委员会也在起草断电后仍能从车内外开启车门的相关标准。
阿里二季度重组电商与 AI 业务架构
阿里巴巴公布截至 6 月 30 日的季度业绩,收入为 2689.53 亿元,净利润为 104.44 亿元。公司把利润下滑主要归因于经营利润减少、处置投资收益和股权投资公允价值变动收益下降。
本季度阿里同步调整业务架构:国内与国际电商、盒马及菜鸟部分商业业务并入阿里电商集团;云智能集团与平头哥合并为「AI 云与计算服务」;模型实验室、千问消费者业务、QwenWork 则组成「AI 实验室与应用」。
AI 云与计算服务季度收入为 484.37 亿元,AI 相关产品收入连续第 12 个季度实现三位数增长。阿里本季度资本开支增至 676.78 亿元,主要用于扩充 AI 基础设施。
腾讯芯片负责人高剑林被曝离职创业,瞄准 RISC-V AI CPU

据「半导体行业观察」报道,腾讯芯片研发负责人高剑林近期离职,计划围绕高性能 AI 服务器和 Agentic AI 创业,研发基于 RISC-V 架构的高性能 CPU。报道援引知情人士称,他在腾讯负责的方向覆盖 AI 加速、CPU、RISC-V 架构、芯片验证和后端团队。
高剑林 2013 年在腾讯发起组建硬件团队,随后推动 FPGA 云服务器、AI 芯片和 RISC-V 核心研发。2020 年腾讯成立蓬莱实验室后,其团队完成腾讯首颗 TPU 架构 AI 芯片回片,并在数据中心部署后续芯片。
这次创业目前仍属于媒体独家消息,腾讯与高剑林尚未公开披露新公司的名称、融资或产品发布时间。
旺旺被曝启动裁员,并要求员工提交自评报告

据财新报道,中国旺旺近期启动裁员。多名接近公司的人士称,一名离职员工听说集团计划裁员约 1000 人、目前已裁约 400 人;另一名离职员工称,其所在部门计划优化 8% 的员工。中国旺旺在报道刊发前未回复问询。
多名员工还称,公司要求总部全体人员围绕过去一年的实际结果提交自评报告,由直属和隔级主管逐项评分,但单位最高主管无需参加。自评要求员工以事实和数据剖析不足。
这项调整延续了董事长蔡衍明本月初内部信释放的信号。蔡衍明此前称公司遭遇「重大经营危机」,要求淘汰没有贡献的干部,并调整长期未变的经销商合作方式。
LV 否认「起诉国家知识产权局遭驳回」
第一财经 8 月 21 日报道,针对「LV 起诉国家知识产权局遭法院驳回」的消息,LV 内部知情人士回应称,相关说法不实,案件仍处于法定程序中,尚未形成最终结论。
这起商标行政纠纷围绕一枚四瓣花图形商标展开。LV 此前主张广东汕头个体户黄民耀注册的图形与其商标近似,并向国家知识产权局申请宣告无效;国家知识产权局审查后认为两者细节差异较大、普通消费者不易混淆,维持了该商标注册,LV 随后提起行政诉讼。
LV 表示,该案属于围绕具体商标行政决定展开的正常法律程序,公司不对仍在进行的案件作进一步评论。
泡泡玛特拟在半年内回购股份
泡泡玛特发布上半年业绩后,创始人兼董事长王宁在业绩会上表示,公司计划在未来 6 个月内回购不低于 20 亿元、不高于 50 亿元的股份。他同时称,今年大概率无法完成年初提出的营收增长目标,下半年经营压力高于上半年。
公司上半年收入为 171.7 亿元,经调整净利润为 51.6 亿元。王宁将今年定位为经营调整年,表示提升销售额不是当前首要目标。
泡泡玛特称,THE MONSTERS、TWINKLE TWINKLE、CRYBABY 等多个 IP 均形成规模化收入,IP 组合较此前更分散。
奇瑞旗下 AiMOGA 筹备 IPO,明年目标交付 1 万台机器人
据路透社报道,奇瑞汽车旗下机器人公司 AiMOGA 正与多个潜在上市地沟通,希望通过 IPO 为后续技术投资筹集资金。AiMOGA 随后表示,公司尚未就 IPO 采取任何实质行动;奇瑞目前持有其近 77% 股权。
AiMOGA 负责人、奇瑞国际总裁张贵兵表示,公司自 2025 年 1 月孵化以来,已在全球交付超过 3000 台机器人,其中 2000 台交付至海外,覆盖 60 多个国家和地区;明年的全球交付目标为 1 万台。
公司早期把双足人形机器人投入奇瑞展厅,目前正扩展至交通管理、人群引导和公共安全宣传等场景,已有 110 台警务机器人在中国多个城市部署。张贵兵称,中东和东南亚的高温、强降雨环境可能带来更强的公共服务机器人需求。
AMD x86 客户端 CPU 出货份额首次突破 30%
Mercury Research 最新数据表明,今年第二季度,AMD 在 x86 客户端 CPU 市场的出货份额升至 30.3%,首次跨过 30% 门槛;英特尔份额为 69.7%。AMD 上一季度份额为 29.6%,去年同期为 23.9%,一年提高了 6.4 个百分点。
这项统计覆盖台式机和笔记本电脑处理器的供应链出货量,不代表终端设备保有量,也不包含 Apple Silicon、高通 Snapdragon 等 Arm 处理器。AMD 的本季度增量同时来自台式机与移动处理器。
Mercury Research 称,第二季度 x86 与 Arm CPU 总出货量环比增长超过 10%,明显高于通常的季节性表现;另一家研究机构 Jon Peddie Research 认为,部分增长来自电脑厂商在英特尔第一季度供应受限后重建库存。
李彦宏:文心大模型要重回基础模型第一梯队
百度董事长兼 CEO 李彦宏在二季度业绩电话会上表示,文心大模型要重新回到基础大模型第一梯队。他承认百度在探索过程中出现过试错,但称公司不会改变让文心具备核心竞争力的承诺。
李彦宏把长期竞争力归结为持续稳定的技术投入、以应用落地为导向的产品策略和耐心。他表示,百度不会同时铺开所有场景,而会集中资源推进 AI 搜索、数字人和秒哒等生态内重点方向,并加快文心迭代。
百度官方材料显示,二季度 AI 驱动业务收入已占一般性业务收入的一半,AI 云基础设施与文库、网盘的 AI 用户渗透率继续增长。
李彦宏作出这一判断的背景,是基础模型竞争格局仍在快速变化,百度此前未能持续保持领先。他提出的推进方案包括引进人工智能人才、维持研发投入,并把有限资源集中到百度已有产品和分发能力能够承接的场景,而不是同时扩张所有应用方向。
雷鸟 iO 发布:34g、双目显示,首发 1996 元起

雷鸟创新 8 月 21 日发布 AI 眼镜雷鸟 iO,正式售价 2499 元,首发到手价 1996 元起,即日起在京东、天猫、抖音及线下眼镜渠道开售,并提供 0 至 1000 度近视配镜方案。
雷鸟 iO 采用双目显示架构,等效 33 英寸画面,入眼亮度为 1800 尼特;整机最低重量 34g,支持两天日常续航和 18 小时连续记录。交互上配有 Smart Crown 旋钮,并支持点头确认、摇头取消。
这款眼镜不配备摄像头,主要通过 4 颗阵列麦克风和 1 颗骨传导麦克风处理会议记录、实时翻译和提词。录音、翻译等功能启用时,镜腿隐私状态灯会同步亮起且不能通过软件关闭;翻译覆盖 55 种语言和 109 种口音。
小红书开源 dots3-note preview,支持 512K 多模态上下文

小红书 dots studio 开源 dots3-note preview,并在 dots.ai 开放平台提供 API 限时免费调用。它是 dots3 系列首个开放权重模型,采用混合专家架构,总参数量为 2800 亿,推理时激活 160 亿参数,最长支持 512K token 上下文。
模型可同时接收文本、图像、视频和音频,输出文本,主要面向知识问答、数学与逻辑推理、代码生成、工具调用、多步 Agent 工作流和长上下文处理。官方提供 BF16 与 FP8 权重,并给出 SGLang、vLLM 两种部署路径。
官方建议 FP8 版本部署在单台 8 卡 GPU 服务器上;vLLM 的原生支持目前位于主分支,稳定版尚未包含这一适配。
百度秒哒接入支付宝支付 Skill

昨天,支付宝宣布,百度旗下无代码应用生成平台秒哒已接入支付宝支付 Skill。开发者在秒哒创建或修改网页应用时,可直接要求 Agent 加入支付宝收款能力,不必自行编写支付接口代码。
该 Skill 默认提供不涉及真实资金的沙箱环境,完成测试后,开发者仍需在支付宝 AI 付站点申请开通网页应用收款、配置应用密钥,才能切换至线上环境。接入范围包括电商店铺、付费课程、活动报名和咨询服务等网页应用。
支付宝表示,TRAE SOLO、扣子编程、Qoder 和百度秒哒目前均已接入这一能力。对个人开发者而言,付款结果可自动回传到应用,用于即时开通额度或交付数字服务。
豆包工作任务加入技能、连接器和专业 Agent

豆包在电脑版「工作任务」模式中上线技能、连接器和「工作伙伴/小队」。用户可在侧边栏选择对应入口,把常用工作步骤、交付标准和参考模板整理成可重复调用的自定义技能。
豆包称,当前已上架超过 200 个技能和连接器。连接器用于在常用工具中查找信息并处理任务;「工作伙伴」则让用户按专业方向选择不同 Agent,由它们协同分析问题、拆解步骤和完成交付。
这次更新把工作任务从单次问答扩展为可复用流程和多 Agent 协作,但具体连接器清单与各项能力的开放范围以豆包电脑版实际账户为准。
商汤开源 SenseNova U1.5 正式版,原生支持 4K 图像生成

商汤 8 月 20 日开源 SenseNova U1.5-8B-MoT 正式版。相较 7 月底发布的预览版,新权重继续改进复杂指令遵循、中英文文字渲染、海报和信息图布局、主体一致性及局部编辑,并原生支持 4K 图像生成。
模型采用统一的多模态架构,可执行图像生成、编辑、视觉理解和图文交错生成。官方同时发布 8 步推理 LoRA,以降低生成延迟,并计划继续开放从监督微调、强化学习到 MOPD 的完整训练流程。
项目也列出了当前边界:密集长文本仍可能出现错误,高约束布局中的数量和对齐不够稳定,小尺寸人脸、手部和肢体细节仍会失真,多轮复杂编辑也可能产生漂移。
DeepSeek Harness 新增 Codex 与 Claude Code 子代理接口

DeepSeek Harness 近期更新子代理子系统,可把 Codex、Claude Code、进程内 Agent、ACP Agent 和 Harness SDK Agent 注册为并列提供方,由主 Agent 按任务选择并启动子代理。
官方文档显示,subagent-codex 会通过 Codex app-server 启动独立子进程,subagent-claude-code 则调用 Claude Agent SDK。Harness 还提供统一的消息、打断、列表与结果回传接口,父 Agent 可继续管理仍在运行的子任务。
这是 DeepSeek Harness 8 月 13 日开放开发者预览后的增量更新,重点从基础工作台扩展到跨 Agent 编排;第三方 DSH-IM 网关还可把同一 Harness 接入飞书、钉钉、微信、QQ 等聊天渠道。
同程旅行完成收购嘀嗒出行,后者保持独立运营
昨天,同程旅行与嘀嗒出行发布联合公告,宣布针对嘀嗒出行股份的自愿有条件全面现金要约已截止,收购正式完成。同程旅行表示,嘀嗒出行将继续保持品牌和运营独立,并计划维持其中国香港上市地位。
收购完成后,双方将继续独立发展各自业务,同时在用户服务、出行场景和技术能力等方面探索协同。嘀嗒出行的业务以顺风车和智慧出租车服务为主,同程旅行则覆盖交通票务、住宿预订及旅游服务。
曝 YouTube 向头部创作者支付独占费用,阻止节目同步给 Netflix
据彭博社报道,YouTube 正与部分头部频道商谈限时独占合作:创作者接受现金激励后,需要先把节目独家上传到 YouTube,独占期结束后才能授权给 Netflix 等平台。
知情人士称,资金安排包括直接为部分节目提供制作资金,或把大型品牌合作的一部分分配给创作者。YouTube 尚未敲定交易,但已接近与数个合作方达成协议。
这轮谈判针对 Netflix 近来引入 YouTube 头部创作者的动作。对不接受独占条件的创作者,YouTube 可能减少大型品牌合作与节目投资机会,但其日常上传权限不受影响。
是周末啊!
One Fun Thing|1.58 万元,问界把 M9 缩成一辆能远程接管的儿童车

问界儿童车把 M9 的设计语言缩进一副双座敞篷车身:贯穿式灯带、同款轮毂和车规级金属漆都被保留下来,车身长 1500 mm,提供金瑞红、赛里木青和暖云白三种颜色。
孩子可以自行驾驶,家长也能随时用遥控器接管。车辆配备 350 W 电机,标称续航 20 公里,并设置两档限速;防侧翻结构、圆角软包和双座安全带用于降低使用风险。
前后双 1080P 摄像头和鸿蒙智联让家长可以通过 App 查看车辆状态、设置电子围栏并进行双向语音。产品由赛力斯与华为联合设计,已开启预订,计划 8 月 30 日上市,售价 1.58 万元。
周末看什么|《龙之家族》最新一季完结,坦格利安内战进入正面冲突

《龙之家族》最新一季已在 HBO Max 完整上线。故事继续改编乔治·R·R·马丁的《血与火》,雷妮拉与伊耿二世争夺铁王座的内战从政治对峙进入更大规模的海战、龙战与阵营分裂。
本季季终集上线前三天触达 2100 万观众,其中美国观众超过 1100 万;整季目前平均每集 3400 万观众,接近第二季的 3500 万。Rotten Tomatoes 收录 171 篇媒体评价,新鲜度为 91%。
本季由 Emma D’Arcy、Olivia Cooke 和 Matt Smith 继续主演,共 8 集。季终集把此前积累的阵营矛盾集中推向战场,也为后续故事留下了明确的权力断点。
买书不读指南|《验证智能》把生成式 AI 放回教育技术史
南加州大学教育学者 Stephen J. Aguilar 在《Authenticating Intelligence》中回看课堂电视、早期教育软件到生成式 AI 辅导工具的演进,讨论新技术如何进入学校和大学,并改变教学设计、个性化学习与师生分工。
作者用「用户、技术、环境」三者互动作为分析框架,分别处理 K-12、高等教育、教育公平和学术诚信。书中结合设计理论、教育技术研究、课堂案例和操作清单,分析 AI 提升学习效率的条件,以及偏见、作弊和资源差距可能被放大的环节。
本书由 Bloomsbury Academic 于 8 月 6 日出版,共 200 页。Aguilar 现任南加州大学生成式 AI 与社会中心主任。
游戏推荐|Agent 64 把 90 年代主机谍战 FPS 做成合作战役

《Agent 64: Spies Never Die》沿着 90 年代主机射击游戏的手感,搭了一套 1997 年想象中的谍战世界。玩家扮演特工 John Walter,在摩天楼、夜店、博物馆、地下墓穴和雪地基地等场景完成 14 个任务,对抗反派 Dominic Pulp。
每关都是可以反复探索的独立地图,目标包括入侵终端、偷取机密计划和营救人质。三档难度不只是调整敌人强度,还会增加任务目标、开放更多区域;通关挑战还能解锁 70 多种 Paradox 修改器,用大头模式、近战缴械或无需换弹等规则重新混合关卡。
整套战役支持单人、分屏和在线合作,竞技场则允许最多 8 名玩家再加入 8 个机器人。游戏由 Replicant D6 开发,8 月 11 日登陆 Steam,暂不支持中文;Steam 当前 723 篇评价中约 88% 为好评,整体为「特别好评」,国区现售 72.83 元。
#欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。


