本期速览:
1. DeepSeek最高调价涨1100%;
2. 平安健康5名董事同日辞任;
3. 李彦宏称要让文心重新回到第一梯队;
4. 曝 DeepSeek 正研发情感 AI 模型;
5. xAI多模态负责人加入腾讯混元,钟钊被曝离职;
6. 传腾讯混元研究员徐灿转岗微信WeLM团队;
7. 字节Seed组织调整,新设4个一级部门;
8. 中科第五纪连续完成A1、A2轮融资。
1.DeepSeek API大幅调价,缓存命中输入暴涨至原价12倍
8月17日零时,DeepSeek新版API定价正式生效,对V4 Pro和V4 Flash两款模型进行大幅调价,并引入峰谷分时计价机制。高峰时段为北京时间9:00至12:00、14:00至18:00,共7小时,其余17小时为空闲时段,空闲时段价格为高峰时段的一半。
旗舰模型V4 Pro调整幅度最大。高峰时段缓存命中输入价格从每百万Token 0.025元涨至0.3元,涨幅达1100%,约为原价的12倍;缓存未命中输入从3元涨至9元,涨幅200%;输出从6元涨至27元,涨幅350%。
空闲时段对应价格分别为0.15元、4.5元和13.5元。V4 Flash同步上调,高峰时段缓存命中输入涨至0.1元,涨幅400%,缓存未命中输入和输出分别涨至3元和9元,涨幅各为200%和350%。
这是DeepSeek发布以来单次幅度最大的一轮提价。有开发者反映,涨价前每月API支出约3000元,调价后按相同用量测算月成本将升至近1万元。
2.李彦宏:目标让文心重新回到第一梯队
8月18日百度发布2026年第二季度财报后,百度董事长兼CEO李彦宏在财报电话会上表示,基础大模型仍在快速迭代,竞争格局远未尘埃落定,长期竞争力源自持续技术投入、应用驱动思路及耐心。
他坦言文心一路走来有尝试也有失误,但公司近期已优化组织架构并引进顶尖AI人才,有信心加快人工智能迭代,让文心重新回到基础大模型的第一梯队。
李彦宏表示未来不会追求所有维度全面领先,将聚焦AI搜索、数字人、秒哒、伐谋及通用智能体等核心应用场景,用真实应用推动模型迭代。
3.平安健康5名董事同日辞任 朱友刚接任董事会主席
8月18日,平安健康医疗科技有限公司发布公告,宣布郭晓涛、付欣、蔡方方、周永健、朱梓阳五名董事因个人工作安排辞任。其中郭晓涛为平安集团联席CEO,付欣为集团副总经理兼首席财务官,蔡方方为集团副总经理。周永健辞任独立非执行董事,朱梓阳辞任非执行董事。
前述变动自8月19日起生效,公告称,五名离任董事均已确认与董事会无意见分歧,亦无其他事项须提请股东及联交所关注。
同日,平安好医生董事会审议通过新任人选,朱友刚获委任为董事会主席、非执行董事。此外,席通专获任执行董事,范彦君获任非执行董事,李国栋获任独立非执行董事。
此次调整涉及董事会超过半数成员,在平安体系子公司人事变动中较为少见。
4.xAI多模态负责人蔺旭东加入腾讯混元,钟钊被曝离职
腾讯混元多模态团队近期接连发生人事变动。据媒体报道,xAI多模态理解负责人蔺旭东已离开xAI,加入腾讯混元担任多模态内容生成算法负责人。
蔺旭东2024年博士毕业后先后任职谷歌DeepMind和xAI,参与Gemini多模态预训练与后训练工作。
与此同时,混元文生视频和文生图片算法负责人钟钊被曝已离职,其不久前在朋友圈发文称“也许即将发布的版本将是我在心爱的HunyuanVideo和HunyuanImage中的最终版本”。
上述变动发生在腾讯混元组织架构密集调整的背景下。7月初,曾在OpenAI与姚顺雨共事的田永龙加入混元多模态团队。7月24日,腾讯将大语言模型部和多模态模型部合并成立基础模型部,由首席AI科学家姚顺雨统一负责。原多模态理解负责人胡瀚于7月离职创业。
5.科大讯飞上半年营收116.23亿元,研发投入超30亿元
8月20日,科大讯飞发布2026年半年度报告,上半年实现营业收入116.23亿元,同比增长6.52%;归属于上市公司股东的净利润亏损2.04亿元,上年同期亏损2.39亿元,同比减亏14.68%。扣除非经常性损益后的净利润亏损达6.37亿元,同比下降74.88%。亏损主要系公司主动推进业务战略聚焦,收缩传统项目型业务,同时加大星火大模型新版本研发投入及AI学习机、AI眼镜等新品推广等战略性费用所致。上半年研发投入达30.07亿元,同比增长25.73%,占营收比重超25%。
分业务看,智慧医疗同比增长58.56%,开放平台同比增长36.01%,智慧教育微降1.16%。公司Q2净利润亏损0.34亿元,环比Q1的-1.7亿元有所收窄。
6.字节Seed组织调整,新设4个一级部门
字节跳动大模型部门Seed已于上周完成新一轮组织调整。Seed Foundation Model(Seed基础模型)新设四个一级部门,负责人均向吴永辉汇报。
Pretrain Data由李成刚负责,整合原先分散在文本、编程、视觉和语音等方向的预训练数据团队,统一负责新Omni模型的多模态数据及超大模型预训练数据工作。Horizon RL由唐晟宇负责,整合后训练、推理和视觉理解等相关团队,主攻强化学习方向。
后训练团队被拆分为两条线:秦禹嘉负责Product Posttrain-Work,主要服务B端应用,负责Agentic模型的整合发布及办公场景优化;原Application团队更名为Product Posttrain-Chat,仍由朱文佳负责,主要服务C端对话模型。
Seed还为AI安全及其他前沿方向分别任命了负责人。此次调整旨在“合并相似工作、减少重合”,此前按模态划分的团队边界日益模糊导致重复劳动和沟通成本增加。
7.豆包工作任务模式上新,集成技能工具与协作智能体
8月21日,字节跳动旗下AI助手豆包宣布工作任务模式上新,技能、连接器、工作伙伴/小队三项功能同步上线。
技能用于将常用工作步骤和标准保存为可复用的标准化流程,连接器打通豆包与飞书、钉钉、企业微信及百度网盘等应用的数据通道,工作伙伴提供覆盖数据分析、内容策划等领域的专业智能体,用户可组合多个智能体形成小队协同完成复杂任务。
三项功能已在豆包电脑版侧边栏上线,支持独立使用或灵活组合搭配。目前豆包内已上架超过200个技能和连接器,支持用户自定义新建。
8.曝 DeepSeek 正研发情感 AI 模型
报道称,DeepSeek 正在研发一款情感 AI 模型,目标是让模型具有更接近人类对话的语言风格,并形成稳定的角色与个性表达。
报道将这项工作与 DeepSeek 已有的编程和通用基础模型路线区分开来,新方向更接近长时间对话和陪伴型产品。相关研发尚处于进行阶段。
9.传腾讯混元研究员徐灿转岗微信WeLM团队
据媒体报道,腾讯混元大模型后训练负责人徐灿已于近期转岗至微信事业群,加入WeLM(微信大语言模型)团队。
徐灿2025年5月从微软离职后加入腾讯混元,此前为WizardLM项目创始人,曾任微软人工智能高级研究科学家,为微软小冰、必应、WizardLM和Phi-3等项目贡献核心技术。
此次调整正值微信AI加速落地阶段,WeLM-80B模型已部署于微信原生AI助手“小微”,WeLM-617B仍在开发中。
10.腾讯TEG运营管理部推行负责人制度
近日,腾讯TEG(技术工程事业群)运营管理部正式推行负责人制度,旨在淡化职级观念、简化管理层级。
新制度下,原先的“总经理”“总监”等头衔统一简化为“组织负责人”或“领域负责人”。大语言模型部、多模态模型部等多个AI研发团队已被纳入试点范围。
11.千问AI平台接入GLM-5.3与DeepSeek-V4-Pro正式版
8月21日,阿里云MaaS平台宣布扩充模型服务矩阵,智谱旗舰大模型GLM-5.3与DeepSeek-V4-Pro正式版接入千问AI平台,相关API服务同步开放,开发者可直接调用。
两款模型重点覆盖编程和智能体应用场景,GLM-5.3强化了编程、长程任务处理和网络安全能力,DeepSeek-V4-Pro重点增强智能体能力,可用于代码开发与复杂任务处理。
12.阿里推出AI音乐模型HappyShrimp 1.0
8月17日,阿里巴巴发布自研AI音乐生成模型HappyShrimp 1.0(快乐虾米),由TokenHub事业群研发,是阿里“Happy”系列AI模型的第三位成员。
模型基于文字描述即可完成从作词、作曲、编曲到演唱的完整歌曲创作,支持自然语言交互,既能理解“Lo-fi R&B”等专业标签,也能理解“适合在咖啡馆播放的曲子”这类生活化描述。
HappyShrimp采用端到端整曲生成技术,歌词、旋律、编曲与人声同步生成、一体成型,针对AI音乐中常见的人声机械、词曲错位等问题进行了优化。产品同步上线国内外网页端并开放体验,上线首日宣布与太合音乐集团达成战略合作。
13.微信灰测图片 AI 处理入口
据「赛博禅心」,微信正在部分用户中灰测图片 AI 处理入口。测试界面会在聊天图片底部显示「AI 处理」标识,点击后可直接进入美化、信息提取和修改三组工具。
现有功能包括人像美化、滤镜、换背景和风格转换,也可提取文字、总结和翻译图片内容、生成文档;修改类工具则包含消除杂物、打马赛克和提升清晰度,更多复杂操作会跳转至小微。该功能目前仍处于灰度测试阶段。
14.百度文库上线库库 AI,主打跨设备任务接力
百度文库上线「库库 AI」,将项目资料、任务上下文、执行状态与生成文件放入同一工作区。用户可为任务选择项目、专家、模型与技能,生成的 Word、Excel、PPT、网页报告等产物会保存到云盘,供后续继续修改。
产品支持网页、PC 客户端和小程序。用户可授权多台设备,在手机或网页端继续操作已连接的电脑;平台还提供盯盘监控等自动化任务,以及面向金融研究、复杂办公和团队协作的专家与技能模板。
15.极佳视界发布新一代具身基础模型GigaBrain-0.7
8 月 19 日,极佳视界在 2026 世界机器人大会上正式发布新一代具身基础模型 GigaBrain-0.7。该模型首次提出 System-3 预判系统,将世界模型 GigaWorld-1 接入机器人实时决策回路,让机器人在执行动作前先进行任务预演和未来状态预测。
GigaBrain-0.7 依托 “数据金字塔 + 算法金字塔” 双塔体系驱动。同期,极佳视界还发布了通用双足人形机器人 Maker L01,整机搭载 31 个关节电机,最高移动速度达 4 米每秒;公司表示计划开源部分模型基座。
16.中科第五纪连续完成A1、A2轮融资,总金额超10亿元
近日,具身智能企业中科第五纪宣布连续完成A1轮、A2轮融资,总融资金额超过10亿元。其中A1轮由锡高投、中国银行旗下中银AIC基金、三锋投资联合投资;A2轮由芯能创投、中银AIC基金、中山创投、鸿瑞达投资、博彦科技、金创投(浙江省新能源汽车子基金)联合投资。
中科第五纪成立于2024年,是一家围绕具身操作大模型构建产品与解决方案的“具身大脑”公司。创始人兼CEO刘年丰为中科院自动化所博士,师从中国科学院院士谭铁牛。
目前公司海外业务已获得数亿元订单,本轮融资完成后全球化将成为核心发展方向之一。
17.智象未来发布交互式世界模型HiDream-O1-World
8月17日,智象未来(HiDream.ai)正式发布原生全模态交互式世界模型HiDream-O1-World。该模型具备漫游、编辑、交互三大功能,支持文本、图像及交互式操控等多模态输入,用户可一键生成时空一致、符合物理规律、可长时推演的完整世界。
HiDream-O1-World搭载智象自研的原生全模态UiT架构,在时空一致性与物理一致性两大行业难题上取得关键突破,镜头推拉摇移时场景几何结构保持稳定,物体间的碰撞与重力响应符合真实物理逻辑。
模型首次参评交互式视频世界模型评测基准WBench,即在核心Navi分榜中以平均分80.9位列榜首。相关研究成果已入选2026年欧洲计算机视觉国际会议(ECCV)。
18.特斯拉中国正式接入豆包大模型,采用双模型协同方案
8月19日,火山引擎宣布特斯拉中国车机系统已上线豆包大模型,相关功能正陆续向车主推送,覆盖Model 3、Model Y、Model S、Model X全系车型。
此次推送工作早于7月31日启动,用户需将系统升级至2026.14.13或2026.20.200及以上版本,搭载AMD处理器的新款车型优先适配。
特斯拉车机语音采用双模型协同方案,豆包主要负责导航设定、媒体播放、空调调节等车辆控制类指令,DeepSeek Chat侧重闲聊对话与资讯查询。
双方合作始于2025年8月,并于今年4月完成相关备案。这是特斯拉入华以来首次在车机端集成第三方大模型,与美国市场使用Grok形成区域分化。
本期观察
整体来看,行业正经历从技术竞赛到商业落地的关键转折期,头部公司围绕组织架构、产品定价和人才配置展开密集调整。
大模型厂商面临盈利能力与研发投入的双重考验,无论是科大讯飞的战略性亏损、DeepSeek的大幅提价,还是百度明确聚焦核心应用场景的战略转向,都反映出行业从粗放扩张转向精耕细作的共同趋势。
人事层面,平安健康超半数董事同日辞任、腾讯混元多模态团队多起核心人员变动、字节Seed部门重组等事件,表明AI赛道竞争正从技术层面向组织效率和管理机制延伸。
产品与技术侧,特斯拉首次在车机端集成第三方大模型、豆包推出工作任务模式、阿里发布AI音乐模型、极佳视界与智象未来在具身智能和世界模型方向相继发布新品,说明AI能力正加速渗透至具体场景,模型即产品的落地节奏持续加快。
可以预见,随着行业竞争进入深水区,技术与商业的双轮驱动将成为下一阶段的核心主题。
黑马精选