电子报阅读机
2026-08-23
星期日
当前报纸名称:中国电子报

中国AI模型公司近期大事

日期:08-18
字号:
版面:第04版:人工智能       上一篇    下一篇

阿里巴巴

8月14日,阿里云千问团队正式宣布开源Qwen3.8系列模型,所有开发者、科研机构和企业均可自由下载、部署及商用。其中,备受全球AI社区期待的Qwen3.8-27B(270亿参数)模型率先上线,成为本次开源的核心亮点。Qwen3.8-27B是一款原生多模态稠密(Dense)模型,原生支持262K上下文,通过YaRN技术可外推至1M Tokens。在性能表现上,该模型较前代Qwen3.6-27B在编程和办公场景中实现大幅提升,整体表现甚至超越了Qwen3.7-Plus。模型新增的reasoning_effort功能可根据任务难度动态控制思考深度,有效节省计算资源。

智谱AI

8月14日,智谱发布GLM-5.3。智谱称GLM-5.3为“编程能力最强的开源模型”,在前一代GLM-5.2相同的基座模型基础上,通过后训练大幅提高了模型的编程能力和网络安全能力,在内部评测中较GLM-5.2提升50%。

DeepSeek

7月31日,DeepSeek在API文档更新日志中低调宣布V4-Flash正式版,该模型总参数2840亿、激活参数130亿,定位高效低成本推理场景。与常规认知中“Pro强、Flash弱”的分层逻辑不同,此次升级最引人关注的是,V4-Flash正式版在智能体(Agent)能力上实现了对自家V4-Pro预览版的全面反超。8月13日,DeepSeek推出DeepSeek-V4-Pro-0813正式版,同时宣布自8月17日起实行峰谷分时定价机制。

字节跳动

7月31日,字节跳动正式发布新一代视频创作模型Seedance 2.5。该模型延续了Seedance 2.0统一的多模态音视频联合生成架构,重点突破长叙事能力、多模态参考能力和编辑能力。

华为

7月31日,华为正式宣布开源盘古5050亿参数的openPangu-2.0-Pro模型。openPangu是华为开源AI模型品牌,致力于通过昇腾原生训练与推理技术打造Agent时代的智能底座。

MiniMax

7月17日,MiniMax首次公开发布旗舰全模态大模型M3,并预热新一代多模态生成模型H3。7月31日,MiniMax发布新一代多模态生成模型MiniMax H3,支持文本、图像、视频、声音组成的多模态上下文的统一理解能力,能够输出具备原生双声道的音视频,最高可支持15秒2K分辨率。

月之暗面

7月16日,月之暗面公司发布新一代旗舰模型Kimi K3。模型发布后市场反响强烈,短时间内用户请求量快速增长。过去48小时后,由于用户请求量远超预估并逼近现有集群承载极限,月之暗面公告暂停C端新增付费订阅,并加快推进算力扩容。7月27日,Kimi K3正式全面开源,同步放出完整模型权重、技术报告及三项核心训练基础设施技术。

腾讯混元

7月6日,腾讯混元Hy3正式发布。7月21日,腾讯混元宣布推出Hyra(Hunyuan Research Agent)首个版本Hyra-1.0,次日上线Miora,定位为有记忆、能理解需求、能调用多智能体(Agent)协作的AI创意智能体。8月13日,腾讯微信团队在X平台公布大语言模型家族WeLM系列,包含80B(800亿)和617B(6170亿)两个参数量的版本,后者在参数量上已经超过混元Hy3正式版。腾讯总裁刘炽平在财报电话会上表示,正在训练“更大参数的模型”Hy4,计划在年内推出。

(本报记者谷月整理)