在过去的70天里,中国人工智能领域经历了一场前所未有的“模型狂欢”。从6月初到8月中旬,至少9家中国AI公司密集发布了超过10款大模型,涵盖推理、编程、多模态和智能体等核心能力。这一现象不仅引发了全球科技媒体的广泛关注,更让CNBC等外媒感叹:美国对先进芯片和技术的出口限制,反而成为了中国AI创新的催化剂。与此同时,这些模型正以惊人的速度融入全球大型企业的业务体系,从汽车制造到电池技术,从消费电子到机器人领域,中国技术正在重塑全球科技生态。
如果说大模型是AI时代的“操作系统”,那么智能助手就是用户与这个操作系统交互的最直观窗口。无论是腾讯的混元Hy3、字节跳动的Seedance,还是月之暗面的Kimi K3,这些模型在对话、编程、图像生成等方面的能力飞跃,直接体现在智能助手的响应速度、理解深度和任务完成度上。而这一轮创新背后,是最新科技与AI技术的深度融合,也是中国企业在压力下迸发出的惊人效率。
70天10余款模型:中国AI的“闪电战”
从6月1日MiniMax发布M3模型开始,中国AI公司就开启了一场密集的“模型发布接力赛”。MiniMax M3凭借前沿的编程能力、100万超长上下文和原生多模态特性,迅速在开发者社区中引起轰动。紧接着,智谱AI在6月12日推出GLM-5.2,专注于超长程任务和高级AI编程,随后又在前不久升级到GLM-5.3,号称“编程能力最强的开源模型”,内部评测较上一代提升50%。
美团也不甘示弱,其LongCat-2.0模型以1.6万亿总参数(激活参数约480亿)的混合专家架构,支持1M超长上下文与原生多步推理,展现出在垂直场景中的深度优化能力。腾讯的混元Hy3正式版则采用295B总参数、21B激活参数的MoE架构,在保证性能的同时控制了推理成本。
月之暗面的Kimi K3是这场发布潮中的一个亮点——全球首个开源3万亿参数级模型,拥有100万Token上下文窗口,性能直接对标GPT-5和Claude Opus 5等全球顶尖闭源模型。字节跳动的Seedance 2.5则延续了统一的多模态音视频联合生成架构,重点提升长叙事和多模态编辑能力。阿里巴巴的Qwen3.8-Max同样不容小觑,2.4万亿总参数在编程、办公及多模态智能体等能力上实现了全面升级。
深度求索(DeepSeek)更是“双响炮”,7月底推出V4-Flash-0731后,8月13日又发布V4 Pro-0813,原生支持OpenAI Responses API格式,针对性适配Codex。在Artificial Analysis Intelligence Index评测中,DeepSeek V4 Pro的AI智能体得分53分,虽然落后于GPT-5.6 Sol的61分和Claude Opus 5的63分,但其平均单次任务成本仅为0.06美元,是Claude Opus 5(2.34美元)的1/39。这种“性能接近、成本仅为1/39”的性价比优势,正是全球企业开始认真审视中国AI模型的关键原因。
成本仅为1/39:性能与价格的双重碾压
长期以来,外界对中国AI模型存在一种刻板印象:便宜但不够好。然而,CNBC援引IDC今年对欧洲企业的调查显示,安全与合规要求、性能优势才是大规模采用中国人工智能模型的最主要两个原因。IDC中国董事总经理Kitty Fok直言:“西方企业使用中国AI模型,很大程度上是因为便宜——这种说法并不准确,企业决策主要由性能驱动,并受到合规要求约束。”
以DeepSeek V4 Pro为例,它在智能体任务上的得分虽然略低于美国顶尖模型,但成本差距巨大。当企业需要处理海量API调用时,0.06美元 vs 2.34美元的区别意味着数百万美元的成本差异。更重要的是,中国模型在编程、推理和多模态任务上的表现正在快速逼近甚至在某些领域超越美国模型。例如,智谱GLM-5.3在编程能力上已经达到开源模型中的顶级水平,而阿里Qwen3.8-Max在办公和多模态智能体方面表现突出。
这种“性能接近、价格极低”的格局,让全球企业开始重新评估供应商选择。福特借助宁德时代的电池技术,大众与小鹏合作开发智能电动汽车,Stellantis扩大与零跑汽车在电动车生产和联合采购方面的合作——这些案例表明,中国技术正从“低成本制造”转向“规模化制造+深度创新”。Counterpoint Research首席分析师Soumen Mandal指出:“成本、规模、制造能力、供应链整合程度和创新速度,推动全球企业继续与中国企业合作。”
与此同时,AI技术的进步也在降低使用门槛。当企业可以通过AI工具导航快速找到合适的模型服务,或者利用AI工具箱进行二次开发时,中国模型的开源特性就成为了巨大的优势。
开源策略:让全球开发者“用脚投票”
与美国的Anthropic和OpenAI不同,阿里巴巴、DeepSeek、智谱等中国企业重点发展开源模型。月之暗面的Kimi K3是全球首个开源3万亿参数级模型,智谱GLM系列一直坚持开源路线,DeepSeek也提供了V4系列的多个版本供开发者使用。这种策略让全球开发者能够自由访问、下载、微调甚至商用这些模型,加速了技术的传播和迭代。
Omdia首席分析师Lian Jye Su表示,美国限制先进半导体出口虽然约束了中国在尖端芯片领域的发展,却也加快了中国本土创新和效率提升。在开源生态中,中国供应商目前仍在人工智能、电池和汽车软件领域保持竞争力。当一个开发者可以在几小时内下载并部署一个与GPT-4性能相当的模型,且无需担心出口管制时,开源就成为了最好的“破圈”工具。
此外,开源模型还带来了合规优势。对于欧洲企业而言,使用开源模型意味着可以完全控制数据流向,避免因使用闭源API而产生的数据隐私风险。这也解释了为什么IDC调查中“安全与合规要求”成为采用中国AI模型的首要原因。
为了进一步降低开发者的实践门槛,一些平台开始提供AI画图、文生图、古诗词生成等垂直工具,这些工具不仅展示了模型能力,也为企业提供了快速验证场景的途径。而AI图片生成和抠图等工具则让创意工作者能够直接体验大模型的视觉能力。
美国限制:倒逼出的“创新加速度”
CNBC在8月13日的报道中明确指出,美国持续收紧对中国先进芯片、芯片制造设备及部分投资的限制,但中国技术正加速进入全球大型企业的业务体系。这一看似矛盾的现象背后,是“压力产生动力”的经典逻辑。
限制先进芯片出口,的确让中国AI公司在训练超大模型时面临算力瓶颈。但中国企业迅速转向了效率优化路线:混合专家架构(MoE)被广泛采用,在相同算力下实现更大参数规模;模型蒸馏和量化技术让推理成本大幅降低;超长上下文窗口成为标配,减少了对多轮交互的算力依赖。这些技术突破,反而让中国模型在效率和成本上具备了独特优势。
与此同时,美国限制也促使中国AI公司加速海外布局。例如,DeepSeek V4 Pro原生支持OpenAI Responses API格式,就是为了让全球开发者能够无缝迁移。这种“兼容+超越”的策略,让中国模型在全球化竞争中拥有了更多筹码。
Mandal预计,中国技术将在电动车、电池、消费电子、机器人、无人机,以及部分人工智能和半导体领域继续扩大全球应用。这将推动形成更加碎片化、但更注重实际利益的全球技术生态。换句话说,未来的科技世界不再是“美国一家独大”,而是一个多极化的、以实用主义为导向的生态。
智能助手重塑:从对话到全能型Agent
在这一轮大模型密集发布中,智能助手的能力边界被大幅拓展。过去,智能助手只能完成简单的问答和任务执行;现在,借助长上下文窗口、多模态理解和编程能力,智能助手已经可以扮演“数字员工”的角色。
例如,腾讯混元Hy3和智谱GLM-5.3能够处理超长文档、编写复杂代码,甚至进行多步推理。字节跳动的Seedance 2.5则展示了多模态音视频联合生成的能力,让智能助手能够“看懂”视频并生成相关内容。这些能力让AI Agent技术从概念走向了实际应用,企业可以构建自动化工作流、智能客服、代码审查等场景。
更值得关注的是,中国模型在智能体(Agent)领域的进步。DeepSeek V4 Pro在AI智能体评测中得分53分,已接近GPT-5.6的61分。这意味着,在自动化任务执行、工具调用、环境交互等方面,中国模型已经具备了实用价值。当企业需要构建一个能够自主完成任务的智能助手时,成本仅为美国模型的1/39,这无疑会加速企业的数字化转型。
对于个人用户而言,智能助手的进化同样令人兴奋。通过AI网名、艺术签名等创意工具,普通用户也能感受到大模型带来的乐趣。而企业数字化转型的浪潮,则让智能助手从“玩具”变成了“生产力工具”。
未来生态:碎片化中的实用主义
IDC中国董事总经理Kitty Fok的观点颇具洞察力:“中国在5年前是全球企业销售产品的主要市场;如今,在部分行业,中国已经成为这些企业获取技术能力的来源。”这一转变标志着全球技术生态正在发生结构性变化。
未来,我们可能会看到两个平行的AI生态:一个是以美国为中心的闭源模型生态,另一个是以中国为中心的开源模型生态。两者将相互竞争、相互借鉴。企业将根据自身需求选择供应商——如果追求极致性能且预算充足,可能选择GPT-5;如果追求性价比和合规灵活,中国模型将是更优解。
与此同时,最新科技的演进速度将进一步加快。中国企业在60天内推出10余款模型,这种速度本身就说明了一切。当美国限制试图扼杀中国AI时,反而催生出一个更高效、更务实、更开放的中国AI生态。
对于全球科技媒体而言,这不仅仅是一个关于“制裁与反制”的故事,更是一个关于“创新如何突破封锁”的现代寓言。而智能助手,作为这场变革中最贴近用户的载体,将直接见证并参与这一历史进程。