ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

中国开放权重模型崛起:海外AI研发新引擎,技术输出引领全球新趋势

时间:2026-08-28 03:07:58来源:互联网编辑:快讯

近年来,中国开放权重模型在全球人工智能产业链中的参与度显著提升,Kimi、DeepSeek等模型的能力不断增强,正成为海外企业开发新模型和产品的重要技术支撑。从直接作为基础模型接受训练,到提供合成数据、模型架构参考,中国模型的技术输出形式日益丰富,国际影响力持续扩大。

美国法律AI公司哈维近期发布的Tenet模型,便是这一趋势的典型案例。该模型以中国月之暗面公司开发的Kimi K3为基础,通过约1750个专业化法律工作智能体环境进行迭代优化,历时两个月完成训练。测试数据显示,专项训练后的Tenet在综合法律实务任务中的完成量接近原始Kimi K3的两倍,合同起草、审查等专项任务的完成量也提升约20%,同时保留了原模型的通用法律知识能力。相比之下,市场上多数通用模型在专业场景中的任务完成率不足10%,凸显了中国模型在垂直领域的技术优势。

在编程领域,中国模型同样表现活跃。美国AI编程平台“光标”代码编辑器所属公司今年3月发布的技术报告显示,其开发的Composer 2模型以Kimi K2.5为基础,通过代码数据预训练和强化学习优化,实现了从通用模型向专项智能模型的转型。5月推出的Composer 2.5进一步扩大训练规模,性能持续提升。美国“认知”公司和英国Cosine公司也基于Kimi模型,通过强化学习提升软件工程能力,推出了各自的AI软件工程产品。

中国模型的影响力还延伸至训练数据和架构设计。开放人工智能研究中心前首席技术官米拉·穆拉蒂创办的思维机器实验室,在研发首款开放权重模型Inkling时,虽未直接采用中国模型作为基础,但其混合专家架构主要参考了DeepSeek V3的技术路线。在后训练阶段,该实验室还使用Kimi K2.5等模型生成合成数据,用于首轮监督微调,体现了中国模型在技术生态中的渗透力。

过去,AI企业普遍依赖闭源模型追求前沿技术,但随着中国开放权重模型能力的提升,这一局面正在改变。部分中国模型已跻身全球前沿行列,为海外企业提供了闭源模型之外的替代方案。尤其是在人工智能向智能体演进的背景下,模型能力评估标准从知识回答转向复杂任务执行,垂直领域的后训练更注重任务执行能力。Cursor、哈维等公司通过在接近真实业务的环境中开展强化学习,使模型掌握信息搜索、工具调用等技能,进一步凸显了中国模型在任务适配性上的优势。

开放权重模型的另一大优势在于成本和控制。企业可自主部署、优化和训练这些模型,在大规模调用场景下降低单位推理成本,提高部署灵活性,减少对外部API的依赖。这种特性使其在需要高频调用的业务中更具竞争力。

更多热门内容
阿里云全新Qoder智能体工作台亮相 集成前沿模型助力开发数据处理
8月27日消息,阿里云今日发布一款以Coding为核心能力,面向所有人的智能体工作台——全新Qoder。 全新Qoder采用更加简洁、以任务为中心的用户界面,内置包括Qwen3.8-Max在内的多款前沿模型。…

2026-08-28

百度搭子全新升级:个人企业双版齐发,专业套件助力AI办公迈向新高度
百度搭子围绕“交付即惊艳”宣布个人版、企业版、专业套件及工作台能力一揽子升级,重点面向自媒体、金融等专业场景,覆盖选题策划、资料研究、内容制作、财报分析、行业研究和报告输出等任务,并形成可用于发布和汇报的图文…

2026-08-28

前Meta科学家创立Perceptron:视觉AI赋能工业,开启自动化新篇章
Aghajanyan和Shrivastava认为,他们的工具与现有模型的不同之处在于其通用性——它并非为某一特定的重复性任务而构建,而是能够根据所处的具体环境或情境灵活适应。A:Isaac 0.5是Per…

2026-08-28

阿里千问Qwen3.8-Flash发布:新架构赋能,成本大降性能跃升引关注
模型采用了与此前所有千问大模型完全不同的全新架构:在注意力方面,引入独特的QSA(Qwen Sparse Attention)机制,形成与GDN高效融合的混合注意力架构,可显著降低计算开销,在高缓存命中的1M…

2026-08-28

OpenAI“重启”之路:从失速到聚焦,安全与愿景下的中场博弈
顺理成章地,Codex 开始合并 ChatGPT,对外呈现出来的产品,则是 ChatGPTWork——现在用户不再需要判断应该用什么模型和工具,只需要告诉 AI 自己想要做什么,系统就会在背后自动调度模型…

2026-08-28