中国的ai大模型有哪些:选型分层说明

中国的ai大模型有哪些可以按通用闭源公服、开源开放权重、行业垂直专项三个层级划分,主流通用闭源包含百度文心、阿里通义千问、腾讯混元、字节豆包、科大讯飞星火、月之暗面Kimi;主流开源包含Qwen、GLM、DeepSeek、百川、书生·浦语;另有华为盘古、中国移动九天、紫东太初等行业科研专项模型,面向个人日常、API接入、私有化部署、政企行业定制四类场景可直接分层选型,面向公众提供生成式服务的模型需要完成《生成式人工智能服务管理暂行办法》要求的备案,仅完成备案的模型可对外提供公网生成服务,未备案模型仅用于企业内网纯内部研发测试不受对外服务备案条款约束。

中国的ai大模型主流分类

通用闭源公服模型,权重不对外开放,以在线产品与API服务为主,大多完成生成式AI备案,普通用户可直接通过网页、APP调用。百度文心依托搜索知识体系,综合多模态与专业知识能力较强;讯飞星火长期积累语音技术,语音交互、教育医疗配套工具链较为完善;腾讯混元深度对接微信、企业微信生态,协同办公场景适配度更高;豆包侧重中文日常表达、内容创作与轻量化办公;Kimi核心差异化在超长上下文文档读取。

开源开放权重模型,开放模型权重,允许你下载后本地部署、二次微调、端侧适配,更适合开发者、数据敏感场景、私有化部署需求。阿里通义千问Qwen、智谱GLM、DeepSeek、百川智能Baichuan、零一万物Yi、上海人工智能实验室书生·浦语是当前主流,多数覆盖从7B小参数端侧到大参数旗舰的完整尺寸梯队,生态活跃度较高,适合嵌入自有业务再做行业微调。

垂直行业与科研大模型不主打通用对话能力,基于领域专属数据训练,面向工业、气象、能源、通信、医疗、法律、代码等细分场景。华为盘古聚焦工业、气象、能源场景,中国移动九天面向通信与工业视觉,紫东太初为中科院图文音多模态科研模型,还有一批金融、医疗、代码专用模型,这类多数不直接面向普通C端开放。

选型前先区分部署约束。

中国的ai大模型选型对比

主流通用模型的能力侧重、适配场景差异明确,选型时优先匹配任务属性,下表整理核心区分维度:

模型核心优势优先适配场景典型形态
文心一言知识、多模态、政企生态专业内容、行业方案、图文生成在线服务+API
通义千问Qwen全尺寸开源、代码、云生态开发、私有化、数据处理在线服务+全系列开源
讯飞星火语音交互、教育医疗工具链语音转写、口语交互、教育在线服务+API
Kimi超长上下文、长文档解析论文、合同、书籍级文档处理在线服务+API
豆包中文日常、内容创作、轻量化办公日常对话、文案、短视频脚本在线服务+APP

中国信息通信研究院2023年发布“方升”大模型基准测试体系,配套《大规模预训练模型基准测试-总体技术要求》,从通用能力、应用能力、行业能力、安全能力四个维度做标准化测评,企业批量选型时优先参考该体系的分维度测评结果,参考价值高于单一能力榜单。

优先选择闭源在线服务的场景是个人日常聊天、即时文案、多模态生成、你不想独立维护算力环境;优先选择开源模型的场景是业务数据不能出公网、需要二次微调、端侧嵌入、大批量低成本推理;优先选择垂直行业模型的场景是业务高度专属、通用模型行业幻觉较多、你手里已有稳定领域标注数据。同一个业务链路也可以混合选型,比如在线侧用闭源做对话入口、内网用开源做私有数据处理。

该分类与选型边界不适用于境外服务场景,模型出海提供服务还需要同时符合对应属地的数据与AI监管规则,不能直接沿用国内备案合规结论。

如果你需要在消费级显卡本地运行,优先选用7B至14B参数区间的开源量化变体,可在16GB显存设备完成常规推理,不需要配套旗舰智算集群。

敬慕百科汇集百科知识与游戏文化,带你发现世界的每一个精彩角落。

想要了解更多关于中国的ai大模型有哪些的文章欢迎访问:百科