SCR-SELF-1472026-06-01会员报告 · 单篇 ¥29919 分钟阅读

大模型改变人工智能工程范式

人工智能大模型的出现,改变了人工智能模型的训练模式,提升了训练的起点,突破了原有小模型的不足和瓶颈,提高了机智的水平,带来了人工智能工程的新范式。企业应该认识到这一革命性突破的意义,探索应用大模型解决企业难题,构建企业基础模型,进而打造企业智机母体,为实现双智协同的业务奠定基础。

大模型改变人工智能工程范式

AI革命:大模型改变人工智能工程范式

尚参科技

2023年7月

摘要

人工智能大模型的出现,改变了人工智能模型的训练模式,提升了训练的起点,突破了原有小模型的不足和瓶颈,提高了机智的水平,带来了人工智能工程的新范式。企业应该认识到这一革命性突破的意义,探索应用大模型解决企业难题,构建企业基础模型,进而打造企业智机母体,为实现双智协同的业务奠定基础。

主要发现

大模型不仅仅是语言模型,也包含了多模态大模型,可以处理视频、音频、图像和结构化数据

大模型是人工智能领域革命性的突破,其智能涌现和泛化能力使人工智能拥有了较高的智能

大模型不仅仅可以用于内容生成,也可以用于数据分析建模和算法提炼

大模型用于数据分析建模将彻底改变现有的数据分析模式,带来人工智能工程新范式

应用大模型可以实现基础模型的构想,在基础模型之上可以训练出各种小模型和专业模型

建议

企业应该认识到大模型的革命性意义,把应用大模型创建的基础模型作为实现双智协同的业务的“底座”

探索大模型对业务的价值,在企业面临的难题中寻找应用场景

在对大模型进行选择时,企业应该综合考虑大模型的适用性、安全性和投入产出比

要提高对大模型的掌控能力,其中管理能力是不可或缺的能力,技术能力是加分项

基础模型是人工智能领域的一种设想,希望有一种模型可以成为其他模型的基础,使其他模型在基础模型之上被训练出来。在大模型产生之前,这样的设想没有完全实现。很难说大模型是基础模型的唯一选项,但大模型可以成为基础模型却是毋庸置疑的。我们曾经分析过,大模型是指模型参数(神经网络中神经元之间连接特征值指标)数量巨大。普遍认同的标准是30亿以上,当前国内许多企业的说法是参数数量在10亿以上,就可以被看做大模型。其实模型大不大是一个相对概念。当模型为了完成某种特定任务,其输出正确率高于随机值时,就说明大模型已经出现了涌现能力。此时的参数数量为临界值。当准确率达到可靠性要求时,大模型就达到了可用的程度,此时的参数数量对所需的任务来说就是足够大的。

大模型是因为AIGC的需要而被开发出来的,因为要使机器通过学习掌握大量的知识,从而具有生成内容的能力。当学习的知识量不够大时,模型没有足够的智能产生有意义的内容,所以需要大量的训练材料。随着训练材料的增多,要求计算速度越来越快,模型也变得越来越大,最终导致了大模型的产生。因为大模型是为了实现AIGC而生的,也因为近期大部分大模型都主要用于AIGC的任务,就使人们误以为大模型只能用于内容产生,而忽略了它们的另一个更重要的价值领域,即基础模型的价值。而这一领域的价值,将有可能彻底人工智能工程的范式,即从“小学生”开始训练模型的模式转变成从“大学生”开始训练模型的模式。

增强型数据分析,人工智能的一种有意义但不太成功的尝试

从大数据的概念开始流行以来,企业纷纷建立了大数据管理系统和大数据分析系统,希望通过历史数据和当前数据发现数据之间的关联和规律,并把这些发现用于对当前态势的分析和未来的预测。但在增强型数据分析技术之前,对数据分析模型的设计主要依靠模型设计师对业务的理解,进行人工的设计。人工设计模式要求设计师对业务有足够的理解,因此设计师的业务能力和设计能力会成为数据分析模型的限制。一方面,人工设计效率很低,不可能在较短的时间内完成业务所需的模型,人工能够完成的模型总量十分有限。另一方面,因为设计师对业务的理解不够充分,设计的结构无法全面反映业务的规律,形成设计偏见。在机器学习被引入大数据分析领域以后,这些情况出现了好转。因为通过机器学习自动发现数据中的样式(Pattern)可以大大提高模型生成的效率,同时能够突破设计师的认知局限,使分析模型的数量和质量都有可能获得较大程度的提升。如果采用人工设计分析模型,一个设计师用一年的时间能够设计的模型也是非常有限的。而采用增强型数据分析技术,可以在几分钟之内产生出几千种分析模型。当然,对这些模型的有效性验证仍然需要一些时间,但毕竟效率大幅度提高了。

据调研的情况,有相当数量的企业已经采用增强型数据分析技术。但总体的应用效果并不理想。主要的原因有两个,一是对增强型数据分析的技术掌握得不好,不能有效发挥其效能。二是增强型数据分析本身也存在缺陷,因为机器只能发现相关性,不能发现因果性。同时,机器学习的重点在于发现数据分析模型,而不是提升机器学习模型自身的能力。在有些应用场景中,比如各种智慧大脑的应用中,虽然提升智慧大脑的能力是重点,但经过长期的训练发现,当智慧大脑的能力提升到一定程度后,似乎达到了能力的天花板,无论如何训练都不能获得提升了。比如无人驾驶系统最终无法克服复杂交通环境的困难,语言翻译系统的错误率保持在20%左右无法进一步消减。在医疗领域,对医学图像的识别也同样遇到了天花板,总是不能达到人类专家的水平。面对这些问题,人们首先想到的是训练的数据质量或数量存在不足,但是在设定的领域能够获得的高质量的数据是十分有限的,很难突破。问题如何解决呢?于是人工智能领域出现了一些科学家再次追问人智与机智的区别问题(比如Yann LeCun)。

Yann LeCun发现,人类在学习过程中不像机器在学习过程中需要大量的数据。比如学开车,只要老师教几个简单的动作,人就可以开始练习了

登录后查看全文

本报告为会员内容,登录后可根据权限阅读。

相关报告推荐

SCR-S269512026-06-04

让每个社区图书馆都拥有专业阅读推广人的荐书与导读能力:公共文化服务的双智协同普惠实践

本报告提出,提升社区图书馆阅读推广能力的关键路径在于构建“双智协同”机制——即以专业人才的智力支撑与数字技术的智能赋能双向驱动,实现服务可及性、适配性与可持续性的统一。当前基层阅读服务面临专业力量薄弱、资源供需错位、活动同质化等共性挑战,单纯依赖硬件投入或短期项目难以形成长效能力。实践表明,通过系统化培育在地化阅读推广人,嵌入轻量化、模块化的数字工具支持,可显著增强其选书研判、分众导读与社群运营能力,使服务真正扎根社区需求。该模式不追求规模扩张,而重在激活存量设施的服务韧性,推动公共文化服务从“有”向“优”、从“均等”向“精准”跃升。其本质是将人的专业判断力与技术的响应效率有机结合,在降低专业

SCR-S269532026-06-04

将优秀电竞战队教练的战术分析与临场指挥经验蒸馏为智能战术助手:电竞产业的双智协同创新

本报告提出,将顶尖电竞教练的战术分析逻辑与临场决策经验系统化提炼,并转化为可嵌入训练与赛事支持流程的智能战术助手,是推动电竞产业向“人机协同”深度演进的关键路径。这一过程并非简单复制经验,而是通过知识蒸馏、行为建模与场景化推理,将隐性判断显性化、碎片策略结构化、动态响应标准化。实践中,该模式有效弥合了高水平教练资源稀缺性与规模化人才培养需求之间的鸿沟,同时提升了战术复盘的颗粒度与实时决策的响应质量。其本质是认知智能与领域智能的双向赋能:一方面,AI强化人类教练的经验沉淀效率与跨场景迁移能力;另一方面,人类专家持续校准模型的战术合理性与竞技语境适应性。该路径已初步验证在选手培养、赛前推演及临场辅

SCR-S269542026-06-04

利用大模型辅助企业进行多版本产品说明书的跨语言一致性校验:确保全球用户获得统一准确的信息

当前,全球化运营的企业普遍面临多语言产品说明书版本间信息不一致的挑战,这不仅影响用户体验与品牌信任,还可能引发合规风险。本报告提出一种以大语言模型为技术底座的跨语言一致性校验方法,通过语义对齐而非字面比对,实现对核心功能描述、安全警示、操作步骤等关键内容在不同语言版本间的深度一致性评估。该方法将说明书文本转化为结构化语义表征,在统一语义空间中进行跨语言匹配与偏差识别,有效规避了传统机器翻译回译或关键词匹配带来的语义失真问题。实践表明,该方案显著提升校验效率与覆盖广度,同时降低人工复核成本;更重要的是,它将语言一致性从“形式合规”推向“意图等效”,使全球用户无论使用何种语言,均能准确理解产品功能