国盛证券：AI大模型的“Linux时刻”降临如何看待未来竞争格局？

作者：智通财经张计伟 2023-05-31 15:30:11

资本市场也在关注大模型未来竞争格局如何，模型小了是否不再需要大量算力，数据在其中又扮演了什么角色?

智通财经APP获悉，国盛证券发布研究报告称，对大模型的看法应该分时、分层看待。1)短期内，OpenAI的GPT系超大模型仍然超越众开源大模型，因此，应当重点关注与其在股权和产品上深度合作的微软、能获得ChatGPTios App收益分成的苹果，以及超大模型的算力服务商英伟达等;2)中长期来看，如果部分开源大模型能力被进一步验证，则应用将快速铺开，大模型对算力将形成正循环;3)其他：边缘算力、大数据公司和开源大模型服务商业态也值得关注。

国盛证券主要观点如下：

ChatGPT发布后不久，Meta就开源了类GPT大语言模型LLaMA，此后，Alpaca、Vicuna、Koala等多个大模型诞生，它们以远低于ChatGPT的模型规模和成本，实现了令人瞩目的性能，引发业内人士担忧“谷歌和OpenAI都没有护城河，大模型门槛正被开源踏破，不合作就会被取代”。资本市场也在关注大模型未来竞争格局如何，模型小了是否不再需要大量算力，数据在其中又扮演了什么角色?本报告试图分析这波开源大语言模型风潮的共同点，回顾开源标杆Linux的发展史，回答这些问题。

共同点一：始于开源。开源≠免费，开源的商业模式至少包括：1、靠服务变现。曾上市、后被IBM收购的Linux企业服务公司红帽即是一例。企业为了更稳定和及时的技术支持，愿意付费。2、靠授权费变现。安卓开源，但谷歌向欧盟使用安卓谷歌套件的厂商收取许可费即是一例。3、许可证、标准和能力评价体系的发展，是开源大模型商用程度深化的催化剂。这波开源大模型采用的许可证协议主要是Apache 2.0和MIT，它们不禁止商用，并且不禁止用户修改模型后闭源，这有助于公司应用此类大模型。

共同点二：参数少、小型化。相较于GPT3+千亿参数超大模型，这波开源大模型的参数量普遍在十亿至百亿级别。目前尚没有一套系统的大模型性能评价体系，其中仅部分任务有公信力较强的评分标准。开源大模型中，Vicuna的能力也较强，在部分任务能达到92% GPT4的效果。总体来说，OpenAI GPT系仍一骑绝尘，但训练成本高，难复现。而开源大模型借助更大标识符训练数据集、DeepSpeed、RLHF等方式，实现低训练成本和高性能，超大模型以下大模型的壁垒正在消失。

共同点三：数据集重视人类指令，并走向商用。ChatGPT相较于GPT3效果大幅提升的重要因素是使用了RLHF(基于人类反馈的强化学习)，即在训练中，使用人类生成的答案和对AI生成内容的排序，来让AI“对齐”人类偏好。LLaMA没有使用指令微调，但LLaMA之后的大量大模型使用并开源了指令数据集，并且逐步探索自建指令数据集，而非使用有商用限制的OpenAI的，进一步降低了复现GPT的门槛，扩展了商用可用性。

接下来怎么看开源大模型?

站在开源大模型浪潮中，该行注意到两个趋势：1)与多模态融合，清华大学的VisualGLM-6B即是著名开源语言模型ChatGLM的多模态升级版，该行认为，其可基于消费级显卡在本地部署的特性是大势所趋。2)开源模型+边缘计算推动AI商用落地，哈尔滨大学的中文医疗问诊模型“华驼”以及在跨境电商的使用就是案例。

建议关注：

1)智能模组服务商：美格智能(002881.SZ)、广和通(300638.SZ);

2)边缘IDC服务商：龙宇股份(603003.SH)、网宿科技(300017.SZ);

3)光模块服务商：中际旭创(300308.SZ)、新易盛(300502.SZ)、天孚通信(300394.SZ)、源杰科技(688498.SH);

4)传统的IoT通信芯片厂商：有望受益行业上行过程。建议关注：中兴通讯(000063.SZ)、工业富联(601138.SH)、翱捷科技(688220.SH)、初灵信息(300250.SZ);

5)应用端标的：恺英网络(002517.SZ)、神州泰岳(300002.SZ)、佳讯飞鸿(300213.SZ)、中科金财(002657.SZ)等。

风险提示：伦理风险、市场竞争风险、政策法律监管风险。

智通声明：本内容为作者独立观点，不代表智通财经立场。未经允许不得转载，文中内容仅供参考，不作为实际操作建议，交易风险自担。更多最新最全港美股资讯，请点击下载智通财经App

国盛证券：AI大模型的“Linux时刻”降临 如何看待未来竞争格局？

国盛证券：AI大模型的“Linux时刻”降临如何看待未来竞争格局？