（一文读懂）大模型到底是怎么生成文字的？

柳星聊产品 2024-02-05 11:28:17

在人工智能的领域，大模型在去年已经成为了一个热门的话题。各大厂商如谷歌、微软、OpenAI等，都在积极研发和应用大模型技术。这些模型在语言理解、图像识别、推荐系统等方面都表现出了惊人的能力，甚至在某些任务上，已经超越了人类的表现。

或许你用过，惊叹于它的神奇，或许你没有用过，听着它的传奇。无论如何，都懂那么一点点，但很难讲的清，它到底是怎么生成的？

我们接下来就讲透它生成的原理，并了解四种构建AI应用的大模型技术架构。

一、大模型的生成原理

首先，我们要了解的是，GPT大模型是一种基于深度学习的自然语言处理模型，也就是LLM。

（敲黑板，LLM是一种生成文字的模型，文生图比如DALL·E，它和LLM都是多模态语言模型的分支）它的工作原理可以简单地理解为“学习语言的规律”，它的生成方式只是根据上文，猜下一个词的概率。

（一文读懂）大模型到底是怎么生成文字的？

那它为什么会掌握这么多的知识？那是因为在模型训练过程中，GPT模型会阅读大量的文本数据，然后学习这些文本中的语言规律。

这个过程可以类比为人类学习语言的方式。当我们是婴儿时，我们会通过听父母和周围的人说话，学习语言的规律。

比如，我们会学习到“我”通常后面会跟“是”，“你”通常后面会跟“好”等等。这就是一种语言规律。GPT模型就是通过类似的方式，学习语言的规律。

但是，GPT模型的学习能力远超人类。

它可以阅读数以亿计的文本，学习到非常复杂的语言规律。这就是为什么GPT模型可以生成非常自然、连贯的文本。

二、GPT模型如何学习语言的规律

说到这里，需要我们了解一下GPT模型的内部结构。GPT模型是由多层神经网络组成的。每一层神经网络都可以抽取文本的某种特征。比如：

第一层神经网络可能会抽取出单词的拼写规律；
第二层神经网络可能会抽取出词性的规律；
第三层神经网络可能会抽取出句子的语法规律等等。

通过这种层层抽取，GPT模型可以学习到非常深层次的语言规律。

当GPT模型生成文本时，它会根据已有的文本，预测下一个单词，整体就是通过这种方式，生成连贯的文本。

当然，这只是一个非常简化的版本。实际上，GPT模型的工作原理还涉及到很多复杂的数学和计算机科学知识。

三、大模型的四种应用技术架构

大模型的厉害之处，其实不止在于它很像我们人学习语言，而更大的作用在于它未来会改变我们的生活和职场。从整体现有最新的架构来看，其实有四种大模型的应用架构，从上往下，依次从简单到复杂。

第一种：Prompt（指令工程）

指令工程听着好像很遥远，其实就是通过下面这个输入框触发的：

（一文读懂）大模型到底是怎么生成文字的？

看上去简单，但这个很考验一个人写prompt的“功力”。

prompt的作用就是通过引导模型生成特定类型的文本。一个好的prompt可以引导模型以期望的方式生成文本。例如，如果我们想让模型写一篇关于全球变暖的文章，我们可以给模型一个prompt，如“全球变暖是一个严重的问题，因为…”。模型会根据这个prompt生成一篇文章。

这种方法的优点是简单直观，但缺点是可能需要大量的尝试才能找到一个好的prompt。

第二种：Function calling（函数调用）

Function calling是一种更深入的应用架构，它通过调用模型的内部函数，直接获取模型的某些特性。

例如，我们可以调用模型的词向量函数，获取单词的词向量。

这种方法的优点是可以直接获取模型的内部信息，但缺点是需要深入理解模型的内部结构。

第三种：RAG（Retrieval-Augmented Generation）

RAG是一种结合检索和生成的应用架构。

在这种方法中，模型首先会检索相关的文本，然后用这些文本作为输入，让模型生成答案。

例如，如果我们想让模型回答一个关于全球变暖的问题，模型可以先检索到一些关于全球变暖的文章，然后根据这些文章生成答案。

这种方法的优点是可以利用大量的外部信息，提高模型的生成质量。但缺点是需要大量的计算资源，因为需要对大量的文本进行检索。

第四种：Fine-tuning（微调）

Fine-tuning是一种在特定任务上进一步训练模型的应用架构（如计算钢材的消耗量等等）。

在这种方法中，模型首先会在大量的文本上进行预训练，学习语言的基本规律。然后，模型会在特定任务的数据上进行fine-tuning，学习任务的特定规律。

例如，我们可以在情感分析任务上fine-tuning模型，让模型更好地理解情感。

这种方法的优点是可以提高模型在特定任务上的表现，但缺点是需要大量的标注数据。

最后的话

总的来说，GPT大模型生成结果的原理，就是通过学习语言的规律，然后根据已有的语境，预测下一个单词，从而生成连贯的文本。这就像我们人类说话或写文章一样，根据已有的语境，预测下一个单词或短语。只不过，GPT模型的学习能力和生成能力，远超我们人类。

我们可以看到，AI在学习我们人类，它们不知疲倦，孜孜以求，我们人类也应该向它们学习，不带批判和有色眼镜的看待身边人的观点，用仅剩的群体智慧来继续引领我们走向下一个新世界。

后续还会对四种技术架构进行深入探讨，欢迎交流~

希望带给你一点启发，加油。

作者：柳星聊产品，公众号：柳星聊产品

本文来自互联网用户投稿，文章观点仅代表作者本人，不代表本站立场，不承担相关法律责任。如若转载，请注明出处。 如若内容造成侵权/违法违规/事实不符，请点击【内容举报】进行投诉反馈！

标签：AI人工智能 Prompt RAG 大模型技术架构

上一篇 > Apple Vision Pro今日上市：独家对话揭秘设计团队的匠心独运
下一篇 > 为了让你过好这个年，大厂大模型疯狂整活儿

23种「Prompt」提示技术向ChatGPT获取高质量输出

为什么微信迟迟未接入大模型

被马斯克抵制却受互联网大厂热捧，AI营销是怎样“卷”起来的

为什么说这些倒腾AI的方式会把自己“搞死”

大模型应开源还是闭源？周鸿祎怼上了李彦宏

开源模型越来越落后？Meta甩出全新Llama 3应战

大模型何去何从？

线上教育大模型应用场景一：出题

AI Agent是每个人的助手

阿里云们的2024：打不完价格战，卷不动大模型

大模型加持后，数字人“更像人”了吗？

挑战一篇文章讲清楚ChatGPT相关概念！小学生也能看懂！

AI入门第一课：把模型跑起来

基于大模型的AI产品设计新方式——双故事线策略探索

AI健康应用体验分析–讯飞晓医/夸克

“更大的焦虑，更大的想象力”：音视频厂商如何闯入AI时代？

最强调优攻略：如何从四种调优技术中做出最佳选择？

（一文看懂）强化学习与人工反馈（RLHF）调优大模型

Kimi“颠儿了”以后：国产大模型危机感来了

ChatGPT vs. Microsoft Copilot vs. Gemini，到底哪个好？

企业如何使用模型微调（SFT）定制化调优大模型？

Perplexity要搞竞价排名了，大模型的尽头……就还是广告？

比人类便宜20倍！谷歌DeepMind推出「超人」AI系统

怎么才能写出AI看得懂的提示词？（以Kimi Chat为例）

苹果搭载大模型的 Siri，可能和你想的不太一样

RAG-大模型的知识库「外挂」｜兼备成本与效益的行业解决方案

GPT-4「荣升」AI顶会同行评审专家？斯坦福最新研究：ICLR/NeurIPS等竟有16.9%评审是ChatGPT生成

苹果被大模型打得措手不及

真假“长文本”，国产大模型混战

AI大模型时代，如何用RAG技术重塑传统智能客服问答机器人？

AI智能体｜海龟汤游戏实践，看你能拿多少分？

Kimi Chat如何一步步破圈？带给AI的启示

（一文读懂）大模型到底是怎么生成文字的？

一、大模型的生成原理

二、GPT模型如何学习语言的规律

三、大模型的四种应用技术架构

第一种：Prompt（指令工程）

第二种：Function calling（函数调用）

第三种：RAG（Retrieval-Augmented Generation）

第四种：Fine-tuning（微调）

最后的话

相关文章