AI加餐 大语言模型(LLM)

发布时间:2026/8/22 16:19:20
AI加餐  大语言模型(LLM) 一. 模型大语言模型Large Language ModelLLM通常模仿人类的认知功能他通过从数据集中学习模式与规律实现预测、分类、生成文本、图像等任务广泛应用于各个行业。例如 ↓模型的任务就是找出输入和输出之间的规律比如输出中间那个数。学成之后当我们再输入 [8,9,10] 时他能根据学到的规律预测输出应该是 9 。二. 大模型大模型Large Model堪称人工智能界的“超级学霸”—— 参数规模巨大、知识覆盖面广像是把整个互联网的内容“吃”进了脑子里的“六边形战士”。 比较✅️普通模型偏科学生。能力单一✅️大模型像通晓天文地理、数理化、文史哲 的“全能学霸”。全能多样化三. 大语言模型大语言模型是大模型中的一种例如ChatGPT、deepseek、通义千问、Claude、Gemini、Kimi等专门用于理解和生成人类语言。他们之所以“聪明能聊”正是因为背后有一个会“读”和“写”的语言大脑。特点1. “大”体现在哪里①规模庞大参数数量通常达到数十亿、数百亿甚至更多。②训练数据海量在互联网级别的文本数据上训练。涵盖书籍、网页、论文、社交媒体、代码等。③学习语言规律通过分析词语之间的上下文关系掌握语法、语义、常识乃至写作风格。④任务广泛可完成问答、写作、翻译、摘要、情感分析、编程辅助等多种语言相交任务。2. 它是如何工作的“文字接龙”的艺术【Next-Token Prediction】①预测下一个词LLM会根据它学过的海量知识去计算出可能要出现的词。②概率游戏通过复杂数学公式来算出哪个词放在哪里更适配而不是像人类一样自带心理情感。3. 它是怎么被训练出来的①无监督预训练在 “闭门读书” 阶段科学家把几乎整个互联网的公开文本包括维基百科、学术论文、开源代码等喂给模型。让它去变强。②对齐与微调这是给大模型“树立规则”阶段这样它才会从一个只会乱写文章的“文字生成器”变成一个可以和你一问一答的AI助手。4.初学者需注意的三个概念与局限①提示词 Prompt你输入给AI的指令。指令越清晰结构越完整AI的回答质量就越高。②上下文窗口Context WindowAI在依次对话中如果对话太长它可能“忘记”你告诉它的开头信息。③幻觉Hallucination这是最重要的局限性。LLM有时会极其自信地告诉你一个完全错的信息。【本人亲身经历】⭐ 最后给大家一个小小建议相信自己 AI模型 Just Do It ✿✿ヽ(°▽°)ノ✿