03-03 大模型的工作原理?
✅大模型的工作原理?
大模型的工作原理LLM 最核心、最基础的任务其实很简单:给你一串文字(上下文),它要猜出下一个最可能出现的词是什么?
例子: 输入 “Hollis是个好”,LLM 的任务就是猜下一个词,比如 “人”、“东西”、“家伙”、“男人” 等等,并给出每个词出现的可能性(概率)。
它是怎么学会“猜词”的?—— 海量阅读 + 疯狂练习
海量阅读(数据):
想象 LLM 在训练时,吞下了整个互联网的文本:书籍、文章、网页、代码、对话记录… 天文数字级别的文字量(TB 甚至 PB 级别)。
它不是在“理解”这些内容,而是在疯狂地寻找词语之间的搭配模式和统计规律。
疯狂练习(训练):
训练方法的核心:遮住一部分,让它猜! 就像我们小时候做“完形填空”。
具体操作:
从海量文本中随机截取一段句子,比如 “人工智能正在改变世界”。
遮住其中一个词,比如遮住 “改变”,变成 “人工智能正在 [MASK] 世界”。
让模型猜被遮住的词是什么。它一开始肯定是瞎猜。
揭晓答案(“改变”),然后调整模型内部的参数和权重。猜错了就调一点,猜对了也微调让它下次更可能猜对 ...
03-02 什么是大模型?
✅什么是大模型?
现在我们说的大模型,一般指定都是LLM,全称是Large Language Model,也就是大语言模型。比如我们常用的ChatGPT、DeepSeek、通义千问等等,都是大语言模型。
所谓大语言模型,其实就是用于做和自然语言相关任务的深度学习模型,它是基于海量文本数据训练出来的,能够理解和生成人类的自然语言。
大模型,和以前的模型相比,主要的差异就在于”大”,所以在大模型出来之后,以前的一些专业模型也被叫做小模型,比如原来的搜索、广告、营销等模型,最容易理解的就是OCR模型,可以说他们是专业模型,也可以说他们是小模型。
大模型的大,体现在几个方面:
参数量巨大
这是“大”最直接、最核心的含义。模型的“参数”可以理解为模型在训练过程中学到的“知识”或“规则”的内部表示。参数越多,模型理论上能存储和表达的信息就越复杂、越精细。我们常见的一些模型会有xxB的描述,比如Qwen3-72B、LLaMA2-13B,这里的72B指的就是参数量有72Billion,即720亿。
比如我们在ollama上看到关于qwen2.5:72b的介绍:
hugg ...
03-01 行业趋势与岗位需求分析
✅行业趋势与岗位需求分析
现在大模型很火大家都知道,但是这个方向,也就是我们课程主讲的,大家学完能干的——大模型应用开发 ,到底咋样,有没有岗位?薪资咋样?
招聘需求
现在的招聘,有很多是AI相关的岗位,其中除了一些算法岗位以外,还有很多工程岗位,比如AI Agent开发工程师、大模型应用开发工程师等等。这些岗位都是后端岗位,主要工作职责是使用AI相关技术做应用开发。如:
而很多人以为,如果我不想找AI相关的岗位,就可以不了解AI了?那就打错特错了!
现在的招聘,不管是大厂也好,中小厂也罢,是校招也好,还是说社招,就算是普通的研发岗位,对于AI的能力要求已经像一些基础技能(如分布式、Mysql)等一样,是个必备项了。
而且如果你看过一些面经的话,就会发现,很多公司都会问一些AI相关的问题,比如你是否做过相关工作,是否用过AI Coding工具等等。
编程语言
关于编程语言,在AI开发这个领域,肯定是Python的岗位是最多的,这个毋庸置疑,毕竟Python他这么多年了在机器学习、算法等方向上一直就是很重要的。
但是Java岗位怎 ...
02-02 应用如何启动
✅应用如何启动
✅代码目录结构以下是我们的课程代码的整体目录,基本上是每一个章节我们会给大家创建一个独立的module,这样每一个章节相关的代码都在一起。 另外因为不同的东西之间会存在冲突,比如spring ai和langchain4j,以及ollama等等,他们之间都
LLMentor
然后不同的module中都有一个单独的Application类,用来单独启动这个module的
设置了不同的端口号,方便大家分别启动。所以,一定要注意不同的端口号的设置,就在对应你的module的applcation.yml中。
当你拿到代码后,需要按照以下步骤进行启动:
1、修改api-key
因为我们是个AI项目,所以一定会用到大模型,所以需要用到api key来和大模型交互,我们建议大家用百炼,有一定的免费额度,自己用用基本够了。后面课程有单独介绍如何申请和使用。
为了方便大家使用,我们把api-key都统一到一起做配置了,你只需要修改一个地方就行了。即项目的根pom中的dashscope.api.key的内容即可。
另外,如果你运行的是St ...
02-01 代码目录结构
✅代码目录结构
✅【重要】代码如何下载?代码库地址: https://codeup.aliyun.com/?_userId=6613bc9414e2ff8b4d921dd8×tamp=1770883499027&org_id=67c56af4e77e9167fa2fa6
LLMentor
以下是我们的课程代码的整体目录,基本上是每一个章节我们会给大家创建一个独立的module,这样每一个章节相关的代码都在一起。
另外因为不同的东西之间会存在冲突,比如spring ai和langchain4j,以及ollama等等,他们之间都会存在同一个bean定义了多个实现的情况,所以会冲突,隔离开可以避免类似的问题。
然后除了前面的基础章节,后面的项目实战,我们也会搞一个单独的module。
在每一个module中,我们也会分成不同的package,比如下面这个,其实就和大家自己的项目差不多,分成了controller、service等等的。没啥特别的,这样大家找起来也比较方便些。
然后不同的module中都有一个单独的Applicatio ...
01-04 【重要】代码如何下载?
✅【重要】代码如何下载?
代码库地址: https://codeup.aliyun.com/?_userId=6613bc9414e2ff8b4d921dd8×tamp=1770883499027&org_id=67c56af4e77e9167fa2fa6df&mode=redirect&sign=dfb08d7c8231c94406f4b80bceafdc25
如果你已经获得了代码权限,压缩包你能下载,但是通过git命令拉不到代码。那么说明你的配置是不正确的,
那么就需要通过以下2种方式之一进行配置。
通过访问令牌在你的个人设置中,创建访问令牌
输入名称,选一个足够长的时间,把代码管理的只读权限勾选上。
创建成功后,他会提示你令牌内容,这个一定要记好。
这样你就可以通过以下方式拉取代码:
12git clone https://codeup.aliyun.com/67c56af4e77e9167fa2fa6df/LLMentor正克隆到 'LLMentor'...Username f ...
01-03 【重要】如何查看视频
✅【重要】如何查看视频
我们的视频是在小鹅通上面学习的,大家可以通过下单时收到的短信,申请小鹅通权限,开通后,可以通过小鹅通小程序进行学习。
需要注意一下,你的微信绑定手机号需要和开通手机号一致,否则需要单独登录一下。
电脑端也可以通过https://study.xiaoe-tech.com/#/wx 进入,用你的微信扫码或手机号登录即可。
01-02 重要说明!!!!
✅重要说明!!!!AI的发展实在是太迅速了。
我还在规划这门课的时候,Agent的工具调用还只能是Function Call和MCP,就算是MCP那时候都算是新玩意,大家还在为A2A而感到兴奋。
而在我文档写完之后,开始录视频的时候,Skill已经出来了。Agent的工具调用的逻辑彻底变了。
在框架这方面,Java中一开始主要是Spring AI(Alibaba),LangChain4J,后来在录制的过程中,又出现了AgentScope,哈哈哈哈~~~
包括很多其他的东西,比如之前我们让Agent效果好,还是靠提示词工程, 后面就出现了上下文工程等等东西。
AI尚处于一个不断的发展中,很可能你前一天还奉为圭臬的东西,后面一天就可能被推翻了。所以大家一定要带着开放、包容的态度来学他!
包括我们课程中的内容也一样,虽然我写的时候他是一些最佳实践,是一些好的用法。但是难保他有一天也会淘汰,也会有新的东西出来。
当然,我会确保至少课程中的内容是在我和我合伙人的认知和实践中主流的,有效的,有竞争力的。我会不断的更新迭代完善。希望这个课程能带大家入门,让大家学到当前主流 ...
01-01 课程介绍
✅课程介绍
这是一个围绕着大模型应用开发的后端课程,我给这个项目起了个名字叫——LLMentor,希望我(国内一线互联网大厂P8)和我的合伙人(某垂直领域头部大厂Agent开发),能像一个mentor(良师益友)一样,带着大家一起入门大模型应用开发。
这个课程的愿景是,让大家可以从0到1,从无到有的入门大模型,可以转型成为大模型应用开发工程师、Agent开发工程师等方向。
课程内容
LLMentor 项目,是一个大模型应用开发实战课。主要包含以下内容:
大模型开发概述
提示词工程
初探Spring AI
LangChain4j
Function Call
MCP
RAG
Agent
Workflow
长期记忆
上下文工程
Skills
AgentScope
Harness Engineering
模型微调&部署
RAG评测
模型微调
项目实战1:企业级知识库问答机器人(RAG)
项目实战2:端到端通用智能体(Agent)
项目实战3:业务综合应用智能体(Agent)
简历模板&模拟面试&面试题
课程优势
课程特色
...
24写作本书时用到的一些重要的参考资料
感谢我不生产知识,只是知识的搬运工。写作本小册的时间主要用在了两个方面:
搞清楚事情的本质是什么。
这个过程就是研究源码、书籍和资料。
如何把我已经知道的知识表达出来。
这个过程就是我不停的在地上走过来走过去,梳理知识结构,斟酌用词用句,不停的将已经写好的文章推倒重来,只是想给大家一个不错的用户体验。
这两个方面用的时间基本上是一半一半吧,在搞清楚事情的本质是什么阶段,除了直接阅读MySQL的源码之外,查看参考资料也是一种比较偷懒的学习方式。本书只是MySQL进阶的一个入门,想了解更多关于MySQL的知识,大家可以从下边这些资料里找点灵感。
一些链接
MySQL官方文档:https://dev.mysql.com/doc/refman/5.7/en/
MySQL官方文档是写作本书时参考最多的一个资料。说实话,文档写的非常通俗易懂,唯一的缺点就是太长了,导致大家看的时候无从下手。
MySQL Internals Manual:https://dev.mysql.com/doc/internals/en/
介绍MySQL如何实现各种功能的文档,写的比较好,但是太少 ...
