AI Agent工程师入门到入土
480 字
2 分钟
AI Agent工程师入门到入土
什么是大模型
学 Agent 开发,第一件事是认识它的”大脑”: 大模型。
你不需要先搞懂它背后的数学原理,但你必须清楚它能做什么、不能做什么,以及它是怎么”看”你发给它的文字的。搞清楚这些,后面学 Prompt、Function Calling、RAG、Agent,你才能知道”为什么要这么做”。
大模型是什么
我们平时说的[AI对话] [助手] ,核心都是大模型,英文叫LLM(Large Language Model,大语言模型)。用大白话讲,大模型就像一个从小读了海量书、见识极广、逻辑又好的超级助理。

它”大”在哪里?两点:
- 参数量大:模型内部有数千亿个参数,可以理解为它”记住了”海量知识的精华
- 训练数据大:研发人员提前给它喂了互联网上的书籍、文章、新闻、代码、论坛等大量内容,让它学会了语言规律、通用常识和各行各业的基础知识
学会之后,它能干什么?说白了就是根据你给的上下文,预测接下来最合理的文字是什么。你问它[今天天气怎么样],它不是真的去查天气,而是根据过去学过的语言模式,生成一个”看起来最合理的回答”。
我们平时用的ChatGPT、豆包、通义千问、文心一言,背后核心都是这样的大模型。
Token:大模型读文字的方式
在讲大模型能做什么之前,有一个基础概念必须先搞清楚,因为后面所有的东西都跟它有关,那就是Token。
Token是大模型处理文本的”基本单位”,它既不是一个字,也不是一个词,你可以理解为把文字”切碎”后的一个个小碎片。

支持与分享
如果这篇文章对你有帮助,欢迎分享给更多人或打赏支持!
相关文章智能推荐
暂无相关文章
随机文章随机推荐


