AI百科 Token是什么?大模型数数的基本单位,记账的类比一看就懂 跟朋友聊天,说到AI,他问了一个让我愣了两秒的问题:「你们老说的token到底是个啥?」 确实,这个词在AI圈已经是个默认大家都懂的词了。但说实话,我第一次看到「GPT-4支持128K token」... AI百科 2026-07-19 78 #Token #AI科普 #大模型 #分词器 #上下文窗口
AI百科 AI Agent到底是什么——跟ChatGPT到底有什么区别 2026年AI圈最热闹的词是AI Agent,中文叫AI智能体。但它跟ChatGPT那种聊天机器人到底差在哪?我用最简单的方式讲清楚。ChatGPT是问答,Agent是干活你问ChatGPT"帮我写一... AI百科 2026-07-19 68 #AI百科 #AI Agent #智能体 #ChatGPT #大模型
AI百科 大模型到底「吃了」多少数据?训练语料来源全揭秘 训练数据不是天上掉下来的GPT-4的训练数据量官方没公布,但业内估算大约在13万亿个token左右。什么概念?1个token大概等于0.75个英文单词,或者1.5个中文字。折算下来,相当于把维基百科... AI百科 2026-07-18 78 #大模型训练 #训练数据 #数据清洗 #AI科普
AI百科 RAG是什么?一个看了就能懂的通俗解释 2026年,RAG(检索增强生成)这个词在AI圈出现的频率越来越高。但很多非技术人员听了半天还是没搞明白。这篇文章用最简单的话讲清楚。RAG解决什么问题先说痛点。你问ChatGPT一个问题,它什么时候... AI百科 2026-07-18 65 #RAG #检索增强生成 #AI术语 #AI基础知识 #向量数据库
AI百科 LoRA微调:几个MB的文件凭什么改变几十GB的大模型 你有一个70B参数的Llama模型,文件大小快150GB。你想让它学会写你个人风格的公众号推文——用词习惯、断句节奏、那个你最爱用的「说白了」。全量微调?一块H100跑得动,但光显存就得吞下600GB... AI百科 2026-07-17 97 #LoRA #AI训练 #大模型 #微调技术
AI百科 Transformer架构通俗解释:ChatGPT怎么「理解」文字 讲Transformer的文章一堆,但大部分要么全是数学公式把人吓跑,要么用「注意力机制是AI的魔法」这种废话糊弄过去。我想试试用完全不涉及公式的方式,把Transformer到底在干嘛讲清楚。先记住... AI百科 2026-07-16 85 #ai #Transformer #大模型 #ChatGPT #深度学习
AI百科 7B、70B、175B:大模型参数到底是啥? 你打开HuggingFace或者随便一个AI工具的模型列表,大概率会看到一堆带着数字的名字:Llama-3-8B、Qwen-2-7B、DeepSeek-V2-236B。这个「B」是Billion,十亿... AI百科 2026-07-15 89 #大模型参数 #7B模型 #175B模型 #模型蒸馏 #AI科普
AI百科 RAG是什么?2026年大模型落地最常见的技术,大白话给你讲清楚 2026年你如果关注AI,大概率听过RAG这个词。它是当前大模型在企业落地中最主流的技术方案之一。说人话就是:让AI在回答你问题的时候,先去翻你家自己的资料库,再结合资料回答。为什么需要RAG?大模... AI百科 2026-07-15 71 #AI百科 #RAG #大模型 #知识库 #AI落地
AI百科 手机跑大模型不是噱头——聊聊AI模型量化到底干了啥 先看一个数字:Meta的Llama 3.1 70B模型,原始大小约140GB。你手机闪存才256GB,装这一个模型就去掉一大半,更别提运行了——显存都不够。但2026年的现实是,我手头这台一加13,高... AI百科 2026-07-14 93 #AI模型量化 #端侧AI #模型压缩 #INT4量化 #手机跑大模型
AI百科 RAG(检索增强生成)详解:让AI不再胡说八道的核心技术 你问ChatGPT一个问题,它有时候会一本正经地编造答案——这叫"幻觉"(Hallucination)。这个问题在2024-2026年一直没彻底解决,因为大语言模型本质上是一个概率预测系统,不是知识库... AI百科 2026-07-14 89 #RAG #检索增强生成 #AI知识库 #向量数据库 #AI幻觉 #大模型