做RAG(检索增强生成)的朋友,一定踩过这个坑:明明Prompt写得很好,大模型也很强,但检索出来的内容就是不靠谱。 问题很可能出在Embedding模型上。 今天就来聊聊,RAG检索中那些主流的Embedding模型,以及到底该怎么选。 一、主流Embedding模型盘点 1. OpenAI系列:曾经的绝对主力 早期做RAG,OpenAI的emb…
如果把 RAG 系统比作一道菜,Embedding 模型是火候,向量数据库是锅具,那 Chunk 切分就是刀工。刀工不对,再好的食材也出不来好菜。 一、为什么 Chunk 切分如此重要? RAG 检索的文档切分是关乎检索质量的关键步骤,如何高效正确地切分,直接决定了能否检索到正确的答案。 切分之所以关键,原因有二:一方面,向量 Embedding …
很多人第一次接触 Claude Code,会把它理解成“一个会写代码的大模型”。但如果你真的拆开看它的内部实现,就会发现它的核心竞争力并不只是模型本身,而是一整套围绕模型构建出来的 Agent 运行时。 它不是回答一次问题就结束的聊天机器人,而是一个能持续思考、调用工具、压缩上下文、恢复错误、管理权限、协调子 Agent 的执行系统。换句话说,Cl…
当"能处理多少 token"成为衡量模型能力的新维度,如何在不让成本和延迟失控的前提下,把上下文从几万推向百万,成了各家大模型最棘手的工程难题。DeepSeek 给出了自己的答案。 DeepSeek-V4 发布已有一段时间,其极具竞争力的定价与高效的缓存机制,给开发者们带来了不小的惊喜。然而,模型出色的表现背后,支撑它的技术创新更值得深入探究。今天…
2026年5月8日,中央网络安全和信息化委员会办公室(国家网信办)发布《智能体规范应用与创新发展实施意见》。这是中国首份系统性针对AI智能体(AI Agent) 的顶层政策文件,全文覆盖技术底座、安全治理、应用场景、产业生态四大维度,为智能体从"野蛮生长"走向"规范发展"划定了清晰的路线图。 一、背景:智能体为何需要"实施意见"? 文件开篇给出了明…
? 本文已同步发布到公众号《浪浪山客栈》 https://mp.weixin.qq.com/s/-VfuWtXcVnwNA4iJmjBAZg 随着 AI Agent 的快速普及,一个现实问题浮出水面:Agent 越来越多,但它们彼此说不上话。 不同框架、不同公司构建的 Agent,各有各的接口、各有各的数据格式。想让它们协作,开发者必须手写大量胶水…
? 本文是学习 Hello-Agents 项目时整理的笔记与思考。 文章已同步发布到微信公众号【浪浪山客栈】 https://mp.weixin.qq.com/s/r170l35dSyKLPlpA3NZwlQ 一、发展脉络:语言模型是如何一步步进化的? 语言模型的核心任务,是对自然语言的概率分布进行建模——简单来说,就是让机器"理解&qu…
? 本文是学习 Hello-Agents 项目时整理的笔记与思考。 拥有记忆和检索能力,只是 Agent 智能化的第一步。如何在有限的上下文窗口内,高效地组织、筛选和利用这些信息,才是决定 Agent 实际表现的关键——这正是上下文工程(Context Engineering)所要解决的问题。 文章已同步发布到微信公众号【浪浪山客栈】 https:…
? 本文是学习 Hello-Agents 项目时整理的笔记与思考。 一、问题的起点:无状态的大模型 当前大模型虽然能力很强,但在设计上它们天然是无状态的。这意味着,每一次对话在模型眼中都是全新开始——它不会"记住"你之前问过什么,也不知道你上周讨论了哪些话题。 这种设计在单次问答场景下没有任何问题,但一旦我们希望构建一个真正可用…
? 本文是学习 Hello-Agents 项目时整理的笔记与思考。Hello-Agents 是 Datawhale 社区出品的开源智能体学习教程,全名《从零开始构建智能体》,目前已在 GitHub 收获超过 13k Star。 文章已同步发布到微信公众号【浪浪山客栈】 https://mp.weixin.qq.com/s/ESHjvHP2tXjZu…