文章
32 篇笔记 · 1 个分类
2026
-
2026/02/01
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 核心链路 基础调用:API -> Prompt -> 结构化输出 -> 校验 RAG:解析 ->...
-
2026/01/31
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 从会用 API 到能设计可靠 LLM 系统,中间是对模型边界、数据质量、业务目标、安全风险和工程演进的持续理解。 31...
-
2026/01/30
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 本章整理 LLM 应用开发常见面试题,重点给出工程判断和追问方向,而不是背模板答案。 30.1 LLM 与传统软件的区...
-
2026/01/29
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 本章把前面的能力组合成一个企业智能客服知识库。目标是回答政策问题、查询订单状态、处理退款申请草稿,并在信息不足或高风险时...
-
2026/01/28
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 LLM 应用的变更包括代码、Prompt、模型、索引、工具策略、护栏和数据集。任何一项变化都可能引起质量漂移,因此需要组...
-
2026/01/27
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 LLM 应用的行为不确定,更需要完整记录每次请求的输入、配置、检索、工具、模型输出、校验结果和用户反馈。可观测性用于排障...
-
2026/01/26
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 用户感知延迟由排队、检索、工具、模型首字和输出长度共同决定。优化要区分首字延迟、尾延迟和总完成时间,并用 trace 定...
-
2026/01/25
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 LLM 成本来自输入 token、输出 token、工具调用、检索和存储。成本优化的前提是不显著降低质量,并把预算、监控...
-
2026/01/24
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 LLM 应用必须继承企业已有的身份、租户、角色和数据权限体系。模型不能决定用户能看什么,所有数据访问都应由服务端在检索或...
-
2026/01/23
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 安全护栏在输入、检索、工具、模型输出和最终展示之间建立多层防线。它不是单个敏感词过滤器,而是策略、模型、规则和人工审核的...
-
2026/01/22
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 幻觉指模型生成了看似合理但缺乏依据、与事实或业务规则冲突的内容。不能期待完全消除,但可以通过数据、检索、约束、校验和流程...
-
2026/01/21
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 数据集决定评测上限。它记录的是业务期望,而不是模型当前擅长的内容。建设数据集要兼顾覆盖、难度、隐私、版本和持续迭代。 ...
-
2026/01/20
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 没有评测,Prompt、模型、检索和工具的修改都是盲改。LLM 应用评测要把主观质量转化为可比较、可回归、可归因的指标。...
-
2026/01/19
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 企业应用中,LLM 常常只是长流程中的一个节点。工作流编排把模型调用、规则、API、人工审批和异步任务组织成可观测、可恢...
-
2026/01/18
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 代码执行能补足模型不擅长的精确计算、数据处理和图表生成,但也带来命令执行、文件访问、网络外连和资源耗尽风险。核心原则是:...
-
2026/01/17
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 多 Agent 不是把模型多调几次就叫协作,而是把复杂任务拆给不同角色,通过明确的通信协议、共享状态和决策边界完成工作。...
-
2026/01/16
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 记忆让应用能利用历史信息,但也会带来成本、隐私、权限污染和上下文失效问题。记忆管理的关键不是保存更多,而是在正确时机取出...
-
2026/01/15
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 Agent 是在目标、工具、状态和停止条件约束下循环决策的系统。它比单次调用更强,也更容易失控。本章讲 Agent 的核...
-
2026/01/14
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 Function Calling 让模型输出结构化工具调用请求,由应用执行工具并把结果返回给模型。模型不直接执行代码,真...
-
2026/01/13
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 一个生产级 RAG 系统不只是“向量库 + 模型”,还包括数据接入、解析、索引、检索、生成、引用、评测、更新、权限、缓存...
-
2026/01/12
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 召回阶段追求“找得到”,重排阶段追求“排得准”。Rerank 模型将查询和候选文档一起编码,能更准确判断细粒度相关性,是...
-
2026/01/11
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 向量检索擅长语义相似,但对错误码、型号、人名、版本号等精确信号不稳定;关键词检索相反。混合检索把多种召回路径组合起来,提...
-
2026/01/10
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 向量库负责存储向量、元数据和索引,并支持相似度查询、过滤、更新和分布式扩展。选型时要同时看召回、延迟、规模、事务、运维和...
-
2026/01/09
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 Embedding 模型把文本映射为向量,让语义相近的内容在向量空间中接近。它是向量检索的核心,但不是 RAG 的全部。...
-
2026/01/08
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 切块把长文档转换成可检索的知识单元。块太大,向量语义被稀释;块太小,上下文不足。切块策略要与文档结构、检索方式和生成目标...
-
2026/01/07
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 RAG 的质量上限常常在解析阶段就确定了。PDF、Word、HTML、扫描件和表格解析错误,会在后续切块、向量化、检索和...
-
2026/01/06
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 生成式模型逐 token 输出,完整结果可能需要数秒。流式响应可以让用户更早看到进展,但它会带来传输协议、超时、安全过滤...
-
2026/01/05
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 自然语言输出适合人看,业务系统更需要结构化结果。本章讲如何让模型稳定输出 JSON,如何在服务端校验,以及如何设计失败修...
-
2026/01/04
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 Prompt 是 LLM 应用的接口定义。它把任务、上下文、约束和输出格式组织成模型可执行的指令。工程化 Prompt ...
-
2026/01/03
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 模型 API 是 LLM 应用的基础依赖。调用层要处理协议、参数、认证、超时、重试、限流、流式响应、错误分类和调用追踪。...
-
2026/01/02
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 选型的第一步不是找“最强模型”,而是判断任务是否适合模型,以及模型出错时业务能否承受。本章讨论 LLM 的能力边界、适用...
-
2026/01/01
这是《LLM 应用开发 零基础实战指南》的独立章节版。本章从概念、实操和生产排查三个视角展开,代码块保留了原书可直接运行的版本。 LLM 应用不是简单调用一次模型接口。一个可靠的生产系统需要处理 Prompt、上下文、结构化输出、检索、工具调用、评测...