Avatar

Khari Z's LogBook

CS Undergrad @ ZJUT LLM&CV Enthusiast

  1. 首页
  2. 归档
  3. 搜索
  4. 关于
    1. 暗色模式

归档

2026 9

分类

LLM-Learning 随笔

标签云

LLM Happy-LLM LLaMA NLP RAG Retrieval SFT Transformer 预训练 Agent BERT BM25 DeepSpeed Embedding Evaluation
LLM-Learning

从 Prompt 到可审计系统:结构化 LLM 决策的工程笔记

整理候选约束、结构化输出、Critic 自纠、冻结回放、推测解码、Prefix Cache 和并发调优中的通用经验

2026-07-24 阅读时长: 10 分钟
LLM-Learning

多路召回学习笔记:BM25、Embedding、SPLADE 和 Reranker 各在解决什么

从搜索系统的召回与精排出发,整理 BM25、Embedding、SPLADE、Reranker 的直觉、适用场景和组合方式

2026-05-15 阅读时长: 9 分钟
Featured image of post 大模型应用这一层:从评测、RAG 到 Agent
LLM-Learning

大模型应用这一层:从评测、RAG 到 Agent

学习 Happy-LLM 第七章后,整理大模型评测、Tiny-RAG 和 Tiny-Agent 这条应用链路

2026-05-02 阅读时长: 9 分钟
Featured image of post 用 Transformers 跑通 LLM 训练流程:预训练、SFT 和 LoRA
LLM-Learning

用 Transformers 跑通 LLM 训练流程:预训练、SFT 和 LoRA

按流程整理 Happy-LLM 第六章:模型初始化、预训练数据处理、Trainer/DeepSpeed、SFT 标签构造与 LoRA 微调

2026-04-21 阅读时长: 8 分钟
Featured image of post 从大语言模型到训练闭环:我现在怎样理解 LLM
LLM-Learning

从大语言模型到训练闭环:我现在怎样理解 LLM

整理 LLM 的语言模型底座、三阶段训练主线,以及 tokenizer、RoPE、loss mask 与 generate 在代码里的位置

2026-04-18 阅读时长: 8 分钟
Featured image of post 预训练语言模型复习:BERT、T5、GPT/LLaMA 各走了哪条路
LLM-Learning

预训练语言模型复习:BERT、T5、GPT/LLaMA 各走了哪条路

整理 Encoder-Only、Encoder-Decoder、Decoder-Only 三条路线,以及它们在大模型阶段的取舍

2026-04-14 阅读时长: 9 分钟
Featured image of post 从 Karpathy 的 LLM Wiki 到我的知识系统
LLM-Learning

从 Karpathy 的 LLM Wiki 到我的知识系统

记录 Karpathy 的 LLM Wiki 思路、我搭个人学习系统的过程,以及接下来学习 NLP 和 Transformer 的路线

2026-04-12 阅读时长: 5 分钟
LLM-Learning

从 NLP 基础到 Transformer:我先补的几块地基

整理文本表示的演化路径,以及手写 Transformer 时最容易卡住的九个问题

2026-04-12 阅读时长: 6 分钟
1 2
© 2025 - 2026 Khari Z's LogBook
使用 Hugo 构建
主题 Stack 由 Jimmy 设计
总访问量 -- 次