logo
LLM
  1. 大模型发展史总复盘:从生成文本到可执行系统

    AI
    LLM
    技术总结
    Agent
    学习路线
  2. 复现论文的工程方法:环境、数据、指标与误差

    AI
    LLM
    论文复现
    实验工程
    机器学习
  3. 读论文方法:如何拆解一篇大模型论文

    AI
    LLM
    论文阅读
    学习方法
    科研实践
  4. 从零搭建 LLM 应用 CI:测试、评测与发布门禁

    AI
    LLM
    CI/CD
    自动化测试
    评测
  5. AI 系统的 SLO:质量、延迟、可用性与安全

    AI
    LLM
    SLO
    可观测性
    可靠性
  6. AI 系统成本核算:Token、GPU、存储与人工成本

    AI
    LLM
    成本优化
    GPU
    工程实践
  7. 长任务 Agent:检查点、恢复与幂等执行

    AI
    LLM
    Agent
    工作流引擎
    可靠性
  8. 实时语音 Agent:延迟预算与打断处理

    AI
    LLM
    语音交互
    Agent
    WebRTC
  9. 多模态 Agent:让模型读图、读表、读屏幕

    AI
    LLM
    多模态
    Agent
    Computer Use
    top
  10. 软件工程 Agent:从 Issue 到可审查 Pull Request

    AI
    LLM
    Coding Agent
    Git
    软件工程
  11. AI Coding Agent 的代码库理解与补丁生成

    AI
    LLM
    Coding Agent
    软件工程
    代码生成
  12. On-device AI:端侧推理的性能与隐私权衡

    AI
    LLM
    On-device AI
    端侧推理
    性能优化
  13. Model Distillation 实战:把大模型能力压缩下来

    AI
    LLM
    知识蒸馏
    模型训练
    PyTorch
  14. 小模型路线:蒸馏、剪枝与任务专用模型

    AI
    LLM
    小模型
    模型压缩
    部署优化
  15. 版权与训练数据:工程师需要知道的边界

    AI
    LLM
    版权
    数据合规
    工程实践
  16. AI 应用的隐私保护:脱敏、留存与数据边界

    AI
    LLM
    隐私保护
    数据安全
    RAG
  17. 多租户 AI 应用:隔离数据、配额和检索权限

    AI
    LLM
    多租户
    RAG
    权限管理
  18. 生产级 RAG:离线评测、在线监控与增量索引

    AI
    LLM
    RAG
    评测
    工程实践
  19. Prompt 版本管理与回归测试

    AI
    LLM
    Prompt Engineering
    回归测试
    工程实践
  20. 构建黄金数据集:让评测从感觉变成证据

    AI
    LLM
    数据集
    评测
    工程实践
  21. LLM-as-a-Judge:自动评审的偏差与校准

    AI
    LLM
    LLM-as-a-Judge
    模型评测
    数据质量
  22. 结构化生成的终极实践:JSON Schema 与类型安全

    AI
    LLM
    JSON Schema
    TypeScript
    结构化输出
  23. LLM 网关设计:统一鉴权、限流、重试与审计

    AI
    LLM
    API Gateway
    限流
    可观测性
  24. 从模型选型到能力路由:建立自己的 Model Gateway

    AI
    LLM
    Model Gateway
    模型选型
    系统架构
  25. 2025 年总结:从 Copilot 到可执行 Agent

    AI
    LLM
    Agent
    Copilot
    技术总结
  26. 量化实践:GPTQ、AWQ、GGUF 如何选择

    AI
    LLM
    量化
    GPTQ
    AWQ
    GGUF
  27. FlashAttention:注意力计算的 IO 优化

    AI
    LLM
    FlashAttention
    GPU
    性能优化
  28. Speculative Decoding:用小模型加速大模型

    AI
    LLM
    Speculative Decoding
    推理优化
    性能优化
  29. Continuous Batching 与服务并发

    AI
    LLM
    Continuous Batching
    GPU
    并发优化
  30. KV Cache:LLM 推理为什么会被显存卡住

    AI
    LLM
    KV Cache
    GPU
    推理优化
  31. vLLM 推理服务:PagedAttention 与吞吐优化

    AI
    LLM
    vLLM
    PagedAttention
    推理服务
  32. BrowserGym 与任务型 Agent 基准测试

    AI
    LLM
    Agent
    BrowserGym
    模型评测
  33. Agent 评测:任务成功率、轨迹质量与成本

    AI
    LLM
    Agent
    模型评测
    成本优化
    top
  34. Human-in-the-loop:高风险动作前的审批设计

    AI
    LLM
    Agent
    Human-in-the-loop
    安全设计
  35. Agent 失败模式:循环、幻觉、工具误用与失控

    AI
    LLM
    Agent
    可靠性
    安全工程
  36. Agent Memory:短期记忆、长期记忆与用户画像

    AI
    LLM
    Agent
    Memory
    隐私保护
  37. Computer Use:浏览器操作的状态机设计

    AI
    LLM
    Computer Use
    Agent
    浏览器自动化
  38. MCP Server 实战:为博客暴露搜索工具

    AI
    LLM
    MCP
    Agent
    TypeScript
  39. MCP 协议入门:统一模型与外部工具的连接

    AI
    LLM
    MCP
    Agent
    协议
  40. 多智能体协作:什么时候值得拆成多个 Agent

    AI
    LLM
    Agent
    多智能体
    架构
  41. Tool Calling 的可靠性:Schema、重试与幂等

    AI
    LLM
    Agent
    Tool Calling
    工程实践
  42. ReAct Agent:从搜索工具开始实现智能体

    AI
    LLM
    Agent
    ReAct
    TypeScript
  43. Agent 是什么:模型、工具、状态与循环

    AI
    LLM
    Agent
    架构
    学习
    top
  44. 推理模型的思维链评测与结果校验

    AI
    LLM
    推理模型
    评测
    思维链
  45. GRPO 入门:群体相对策略优化

    AI
    LLM
    推理模型
    GRPO
    强化学习
  46. DeepSeek-R1 的训练思路与开源影响

    AI
    LLM
    DeepSeek
    推理模型
    强化学习
  47. Test-time Compute:用更多推理换更高正确率

    AI
    LLM
    推理模型
    Test-time Compute
    性能优化
  48. Chain-of-Thought、ReAct 与 Tree-of-Thought 对比

    AI
    LLM
    推理
    ReAct
    Tree-of-Thought
  49. 推理模型兴起:为什么测试时计算开始变重要

    AI
    LLM
    推理模型
    Test-time Compute
    发展史
  50. 2024 年总结:LLM 应用工程化检查清单

    AI
    LLM
    工程实践
    RAG
    多模态
  51. 多模型路由:按质量、延迟和价格选择模型

    AI
    LLM
    模型路由
    架构
    成本优化
  52. LLM 观测:Tracing、Token 用量与失败样本

    AI
    LLM
    可观测性
    Tracing
    工程实践
  53. Guardrails:输出过滤、策略判断与人工兜底

    AI
    LLM
    安全
    Guardrails
    工程实践
  54. LLM 安全:Prompt Injection 与越权工具调用

    AI
    LLM
    安全
    Prompt Injection
    Agent
  55. RAG 数据管道:解析 PDF、网页与表格

    AI
    LLM
    RAG
    数据工程
    文档解析
  56. GraphRAG:知识图谱如何补足向量检索

    AI
    LLM
    RAG
    GraphRAG
    知识图谱
  57. RAG 进阶:Hybrid Search 与 Reranker

    AI
    LLM
    RAG
    Hybrid Search
    Reranker
  58. DPO 实战:训练一个更符合业务偏好的模型

    AI
    LLM
    DPO
    微调
    偏好优化
  59. 偏好优化:从 RLHF 到 DPO

    AI
    LLM
    RLHF
    DPO
    对齐
  60. SFT 指令微调:数据格式、清洗与训练

    AI
    LLM
    SFT
    微调
    数据工程
  61. QLoRA 实战:在消费级显卡上微调模型

    AI
    LLM
    QLoRA
    LoRA
    微调
  62. LoRA 原理:低秩矩阵为什么能微调大模型

    AI
    LLM
    LoRA
    微调
    Transformer
  63. MoE 的路由、负载均衡与训练难点

    AI
    LLM
    MoE
    稀疏专家
    深度学习
  64. Mixtral 与 MoE:稀疏专家模型怎么省计算

    AI
    LLM
    Mixtral
    MoE
    稀疏模型
  65. Llama 3 开源模型部署与 API 封装

    AI
    LLM
    Llama 3
    本地部署
    API
  66. Claude 3 系列与模型能力评测方法

    AI
    LLM
    Claude 3
    模型评测
    多模态
  67. 长文档问答:Map-Reduce、Refine 与分层摘要

    AI
    LLM
    长上下文
    RAG
    文档问答
  68. Context Window 的内存模型与成本计算

    AI
    LLM
    Context Window
    KV Cache
    成本优化
  69. 大模型发展史:

    AI
    LLM
    学习路线
    写作计划