logo
推理模型
  1. 推理模型的思维链评测与结果校验

    AI
    LLM
    推理模型
    评测
    思维链
  2. GRPO 入门:群体相对策略优化

    AI
    LLM
    推理模型
    GRPO
    强化学习
  3. DeepSeek-R1 的训练思路与开源影响

    AI
    LLM
    DeepSeek
    推理模型
    强化学习
  4. Test-time Compute:用更多推理换更高正确率

    AI
    LLM
    推理模型
    Test-time Compute
    性能优化
  5. 推理模型兴起:为什么测试时计算开始变重要

    AI
    LLM
    推理模型
    Test-time Compute
    发展史