归档 - 第二支羽毛|吹灭读书灯，一身都是月

2025

一文读懂自动编码器：类型、原理与应用

2025-04-12 一文读懂自动编码器：类型、原理与应用

缓存增强生成（CAG）对比检索增强生成（RAG）：谁才是大语言模型的最优解？

2025-04-12 缓存增强生成（CAG）对比检索增强生成（RAG）：谁才是大语言模型的最优解？

ReaderLM v2：前沿小型语言模型，实现HTML到Markdown和JSON的转换

2025-04-12 ReaderLM v2：前沿小型语言模型，实现HTML到Markdown和JSON的转换

重现 OpenAI o1 的技术路线

2025-04-12 重现 OpenAI o1 的技术路线

典型的RAG流程、每个模块的最佳实践和综合评估

2025-04-12 典型的RAG流程、每个模块的最佳实践和综合评估

加速大模型推理：深入探究MQA、GQA、MLA（DeepSeek）、KV缓存技术

2025-04-12 加速大模型推理：深入探究MQA、GQA、MLA（DeepSeek）、KV缓存技术

强化自训练（ReST）：让大语言模型更懂你的“心”

2025-04-12 强化自训练（ReST）：让大语言模型更懂你的“心”

Qwen2.5-Max：对标DeepSeek V3

2025-04-12 Qwen2.5-Max：对标DeepSeek V3

DeepSeek-R1的顿悟时刻是如何出现的？背后的数学原理：强化学习如何教大型语言模型进行推理

2025-04-12 DeepSeek-R1的顿悟时刻是如何出现的？背后的数学原理：强化学习如何教大型语言模型进行推理

2025-04-12 强化学习中的关键模型与算法：从Actor-Critic到GRPO

弹