逍遥云初
首页
关于
看稿不停
菜单
首页
关于
看稿不停
正在加载
逍遥云初
首页
关于
看稿不停
菜单
首页
关于
看稿不停
← 返回首页
LLM底层技术
35 篇
LLM底层技术
Think Deep, Not Just Long:用 Deep-Thinking Token 重新定义 LLM 推理质量
来自 Notion 的自动成稿文章。
2026-05-25
·
1 分钟
LLM底层技术
Think Deep, Not Just Long:用深度思考 Token 重新定义 LLM 推理质量
来自 Notion 的自动成稿文章。
2026-05-25
·
1 分钟
LLM底层技术
ZAYA1-8B:700M 活跃参数挑战 DeepSeek-R1,小模型推理的新标杆
来自 Notion 的自动成稿文章。
2026-05-24
·
1 分钟
LLM底层技术
推理模型推理得很好,直到它们做不到:LRM 推理能力的玻璃天花板
来自 Notion 的自动成稿文章。
2026-05-22
·
1 分钟
LLM底层技术
STRIDE:用可学习的语言反馈突破 LLM 推理瓶颈
来自 Notion 的自动成稿文章。
2026-05-21
·
1 分钟
LLM底层技术
SHAPE:让 LLM 推理既深又快——ACL 2026 阶段感知分层优势估计框架
来自 Notion 的自动成稿文章。
2026-05-20
·
1 分钟
LLM底层技术
DeepSeek Engram:将记忆与推理分离的 LLM 架构突破
来自 Notion 的自动成稿文章。
2026-05-20
·
1 分钟
LLM底层技术
DeepSeek Engram 条件记忆架构:将「知道什么」与「如何思考」彻底解耦
来自 Notion 的自动成稿文章。
2026-05-17
·
1 分钟
LLM底层技术
Sebastian Raschka 2025 LLM 年度回顾:RLVR+GRPO 如何重塑大模型推理能力
来自 Notion 的自动成稿文章。
2026-05-12
·
1 分钟
LLM底层技术
Can RL Teach Long-Horizon Reasoning to LLMs? Expressiveness Is Key — ScaleLogic 揭示 RL 训练的幂律缩放与逻辑表达力的关键作用
来自 Notion 的自动成稿文章。
2026-05-10
·
1 分钟
LLM底层技术
GPT-5.2 推导理论物理新结果:AI首次在未知领域发现新的物理公式
来自 Notion 的自动成稿文章。
2026-05-08
·
1 分钟
← 上一页
3 / 3
下一页 →