方位缓存(Orientation Cache)
2026-05-22
方位缓存:LLM Agent 将对长上下文的方位知识持久化为常量大小的 Context Map,避免每次从零探索。
573 字
|
3 分钟
PEEK: Context Map as an Orientation Cache for Long-Context LLM Agents
2026-05-22
PEEK 用固定预算的 Context Map 保存长上下文导航信息,减少重复探索、迭代次数和调用成本。
742 字
|
4 分钟
Agentic Harness Engineering:根据运行记录改进 Coding Agent
2026-05-18
根据运行轨迹自动改进 Agent 的提示、工具和记忆,在固定模型下提升 Terminal-Bench 2 的 pass@1。
437 字
|
2 分钟
LLMs Get Lost In Multi-Turn Conversation
2026-05-10
将完整指令拆成多轮逐步补充后,主流 LLM 的平均性能下降约 39%,主要表现为回答可靠性降低。
668 字
|
3 分钟
Sparser, Faster, Lighter Transformer Language Models
2026-05-10
通过超过 99% 的前馈层非结构化稀疏度和专用 CUDA kernel,提高吞吐量、降低能耗与内存占用。
385 字
|
2 分钟
教思考模型用工具推理:工具集成推理全流程方案
2026-05-09
TRICE:工具集成推理全流程方案(SFT→RL),Qwen3 4B/30B 上达到 AIME 2025 的 96.7%/99.2%,开源 SOTA。
1651 字
|
8 分钟