摘要: AutoMem:把 Agent Memory 变成可训练的记忆管理技能 AutoMem是斯坦福提出的创新框架,将记忆管理视为可学习的认知技能:通过双层外循环(结构优化+能力训练),让LLM自主决定“记什么、何时记、如何组织”,显著提升长任务表现与记忆效率。 阅读全文
posted @ 2026-07-07 14:12 小七-七牛开发者 阅读(197) 评论(0) 推荐(0)
摘要: Agent 也需要一个“调度员”吗? Addy Osmani提出“Agent自主等级”框架,从agency(单Agent行动力)与orchestration(多Agent编排力)双维度,系统划分0–5级自主性。 阅读全文
posted @ 2026-07-06 16:13 小七-七牛开发者 阅读(29) 评论(0) 推荐(0)
摘要: 周一上线:被 Claude 封号算工伤吗?贾扬清据报离开 NVIDIA,Cursor 推出 iOS 版 账号被封、Prompt 被降级,这周你又摸鱼了吗? 阅读全文
posted @ 2026-07-06 14:48 小七-七牛开发者 阅读(266) 评论(1) 推荐(2)
摘要: 记一次高性能 I O 调试:Agent 给出满分优化,却说错了底层原理 系统真正的瓶颈不是 I/O,而是CPU 在扫内存时的地址翻译成本 阅读全文
posted @ 2026-07-02 14:26 小七-七牛开发者 阅读(35) 评论(0) 推荐(0)
摘要: 理解 Prefill  Decode:AI 回答慢,慢在输入还是输出? 讲解大模型推理中的 Prefill 与 Decode 两个阶段,分析 AI 回答变慢的根源 阅读全文
posted @ 2026-07-02 14:10 小七-七牛开发者 阅读(208) 评论(0) 推荐(0)
摘要: Coding Agent 规则管理:CLAUDE.md、Skills、Hooks、Subagents 到底怎么选? Claude Code 用分层设计把 Coding Agent 的规则拆成多种机制,让约束在合适的时机生效 阅读全文
posted @ 2026-07-01 14:11 小七-七牛开发者 阅读(260) 评论(0) 推荐(0)
摘要: MCP Server 怎么安全接给 AI Agent?以 OpenAI Secure MCP Tunnel 为例 OpenAI 让 Agent 能安全调用企业内网 MCP Server,同时不暴露任何公网入口。 阅读全文
posted @ 2026-07-01 14:10 小七-七牛开发者 阅读(28) 评论(0) 推荐(0)
摘要: 论文解读:DeepSeek DSpark 在真实高并发推理服务中,如何保证 Token 生成又好又快? DSpark 通过半自回归生成和置信度调度,加速 speculative decoding。 阅读全文
posted @ 2026-06-30 14:20 小七-七牛开发者 阅读(288) 评论(0) 推荐(0)
摘要: 论文解读:LLM 不直接改代码,也能让程序跑快 3 倍? 一篇关于 LLM 参与编译器优化循环的研究 阅读全文
posted @ 2026-06-30 13:55 小七-七牛开发者 阅读(33) 评论(0) 推荐(0)
摘要: 端侧 AI 的推理加速:手机端大模型怎么提速? Google 给 Pixel 上的 Gemini Nano 装了个“先猜后验”的加速器 阅读全文
posted @ 2026-06-29 15:10 小七-七牛开发者 阅读(19) 评论(0) 推荐(0)