摘要: Agent 小知识|长任务不重来:Agent 状态保存的工程设计 本文详解Agent状态的核心概念与工程实践:它不是简单记忆,而是任务执行的实时快照,涵盖进度、环境、内部判断与资源约束。通过结构化Schema、分层检查点和状态栏机制,实现可靠暂停恢复、高效决策与长程连贯性。 阅读全文
posted @ 2026-08-06 14:20 小七-七牛开发者 阅读(139) 评论(0) 推荐(1)
摘要: Coding Agent 不需要 VM:如何把 Agent、文件系统和代码执行拆出虚拟机 camelAI重构Coding Agent架构,将长期驻留的虚拟机解耦为按需调用的分层执行环境:Agent运行于Cloudflare Durable Object(“脑”),文件存于SQLite+R2,常规操作交由JavaScript沙箱,仅构建/Notebook等重任务临时启用Linux容器 阅读全文
posted @ 2026-08-05 15:02 小七-七牛开发者 阅读(12) 评论(0) 推荐(0)
摘要: “打透” Harness:用 GitHub Copilot 跑通从原型、规划到实现与评审的 AI Coding 工作流 面对层出不穷的AI工具与提示词,开发者常陷“工具焦虑”。GitHub AI专家Burke Holland提出:少即是多——聚焦一个成熟Agent Harness(如Copilot),通过原型→规划→实现→评审的八步工作流,把AI用深、用透、用稳。 阅读全文
posted @ 2026-08-05 14:19 小七-七牛开发者 阅读(531) 评论(0) 推荐(5)
摘要: Harness 自进化真的在变好么? 阅读全文
posted @ 2026-08-04 16:29 小七-七牛开发者 阅读(11) 评论(0) 推荐(0)
摘要: 先做代码切片和行为图,证据不足再查文档、进沙箱 阅读全文
posted @ 2026-08-04 16:20 小七-七牛开发者 阅读(6) 评论(0) 推荐(0)
摘要: 本期「周一上线」聚焦AI两大演进方向:模型加速迈向多模态与机器人,Agent则从“写代码”升级为长期协作、端到端交付与自我改进。DeepSeek V4-Flash、MiniMax H3、Gemini Robotics 2等密集发布,OpenAI Astra、Lilian Weng的RSI团队、贾扬清Intent Lab齐探AI自主进化;行业层面,AlphaFold团队拆分、字节整合飞书/豆包/火山引擎,技术与组织同步重构。 阅读全文
posted @ 2026-08-03 14:29 小七-七牛开发者 阅读(780) 评论(0) 推荐(1)
摘要: 读七月:那些你可能错过的好文 小七精选七月AI开发干货:涵盖Claude Code/Codex高效用法、Agent图编排与自我改进、Harness成本优化、多模型评审、Living-Harness持续学习及OO Agents面向对象设计等前沿实践与论文,助你高效进阶。 阅读全文
posted @ 2026-07-31 15:38 小七-七牛开发者 阅读(19) 评论(0) 推荐(0)
摘要: Claude 新模型的上下文工程:从堆规则到设计上下文 Anthropic提出“上下文工程”(Context Engineering)新范式:Claude Opus 5/Fable 5删减超80%系统提示词,性能未降。核心转向“瘦提示-厚工件-瘦技能”,强调模型自主判断、渐进披露与高保真参考,告别冗余规则堆砌。 阅读全文
posted @ 2026-07-31 15:25 小七-七牛开发者 阅读(234) 评论(0) 推荐(1)
摘要: AI 模型是如何训练出来的 本文用人类学习类比AI训练,通俗解析大模型如何通过预训练、监督微调与强化学习掌握新技能;详解Model Spec、宪法等行为规范如何引导AI成为可靠协作者,并介绍评测与持续对齐的关键作用。 阅读全文
posted @ 2026-07-30 14:42 小七-七牛开发者 阅读(23) 评论(0) 推荐(0)
摘要: Agent 小知识|让 Agent 调对工具:输入输出契约的设计 本文详解Agent工具调用的输入输出契约:输入契约规范工具名称、描述、参数Schema与使用边界,确保模型准确调用;输出契约定义结构化结果、状态码与错误反馈,支撑模型可靠决策。二者共同保障Agent“思考→行动→判断”闭环的稳定性与可解释性。 阅读全文
posted @ 2026-07-30 14:10 小七-七牛开发者 阅读(146) 评论(0) 推荐(0)