摘要: 第二本书出版了:《Transformer技术纵深:架构解析与前沿突破》 第二本书出版了:《Transformer技术纵深:架构解析与前沿突破》 目录第二本书出版了:《Transformer技术纵深:架构解析与前沿突破》购买链接0x01 由来0x02 收获0x03 感谢0x04 遗憾0x05 打广告 我的第二本书终于顺利出版了。这次是和清华大学出版社合作,本书的策划编辑是 阅读全文
posted @ 2026-04-14 21:06 罗西的思考 阅读(696) 评论(0) 推荐(2)
摘要: 新书出版:《分布式机器学习——系统、工程与实战》 ## 0x01 广告 经过一年多的努力,我的书 《分布式机器学习——系统、工程与实战》终于上架了,在这里打个广告。 ![](https://img2023.cnblogs.com/blog/1850883/202307/1850883-20230719224442070-381968133.jpg) 阅读全文
posted @ 2023-07-21 23:50 罗西的思考 阅读(3032) 评论(7) 推荐(3)
摘要: 【OpenClaw具身硬件】MiniClaw 阅读笔记 (2)钉核 & 上下文 目录【OpenClaw具身硬件】MiniClaw 阅读笔记 (2)钉核 & 上下文0x00 概要0x01 双核配置1.1 ESP32-S3 核1.2 MimiClaw实际的钉核决策1.3 钉核原因引力1:WiFi/lwI 阅读全文
posted @ 2026-08-12 20:42 罗西的思考 阅读(34) 评论(0) 推荐(0)
摘要: 【OpenClaw具身硬件】MiniClaw 阅读笔记 (1)基础 目录【OpenClaw具身硬件】MiniClaw 阅读笔记 (1)基础0x00 概要0x01 基本知识1.1 MimiClaw 核心特色1.2 核心定位1.3 应用场景0x02 设计理念2.1 核心设计哲学2.2 设计取舍总结0x0 阅读全文
posted @ 2026-08-11 20:53 罗西的思考 阅读(112) 评论(0) 推荐(0)
摘要: 【Agentic RL / 强化学习 / OPD】Hermes & OPD 源码阅读笔记 目录【Agentic RL / 强化学习 / OPD】Hermes & OPD 源码阅读笔记0x00 概要0x01 OPD 机制原理 —— "OPD 是什么,怎么工作"1.1 OPD 的完整数据流1.2 vLL 阅读全文
posted @ 2026-08-10 20:53 罗西的思考 阅读(57) 评论(0) 推荐(0)
摘要: VelesDB 深度解读 —— 融合向量、图与列存的端侧 AI 记忆引擎 目录VelesDB 深度解读 —— 融合向量、图与列存的端侧 AI 记忆引擎0x00 概要:VelesDB 是什么0x01 总论1.1 面对的难点与核心冲突1.2 如何解决这些难点1.3 本项目的特色1.4 三种视角解读给 1 阅读全文
posted @ 2026-08-06 21:14 罗西的思考 阅读(76) 评论(0) 推荐(1)
摘要: 【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (16) AReal 目录【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (16) AReal0x00 概要0x01 基础背景1.1 AReaL1.2 工作1.3 训练架构 阅读全文
posted @ 2026-08-04 19:53 罗西的思考 阅读(64) 评论(0) 推荐(0)
摘要: 【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (15) Combine模式 目录【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (15) Combine模式0x00 概要0x01 架构1.1 架构:继承而非重写1.2 阅读全文
posted @ 2026-08-03 20:49 罗西的思考 阅读(82) 评论(0) 推荐(0)
摘要: 【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (14) Teacher 目录【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (14) Teacher0x00 概要0x01 基础背景1.1 完整数据流1.2 关键点公式代 阅读全文
posted @ 2026-07-29 20:57 罗西的思考 阅读(82) 评论(0) 推荐(0)
摘要: 【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (13) OPD实现 目录【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (13) OPD实现0x00 概要0x01 基础背景1.1 通俗讲解1.2 数学形式1.3 OPD 阅读全文
posted @ 2026-07-28 20:12 罗西的思考 阅读(93) 评论(0) 推荐(0)
摘要: 【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (12) GRPO 目录【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (12) GRPO0x00 概要0x01 GRPO基础1.1 GRPO 解读PPOGRPOGroup 阅读全文
posted @ 2026-07-27 20:25 罗西的思考 阅读(86) 评论(0) 推荐(0)
摘要: 【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (11) 算法总体实现 目录【Agentic RL / 强化学习 / OPD】OpenClaw-RL 源码阅读笔记 (11) 算法总体实现0x00 概要0x01 基础背景1.1 架构1.2 算法三种训练方法核心设 阅读全文
posted @ 2026-07-23 20:48 罗西的思考 阅读(95) 评论(0) 推荐(0)