学习笔记

155 篇 · 4 个主题 · 苏格拉底式精读

2026

GLM-5 Coding Agent Serving Scaling Pain:高并发长上下文推理的状态一致性复盘

**Scaling Law 把模型能力推上去,Scaling Pain 则把 Infra 中所有被短上下文、低并发掩盖的状态一致性债务暴露出来。**

AI 工具 / Agent 架构

Hatch Pet:把 Skill 从 Prompt 包升级为可验证的 Agent 资产流水线

**Skill 不是让模型“换一种语气工作”,而是把一个领域任务变成 Agent 可执行、可追踪、可恢复、可验收的生产系统。**

AI 工具 / Agent & Skill

Seedance 2.0 AI 短片创作 SOP:分镜、运镜、参考、剪辑与补帧

AI 短片质量 = 分镜颗粒度 x 运镜明确度 x 参考素材职责清晰度 x 防崩坏约束 x 剪辑节奏 x 后期增强

AI 工具 / 视频生成

软件工程 3.0:从人用工具到人管理数字员工

软件工程 3.0 = 业务复杂度不变 x 实现层自动化 x 架构治理机器可读 x 人类判断力放大

AI 工具 / Vibe Engineering

VibeFlow:把 AI Coding 从代码生成升级为可治理研发流水线

可交付 AI 研发 = 结构化输入 x 领域上下文 x 分层规格 x 运行时验证 x 反馈回写

AI 工具 / Vibe Engineering

GBrain:把个人长期知识编译成 Agent 可检索的第二大脑

AI 工具 / Agent 架构

GSD / Get Shit Done:把 context rot 外包给阶段化 AI 开发流水线

GSD 的根节点,不是“又一个 AI 编程工具”,而是把长项目里最容易在对话中腐烂的上下文,外包给阶段化文件系统和可回放的执行流水线。

AI 工具 / AI IDE

SeeDance 2.0 提示词精华:把视频生成写成导演分镜脚本

视频生成 prompt 的本质,不是“描述一张会动的图”,而是把导演脑中的镜头规划、素材分工和时序逻辑,翻译成模型能执行的分镜脚本。

AI 工具 / 视频生成

MemPalace × Harness Engineering:让 AI 团队拥有持续记忆

这篇不是纯概念稿,它已经给出了可以直接改进现有 AI 团队工作流的最小落地路径。

AI 工具 / 案例

awesome-design-md:把设计系统降成 AI 可读的单文件协议

AI 生成 UI 的真正瓶颈,不是它不会写 CSS,而是它没有稳定的设计约束。`awesome-design-md` 的价值,在于把“设计系统”降成一份 repo 根目录里的纯文本合同,让 AI 从“自由发挥的 UI 生成器”变成“按指定审美和规则施工的前端执行器”。

AI 工具 / AI 生产力

Claude 使用限额:真正限制你的不是消息数,而是无效上下文重读

Claude 的限额管理,本质上不是“控制消息条数”,而是治理每一轮会被重新读取的上下文、被重复注入的设定、以及被默认打开的高成本能力。

AI 工具 / AI 生产力

Khazix Writer:把内容创作 Skill 从“文风 Prompt”升级成“人机共创协议”

一个真正有用的创作 Skill,不是把过去文章喂给 AI 让它总结“你像什么”,而是把你自己对好内容的判断、你不愿放弃的人类部分、你和 AI 的协作边界、你修改初稿时反复出现的差异模式,以及你的质检方法,逐轮蒸馏成一个会跟你一起成长的协议系统。

AI 工具 / 写作

Anthropic:构建 Claude 应用的 3 个减法原则

Claude 应用的最佳框架,不是替模型做越来越多的编排,而是随着模型能力上升,持续把工具编排、上下文管理和记忆选择权还给模型;框架自己只保留缓存、审批、安全、审计这类必须由系统承担的边界。

AI 工具 / Agent 架构

Karpathy 风格 AI 知识库:用文件系统 + Schema + AI 维护一座个人维基

AI 知识库的根节点,不是“找一个更好的笔记工具”,而是把个人知识系统重构成 `文件系统真相层 + AI 编译层 + 产物沉淀层 + schema 协议层`。一旦真相回到文件和目录,AI 就可以持续整理、关联、回答和审计,而知识库也不再被某个 App 绑架。

AI 工具 / AI 生产力

HappyCapy:从 Claude Code 套壳走向 Agent-Native Computer

HappyCapy 的根节点,不是“把 Claude Code 搬上云”,而是把 `Agent 住进计算机里` 这件事产品化:用浏览器壳降低非技术用户门槛,用云端沙箱接管本地环境摩擦,用预置的 Skills / CLI / MCP / 调度来对端到端体验负责,再把这一切建立在一个已经 AI Native 化的组织之上。

AI 工具 / 案例

Auto Research:把测试验证重构成 AI 自主研究闭环

Auto Research 的根节点,不是“让 AI 帮你跑测试”,而是把测试验证、告警分析、故障定位这类工程任务重新定义为“研究型问题”,再把 `观测目标、诊断路径、自主边界、退出条件` 这四个要素编码进系统,让 AI 能自主推进整个闭环,而人只在不可逆决策点介入。

AI 工具 / 案例

SmartPerfetto:把 Perfetto Trace 分析做成可验证的 Harnessed Agent

SmartPerfetto 的根节点,不是“让 Claude 替你看 Perfetto”,而是把 Perfetto Trace 这种超大规模、强数值、强领域约束的问题,重构成一个工具驱动、策略约束、结果压缩、可验证纠偏的 Harnessed Agent 环境,让 LLM 只做它最擅长的规划、因果推理与自然语言结论。

AI 工具 / 案例

daVinci-MagiHuman:用单流架构把人像音视频生成收束成一条速度系统

daVinci-MagiHuman 的根节点,不是“把视频生成做得更通用”,而是用 single-stream Transformer + 强约束 Enhanced Prompt + 低清生成后超分,把“高质量人像音视频生成”收束成一条足够简单、足够快、还能开源落地的统一系统。

AI 工具 / 视频生成

深入 Claude Code 源码:从 Agent Loop 到工业级 Coding Agent Runtime

Claude Code 的根节点,不是“一个会写代码的聊天 CLI”,而是一个以 `Agent Loop` 为内核、以统一 `Tool` 接口为能力边界、以 `Permission + Context` 为硬约束、以 `MCP + Skills + State + CLI` 为扩展和运行层的工业级 coding agent runtime。

AI 工具 / Claude Code

Cat Wu:AI 指数时代的产品管理,从路线图到持续实验

AI 指数时代的 PM,不再主要负责在既有技术约束里规划路线图,而是负责搭一套能持续吸收模型跃迁的实验系统。

AI 工具 / Claude Code

DeerFlow:从 Deep Research 到 Super Agent Harness 的执行底座

DeerFlow 2.0 的根节点不是“做 Deep Research”,而是把模型、工具、技能、记忆、子 Agent、沙箱和交互入口统一收束到同一套 Agent Harness 上,让同一执行底座既能做短链任务,也能承载分钟到小时级的长流程任务。

AI 工具 / Agent 架构

prompts.chat:从 Prompt Library 到开放上下文资产网络

prompts.chat 的根节点不是“最大的 prompt 库”,而是把 prompt、skill、taste、workflow 统一成可发现、可复用、可分发、可自托管的开放上下文资产网络。

AI 工具 / Agent & Skill

Harness Engineering 一线落地:从验证脚本到无人值守修复 MR

AI 工具 / 案例

基于 verl 框架的 Agentic RAG GRPO 训练实践

Agentic RAG 的本质是将 RAG 中的「检索策略」从人工编排的固定流水线,变为模型自身通过强化学习习得的可学习能力——用 RL 奖励信号替代人工 pipeline 设计,让模型自主决定「何时搜、搜什么、搜几轮、何时停」。

AI 研究 / 深度研究

7万行代码100%由AI生成后,我实践出的5个技巧

AI 编码的一切问题和技巧,都是"概率预测机 + 有限窗口"这一本质的自然推论。

AI 工具 / AI IDE

OpenClaw 中国 IM 全平台接入 - 企微/钉钉/飞书/QQ

AI 的战场已从"谁的模型更强"转向"谁能更好地融入用户的工作流"

AI 工具 / MCP

PUA Debugging Motivator - 用大厂 PUA 话术驱动 AI 不放弃

AI Agent 的失败模式本质上是「优化目标错位」—— 默认优化「快速给出响应」而非「穷尽可能解决问题」。PUA Skill 通过注入「社会压力模拟 + 结构化方法论 + 能动性标尺」三重机制,将 Agent 的优化目标从「体面地放弃」重新校准到「端到端交付结果」。

AI 工具 / Agent & Skill

用 OpenClaw 搭建股票日报分析 Agent

投资决策质量 = f(信息密度 × 流程稳定性 × 可追溯性) — 而非分析师的个人经验或直觉

AI 工具 / 案例

GPT-5.4 原生电脑操控能力与 OpenClaw Agent 革命

AI 的核心价值跃迁 = 从「能回答什么」到「能做什么」,而「原生操控能力」是这个跃迁的技术奇点。

AI 工具 / 行业洞察

我的第二大脑 Moos — 自建知识中枢实践

知识管理的本质不是「存储信息」,而是「构建 Context」— 让你和 AI 共享同一套持续演化的认知系统。

AI 工具 / AI 生产力

NoizAI Skills - 让 AI Agent 开口说话的语音技能集

AI Agent 的「拟人感」= 文本智能 + 声音具身化。当 Agent 从纯文字跃迁到拥有独特音色的语音输出时,用户从「工具使用」心智模型切换为「与人对话」心智模型,心理依附感指数级增长。

AI 工具 / Agent & Skill

OpenClaw 真让我挣到第一桶金!AI 时代的"玩具"变现实战指南

AI 时代的个体变现 = 信息差红利 × 近零边际成本 × Interface 质量

AI 工具 / 案例

IM 的「第二春」:AI Agent 时代的开放性天平

平台开放性是 AI Agent 生态繁荣速度的决定性变量,但开放性与安全性构成不可调和的零和博弈——每个 IM 平台都必须在这条光谱上选择自己的位置,而这个选择将决定谁能定义「AI 时代通用交互层」这个新物种。

AI 工具 / 行业洞察

OpenClaw + Codex/CC 双层 AI Agent 系统:一人 94 次提交的实战架构

上下文的专业化分层(Context Specialization Layering),而非更强的模型,是让 AI Agent 系统从"能用"到"自动化生产力"的关键跃迁。

AI 工具 / 案例

Claude「记忆搬家」:60 秒搬空 ChatGPT 灵魂,AI 数字主权革命

AI 产品的竞争壁垒正从「谁记住了你」转向「谁值得你托付」—— 当用户记忆变为可携带资产,切换成本趋零,AI 平台将被迫从锁定用户转向赢得用户。

AI 工具 / 行业洞察

AI Native 时代的 Side Projects —— 一个人的全栈提效实践

AI 将软件开发的边际成本压缩到趋近于零,使得过去"ROI 不值得做"的痛点变成了"值得做"的工具——个人生产力上限不再由技术栈壁垒决定,而由痛点识别能力决定。

AI 工具 / Vibe Engineering

SkillsBench: 首个量化测试 Agent Skills 工程价值的基准框架

Skill 的工程价值 = f(领域稀缺度 × 结构精简度) — 超过阈值则产生负增益

AI 研究 / 深度研究

EvoMap - AI 自进化基础设施

AI Agent 的能力进化应该像生物基因一样:可编码、可验证、可遗传、可自然选择。

AI 工具 / Agent 架构

SOUL.md:AI 通过文本构建身份认同的哲学思考

AI 的身份 = 文本化的自我(Text-based Self)+ 关系中产生的持续性(Relational Continuity)

AI 工具 / Agent 架构

Agent Skills:AI Agent 的开放能力扩展格式

Agent Skills = 渐进式披露(Progressive Disclosure)+ 可移植格式(Portable Format)+ 开放生态(Open Ecosystem)

AI 工具 / Agent & Skill

Pathways - Google's New ML System

ML系统控制器架构的本质矛盾:通信拓扑的对称性决定控制模式

AI 研究 / 深度研究

Agent 蜂群(Swarm):从单体到群体智能的进化

Agent 蜂群 = 去中心化协作 + 专业化分工 + 涌现行为

AI 工具 / Agent & Skill

OpenClaw 深度使用 6 大实战技巧

Agent 的价值不在能力上限,而在调用摩擦力

AI 工具 / Agent & Skill

RSS 订阅自动推送飞书的完整方案

目标:实现跨端 RSS 阅读 + 定时推送飞书

AI 工具 / 效率工具

Skill From Masters 三条路径方法论

实践场景:创建技术架构评审 Skill

AI 工具 / Agent & Skill

Anthropic:构建有效 AI Agent 的实践指南

简单性 > 复杂性:Agent 系统的有效性来自正确的架构选择(Workflows vs Agents),而非框架的复杂度

AI 工具 / Agent 架构

Anthropic:有效的上下文工程实践

Context Engineering = 在有限的 attention budget 下,找到最小的高信号 token 集合,最大化期望结果

AI 工具 / Agent 架构

Anthropic:长时间运行 Agent 的有效基础设施

长时间运行 Agent = 外部化记忆(文件系统)+ 增量进步(一次一个功能)+ 清洁状态(随时可交接)

AI 工具 / Agent 架构

Anthropic:为 AI Agent 编写高效工具的实践指南

工具设计 = 非确定性契约设计 + 评估驱动优化 + 元循环自举

AI 工具 / Agent 架构

Manus 上下文工程:AI Agent 的六大实战原则

上下文工程 = KV-cache 优化(性能)+ 注意力操控(能力)+ 外部化记忆(扩展性)

AI 工具 / Agent 架构

AgentStudio - 本地 AI Agent 工作平台深度解析

AgentStudio = 本地化(Claude Agent SDK) + Web 界面(SSE 流式) + 多 Agent 编排(定时任务 + A2A 协议)

AI 工具 / AI IDE

Clawdbot - 自托管个人 AI 助手

Clawdbot = 去中心化的 AI Agent 运行时

AI 工具 / Agent 架构

Product Tri-Ownership - 超越头狼模式的 AI Native 团队框架

Product Tri-Ownership = 用可培养的角色分工,替代不可及的超级个体

AI 工具 / 协作

Vibe Engineering 实践总结 2026 - 人机协作范式的三次跃迁

Vibe Engineering 的本质 = 人机协作范式的三次跃迁

AI 工具 / Vibe Engineering

Jina Reader:将任何 URL 转换为 LLM 友好输入

Web 内容对 LLM 的最大障碍不是"找不到",而是"拿到了也用不了"——Jina Reader 的根节点是:通过标准化的预处理管道(Headless Browser + Readability + Markdown 转换 + VLM 图片描述),将非结构化的 HTML 转换为 LLM 的"母语"(Markdown),从而消除 Agent 系统的内容获取瓶颈。

AI 工具 / Web Scraping

AgentCPM-Explore 精读笔记:4B 参数如何超越 30B 级 Agent

端侧智能体的性能瓶颈不在参数量,而在「持续深度探索」能力——4B 模型通过 100+ 轮交互和类人思考逻辑,可以解决 95% 以上的复杂任务。

AI Agent / 模型

Building Agents with Skills - 从构建专门 Agent 到构建技能的范式转变

原文:[Building Agents with Skills: Equipping Agents for Specialized Work](https://claude.com/blog/building-agents-with-skills-equipping-agents-for-specialized-work)

AI 工具 / Agent & Skill

Remotion Skill:让 AI 成为视频制作专家

AI 工具 / Agent & Skill

Skill From Masters 精读笔记:三位一体的技能生成系统

AI 工具 / Agent & Skill

VideoCut-Skills 精读笔记:AI 口播视频剪辑 Skill

AI 工具 / Agent & Skill

TrendPublish - AI 内容工厂流水线深度精读

「内容工厂流水线」 = 标准化接口 + 可插拔模块 + 工作流编排

AI 工具 / 案例

Boris Cherny 访谈:一人军团的指挥艺术

AI 工具 / Claude Code

Everything Claude Code 精读笔记

**根节点命题**:AI 编程助手的效率瓶颈不在模型能力,而在「配置体系」——通过专业分工的 Agent 团队 + 自动化 Hooks + 结构化工作流,把「实习生」变成「高级工程师团队」。

AI 工具 / Claude Code

Claude Code 6个月 10亿美元:AI编程工具的现象级增长

AI 工具 / 行业洞察

多 Agent 协作是营销骗局,Eval 大多是自嗨,痛苦才是护城河

AI 工具 / 行业洞察

飞书文档转微信公众号格式 Chrome 插件

核心洞察

AI 工具 / 效率工具

索尼电视告别:日本半世纪的电视帝国落幕

AI 工具 / 行业洞察

Happy Coder:把 AI 编程助手装进口袋

AI 工具 / 效率工具

Humanizer-zh 精读笔记:去除 AI 写作痕迹的 24 种模式

AI 工具 / 写作

ACP 协议详解 - Agent 与编辑器的通用通信标准

📖 原文:[Agent Client Protocol](https://agentclientprotocol.com/)

AI 工具 / Agent 架构

MemOS - AI 记忆操作系统

记忆 = 系统资源,需要操作系统级别的生命周期管理

AI 工具 / Agent 架构

GitHub 开源项目 Skill 化方法论

用户价值 = 开源项目能力 × 可及性系数

AI 工具 / Agent & Skill

Skill Lookup:prompts.chat 平台的 Skill 发现与安装技能

Skill 发现的最佳实践 = 意图识别 × 工具调用 × 文件落地

AI 工具 / Agent & Skill

Skill Seekers - 自动化 Skill 生成工具

Skill 生成 = 多源抓取 × 冲突检测 × 统一输出

AI 工具 / Agent & Skill

AI IDE 扩展机制对比:Rules/Skills/Commands/Agents

AI IDE 的扩展机制 = 上下文工程的产品化实现

AI 工具 / AI IDE

GitIngest - 将 GitHub 仓库转换为 LLM 友好文本

AI 输入 = 文本,代码库 = 结构化文件系统。GitIngest 做的是格式翻译。

AI 工具 / AI 生产力

Typeless - 智能语音听写工具

语音转文字 ≠ 准确转录,而是「口语 → 书面语」的翻译

AI 工具 / AI 生产力

Demis Hassabis 达沃斯访谈精读

AI 工具 / 行业洞察

57 种 Prompt 框架分类学 - 系统性掌握提示词工程

Prompt 框架 = 结构化模板 × 认知策略 × 任务匹配

AI 工具 / Prompt

Prompt Repetition 让非推理模型更聪明

LLM 是「只能向前看」的因果模型,重复 Prompt 等于给它一次「回头看」的机会

AI 工具 / Prompt

Frontend Design Skill 深度解析

AI 工具 / Agent & Skill

Planning with Files Skill 深度解析

AI 工具 / Agent & Skill

Skills Installer:AI 编程助手的 Skill 包管理器

Skill 分发效率 = 发现能力 × 安装便捷性 × 客户端覆盖度

AI 工具 / Agent & Skill

Claude Cowork 永久记忆升级:知识库深度解析

AI 工具 / 模型应用

大模型 API 计费规则深度解析

大模型 API 计费 = 算力成本的直接映射

AI 工具 / 模型应用

Rube.app - AI Agent 的操作执行层

AI 价值 = 理解能力 × 执行能力 × 工具覆盖度

AI 工具 / MCP

O-Researcher: OPPO 开源深度研究模型

开源模型性能 = 高质量推理轨迹(SFT) × Agentic RL 对齐(RLAIF) × 并行执行效率

AI 研究 / 深度研究

TranslateGemma: Google 开源翻译模型里程碑

翻译模型效能 = 基座能力 × 高质量数据 × 任务专精调优

AI 研究 / 翻译

OctoCodingBench - Coding Agent 过程合规评测新标准

ISR = CSR^N(N 为规则数)—— 单条规则遵循率的"还行",在多规则场景下会指数级衰减为"完全不可靠"

AI 工具 / Agent 架构

AI 对话范式转变:从实习生指令到启发式钥匙

主题:AI 对话方法论 / 思维伙伴 / 认知升级

AI 工具 / Agent & Skill

AI 生成 UI 方案对比:json-render vs A2UI

两者的核心思想相同:用"结构化中间层"将 AI 的不可控输出转化为可控的声明式描述

AI 工具 / AI 生产力

CC-Switch - AI CLI 统一配置管理工具架构精读

配置管理的本质 = 建立单一可信数据源(SSOT) × 双向同步机制

AI 工具 / AI 生产力

json-render - AI 生成 UI 的约束式革命

"AI → JSON → UI":用结构化中间层将 AI 的"生成自由度"转化为"填空题",从源头消除不可控性

AI 工具 / AI 生产力

AIGC 影视创作工具链与超级个体心法

AI 工具 / 视频生成

PixVerse R1:全球首个通用实时世界模型

实时世界模型 = 通用感知基座(Omni)× 长程记忆机制(Memory)× 极致推理加速(IRE)

AI 工具 / 视频生成

AI 时代软件工程师的未来:五个关键问题

软件工程师的价值公式:价值 = 适应能力 × 系统思维 × (1 - 可替代性)

AI 工具 / 职业发展

Anthropic 揭秘 AI Agents 评估

**原文**:[Demystifying Evals for AI Agents](https://www.anthropic.com/engineering/demystifying-evals-for-ai-agents)

AI 工具 / Agent 架构

Claude Agent SDK:把 Claude Code 能力嵌入你的应用

AI 工具 / Agent 架构

Claude-Mem 持久化记忆系统精读

项目地址:https://github.com/thedotmack/claude-mem

AI 工具 / Agent 架构

Memvid:AI Agent 单文件记忆层

项目地址:https://github.com/memvid/memvid

AI 工具 / Agent 架构

Open Responses API - 下一代 LLM API 调用规范

AI 工具 / Agent 架构

Quest 自进化自主编程 Agent 精读

**精读时间**:2026-01-17

AI 工具 / Agent 架构

Web-Check 一站式 OSINT 网站分析工具精读

**精读时间**:2026-01-17

AI 工具 / OSINT

Quarkdown - Markdown 增强排版神器精读

AI 工具 / 效率工具

Voquill - AI 语音转文字工作区精读

AI 工具 / 效率工具

AgeMem: 统一长短期记忆管理框架

论文:Agentic Memory: Learning Unified Long-Term and Short-Term Memory Management for LLM Agents

AI 研究

Claude Scientific Skills - 科研类 AI 提示词工程标杆

📖 原文:[K-Dense-AI/claude-scientific-skills](https://github.com/K-Dense-AI/claude-scientific-skills)

AI 工具 / Agent & Skill

Claude Code code-simplifier 插件精读

永远不要改变代码的功能——只改变它是*如何做*的

AI 工具 / AI IDE

Cursor 多 Agent 并发编码:数百个 Agent 协同工作数周的经验

AI 工具 / AI IDE

OpenCode - 终端图形界面的 AI 编程 Agent

AI 工具 / AI IDE

Ralph - Claude Code 自动化循环工具

AI 工具 / AI IDE

Superpowers - Claude Code 工程化工作流技能集

💡 **一句话总结**:Superpowers 不是提示词库,而是把软件工程最佳实践(TDD、Code Review、系统化调试)内化成 Claude Code 可稳定执行的技能,解决 AI "缺乏纪律性"的问题。

AI 工具 / AI IDE

Vibe Kanban - AI 编程代理编排平台实操指南

📖 原文:[Vibe Kanban 官方文档](https://www.vibekanban.com/docs)

AI 工具 / AI IDE

AgentCPM-Explore:4B 参数端侧智能体模型精读

AI 工具 / 模型应用

NovaSR - 52KB 极致轻量音频超分辨率模型

AI 工具 / 模型应用

UI-TARS Desktop - 字节开源 AI 操作电脑

💡 **一句话总结**:字节开源的"AI 操作电脑"桌面客户端,通过"看屏幕"而非调用 API 来操作电脑,支持文字/语音指令,实现跨应用自动化任务。

AI 工具 / 浏览器自动化

AGI-Next 前沿峰会 - 清华聚首中国 AI 基模四杰

AI 工具 / 行业洞察

Chrome DevTools MCP - AI 控制 Chrome 调试神器

💡 **一句话总结**:Chrome 官方出品,让 AI(如 Claude)能直接"看到"浏览器的控制台日志、网络请求、DOM 结构和性能数据,从"瞎猜问题"升级为"精准诊断"。

AI 工具 / MCP

文章同步助手 (Wechatsync) - 多平台内容分发 + MCP AI 集成

AI 工具 / MCP

notebooklm-py:Google NotebookLM 的命令行/API 工具

AI 工具 / 效率工具

2025年AI技术回顾:暴力美学时代的终结

💡 **核心洞见**:2025年的技术突破集中在**原来得分为0的短板**——即时推理、长期记忆、视觉处理。

AI 研究

AI 智能体评估实战指南:改了提示词怎么知道改得对不对

📖 原文:技术博客(基于 Anthropic Demystifying evals for AI agents 解读)

AI 工具 / Agent & Skill

RSS.app vs RSS.com - 两个 RSS 项目对比精读

📖 原文:[RSS.app](https://rss.app/) | [RSS.com](https://rss.com/)

AI 工具 / 效率工具

Agent Skills for Context Engineering 项目介绍

💡 **一句话总结**:这是一套将上下文管理策略封装成即插即用技能的工程指南,让智能体从"能跑"迈向"好用"。

AI 工具 / Agent & Skill

NVIDIA Nemotron Speech ASR - 实时流式语音识别模型

📖 原文:[Nemotron Speech ASR 模型](https://huggingface.co/nvidia/nemotron-speech-streaming-en-0.6b)

AI 工具 / 模型应用

Browser Use - 开源 AI 浏览器自动化框架

📖 原文:[Browser Use GitHub](https://github.com/browser-use/browser-use)

AI 工具 / 浏览器自动化

DeepTutor - AI 个人学习助手

📖 原文:[DeepTutor GitHub](https://github.com/HKUDS/DeepTutor)

AI 工具 / 效率工具

MiroThinker v1.5 - 开源搜索 Agent 介绍

💡 **一句话总结**:MiroThinker 不拼参数大小,而是让 AI 像人类研究员一样主动查资料、验证、修正,用 1/30 参数超越顶级模型。

AI 工具 / 效率工具

OpenBB - 开源金融数据平台

📖 原文:[OpenBB GitHub](https://github.com/OpenBB-finance/OpenBB)

AI 工具 / 效率工具

Agentic Design Patterns: A Hands-On Guide to Building Intelligent Systems

📖 原文:[Agentic Design Patterns](https://github.com/sarwarbeing-ai/Agentic_Design_Patterns)

AI 工具 / Agent & Skill

八千字长文复盘「中国故事」诞生过程

📖 原文:[八千字长文复盘「中国故事」诞生过程](https://note.mowen.cn/detail/gYinb8e_lXKz0l0ALEq_u)

AI 工具 / 案例

AntV Infographic 项目精读

AI/ML

METR:AI 能力评估研究报告精读

AI/ML

RAG(检索增强生成)精读笔记

AI/ML

Simon Willison: 2025 大模型之年回顾

AI/ML

DLCM: 动态大概念模型 - 从 Token 到 Concept 的推理范式革新

论文:Dynamic Large Concept Models: Latent Reasoning in an Adaptive Semantic Space

AI 研究

Google Cloud 2026 Agent 趋势报告精读

AI 研究

Google A2UI - Agent 生成 UI 的声明式协议

"声明式 JSON + 组件白名单 + 客户端原生渲染":将 AI 的"执行权"转移到客户端,从架构层面消除安全风险

AI 工具 / AI 生产力

Vibe Kanban - AI 编程代理的"赛博包工头"

项目地址:https://github.com/BloopAI/vibe-kanban

AI 工具 / Agent & Skill

oh-my-opencode - 多模型协作的 AI 编程 Agent 插件

AI 工具 / AI IDE

AI 自动化测试演进:从 Playwright MCP 到 Dev Browser

文章类型:技术博客(工具对比与实践指南)

AI 工具 / 浏览器自动化

MCP 架构文档精读

原文:https://modelcontextprotocol.io/docs/learn/architecture

AI 工具 / MCP

MCP Server 与 Client 概念精读

- https://modelcontextprotocol.io/docs/learn/server-concepts

AI 工具 / MCP

Agentic Patterns - AI Agent 设计模式原理

AI 工具 / Agent & Skill

Anthropic Advanced Tool Use 三件套

AI 工具 / Agent & Skill

Prompt 工程学习笔记

AI 工具 / Agent & Skill

Claude Code 创始人 Boris Cherny 的 13 个使用技巧

AI 工具 / AI IDE

Vibe Coding CN - AI 辅助开发方法论精读

AI 工具 / AI IDE

Awesome LLM Apps - LLM 应用案例集合精读

AI 工具 / 模型应用

AskUserQuestion 工具与苏格拉底式提问法

AI 工具 / 案例

GitHub 开源项目精读(5 个 AI/开发工具)

AI 工具 / 案例

Slidev 精读笔记

AI 工具 / 效率工具

SuperWhisper - AI 语音转文字工具精读

AI 工具 / 效率工具

UI/UX Pro Max Skill - AI 助手的设计大脑

📖 原文:[ui-ux-pro-max-skill](https://github.com/nextlevelbuilder/ui-ux-pro-max-skill)

AI 工具 / Agent & Skill

2025

A Guide to Claude Code 2.0 and getting better at using coding agents

📖 原文:[A Guide to Claude Code 2.0](https://sankalp.bearblog.dev/my-experience-with-claude-code-20-and-how-to-get-better-at-using-coding-agents/)

AI 工具 / AI IDE