重读《Building Effective Agents》:怎么才算构建了一个"高效"的 AI Agent

Posted on 日 02 8月 2026 in AI • Tagged with journal, AI, agent, LLM, workflow

Anthropic 那篇《Building Effective Agents》我隔一阵就翻一遍,每次读都有点新体会。这篇是我第 N 次重读后的笔记:先把 workflow 和 agent 掰扯清楚,再把五种 workflow 模式和真正的 agent 逐个过一遍,重点讲什么时候该用、什么时候别用,最后落到一张选型表和一份落地清单。核心就一句话——别一上来就上 agent,能用简单模式解决的,绝不加复杂度。


Continue reading

MCP 大改版:从"打电话"变成"发快递",附一个高德天气 MCP Server

Posted on 日 02 8月 2026 in AI • Tagged with journal, AI, MCP, agent, python

2026-07-28 版 MCP 规范被官方称为"发布以来最大的一次改动":协议核心从有状态改成无状态,握手和 Session Header 被砍掉,长任务、UI、鉴权都拆成了扩展。这篇先用大白话讲清楚这次到底改了什么、为什么改,再用一个"高德天气 MCP Server"的 Python 实例带你上手。


Continue reading

边车和服务之间怎么说话最快:HTTP、gRPC、UDS 的一场同机较量

Posted on 日 02 8月 2026 in Tech • Tagged with journal, sidecar, grpc, http, uds, service-mesh

边车(sidecar)和主服务跑在同一个 Pod 里,只隔着一层内核,却常常还在用 localhost:8080 这种"绕远路"的方式通信。这篇把同机通信的三条主流路子——HTTP over TCP、gRPC、以及走 Unix Domain Socket(UDS)——的技术细节、延迟、吞吐、序列化开销和运维成本摊开对比;并专门讨论迁移成本最低的 HTTP over UDS 及其双向通信短板,给出 SSE / WebSocket / gRPC over UDS 三档解法。最后附一张选型表和落地清单,帮你在真实场景里选对那条最短的路。


Continue reading

DPoP 详解:给浏览器里的令牌也上一把“偷不走”的锁

Posted on 六 01 8月 2026 in Tech • Tagged with journal, blog, security, oauth, jwt, dpop, zero-trust

mTLS + 证书绑定令牌很安全,但浏览器和 App 里没法优雅地管客户端证书。DPoP(RFC 9449)就是为公网客户端准备的那把锁:客户端自己生成一对公私钥,每次请求都附上一个用私钥签名的 DPoP proof。本文把 DPoP 的每个字段、两段流程、防重放机制和常见坑一次讲透,并回答“服务间调用要不要用 DPoP”,顺带讲清 SPIFFE JWT-SVID 的定位。


Continue reading

令牌被偷了也白搭:说清楚 PoP 与证书绑定令牌

Posted on 六 01 8月 2026 in Tech • Tagged with journal, blog, security, oauth, jwt, mtls, dpop, zero-trust

Bearer Token 最大的毛病是“谁捡到谁能用”。本文用大白话讲清两个专治盗用的概念——PoP(证明我是令牌的主人)和 Certificate-Bound Token(令牌只认这张证书),顺带把它们跟 mTLS、DPoP、Kubernetes、SPIFFE 之间的关系理顺。


Continue reading

给微服务造一个 STS:像 AWS 一样发放临时凭证

Posted on 六 01 8月 2026 in Tech • Tagged with journal, blog, security, microservices, sts, jwt, oauth

微服务之间到底该怎么互相证明“我是谁、我能干什么”?本文借 AWS STS 的思路,拆开临时凭证的门道,对比 JWT+OIDC 与 AWS 式 AssumeRole 两条路线,并给出可以直接跑起来的最小实现。


Continue reading

传统的软件教程,在 AI 时代该与时俱进了

Posted on 五 31 7月 2026 in Tech • Tagged with journal, AI, documentation, developer-experience, tutorial

写了大半辈子技术文档,我一直用“教程 + 例子 + FAQ”那一套教别人用 API/SDK,后来又加了 AI skill,可还是不够直观。这篇聊聊我的反思:AI 时代的软件教程,应该是可交互、可执行、有 AI 随时答疑纠错的“活教程”——sandbox 演示 + 类 Notebook 的边看边跑 + AI 助教,能把市面上大多数静态教程甩开一条街。


Continue reading

AI 的“操作系统”:Harness 工程如何让模型自我改进

Posted on 五 31 7月 2026 in AI • Tagged with journal, AI, harness, agent, LLM, 自我改进

为什么 Claude Code、Codex 这些编码 Agent 感觉比“裸模型”聪明得多?秘密不在模型参数里,而在模型外面那层叫 Harness 的壳。这篇翻译并解读 Lilian Weng 2026 年 7 月的长文《Harness Engineering for Self-Improvement》:什么是 Harness、三大设计模式、优化路线图(上下文工程→工作流→自我改进→进化搜索→权重联合优化)、七大未来挑战,以及我作为一个后端老兵的解读。


Continue reading

深入 MySQL 的锁:从行锁、间隙锁到度量驱动的排障

Posted on 四 30 7月 2026 in Tech • Tagged with mysql, innodb, lock, , 事务, 并发, metrics-driven-development, 度量驱动开发, monitoring, distributed-lock, 分布式锁, 死锁, 数据库

MySQL 的锁是很多线上事故的“隐形主角”——超卖、死锁、慢查询拖垮整个库,往往都能追到锁上。本文从并发下为什么需要锁讲起,把 InnoDB 的全局锁、表锁、MDL、行锁、间隙锁、Next-Key Lock 一层层拆开,再用 Metrics-Driven Development 的方式定义业务、应用和数据库指标,演示如何发现、定位、改进和验证锁问题,最后讨论 MySQL、Redis、ZooKeeper/etcd 分布式锁的边界。


Continue reading

后端工程师的 AI Infra 学习路线

Posted on 四 30 7月 2026 in Tech • Tagged with AI, AI Infra, career, infrastructure, learning

一份可实操的 AI Infra 自学路线——包含六阶段的知识地图、每阶段的推荐资源、动手实验和验收标准,附带完整的练级手册 Checklist,让后端工程师按图索骥,3~4 个月转型 AI Infra。


Continue reading

AI Agent 孵化器:用一个父 Agent,批量造出贴身服务的子 Agent

Posted on 三 29 7月 2026 in AI • Tagged with journal, AI, agent, ReAct, LLM, vibe-coding

与其一个个手搓专业 AI Agent,不如造一台"孵化器"——一个父 Agent,听你一句大白话,就快速孵化出贴身服务某类需求的子 Agent。这篇聊聊这台"AI Agent 制造工厂"的运转机制:父 Agent 怎么把自然语言编译成五份产品图纸(角色/工具/规矩/提示词/验收),照着标准模板批量生产,再让子 Agent 用 ReAct 边想边做。以日程安排专家作为流水线上的第一个样品。


Continue reading

K8s 是怎么被攻破的:威胁模型与攻击树入门

Posted on 三 29 7月 2026 in Tech • Tagged with kubernetes, security, threat-modeling, attack-tree, k8s, cloud-native, STRIDE

把 K8s 集群想成一座城:apiserver 是市政大厅,etcd 是档案馆存着所有户口和钥匙,kubelet 是每个街区的物业管家。攻击者很少一步登天,更多是从一个不起眼的 Pod 开始,一格一格往上爬,直到拿到"城主令牌" cluster-admin。这篇借 ControlPlane 与 Kubernetes 官方安全审计的威胁模型,用 STRIDE 逐个拆解核心组件的风险,再画一棵"从一个 Pod 打到集群管理员"的攻击树,最后给一份能照着做的加固清单。


Continue reading

验收用例,才是驾驭 AI 编码的那根缰绳

Posted on 二 28 7月 2026 in AI • Tagged with journal, AI, testing, methodology, harness

我以前有位高级 QA 老同事:每次 Design Review 之后,她都会拿出一整套验收用例,没通过就别把软件包交给她。如今我们已经不是同事,我却把她的质量纪律“蒸馏”成了 qa-acceptance-harness,并配上 lazy-harness-audit 和 lazy-harness-helper:先定义什么叫做对,再用证据验收、审计和改进 AI 编码护栏。


Continue reading

开会的艺术之一:在开会时实时分享 Agenda 和会议记录

Posted on 二 28 7月 2026 in Journal • Tagged with meeting, communication, collaboration, agenda, meeting notes

同一场会结束后,大家常常带走不同版本的结论。我的做法是把 Agenda 和会议记录变成一份实时共享的“会议工作台”,让共识当场形成、责任落实到人,也让团队协作少一点猜测,多一点信任。


Continue reading

承认平凡,但不要默认平庸

Posted on 一 27 7月 2026 in Journal • Tagged with journal, reflection, ordinary-life, responsibility, 三不朽

承认能力、机会和时代的边界,不等于向平庸投降。古人的“立德、立功、立言”和“横渠四句”,放到今天,也可以从普通人的责任半径做起:护住家人,做好手里的事,留下一点对别人有用的东西。


Continue reading

Zanzibar 精读:Google 如何在十毫秒内回答“你能看这份文档吗”

Posted on 一 20 7月 2026 in Tech • Tagged with authorization, zanzibar, rebac, distributed-system, consistency, spanner, security, paper-reading

Zanzibar 最难的并不是把权限存成关系元组,而是在全球规模下同时守住用户意图、低延迟和高可用。本文精读 Google 2019 年论文,拆解关系模型、zookie 一致性协议、递归查询、Leopard 索引与热点治理,并给出一份普通团队可以直接复用的设计清单。


Continue reading

用 Quarto + Notebook 写一本"能跑起来"的技术书

Posted on 一 20 7月 2026 in Tech • Tagged with quarto, jupyter, notebook, mermaid, technical-writing, AI-agent

写技术教程最尴尬的一点:文字讲得头头是道,读者一跑代码全是坑。我这些年攒了不少笔记,一直想找个既能写概念、又能嵌可运行实验、还能一键出网站/PDF/EPUB 的工具。Quarto + Notebook 这套组合基本满足了我的贪心。本文用一个"AI Agent Loop 入门教程"做实例,从二十行的最小循环骨架,一路加料到接真模型、上安全文件工具、加记忆和任务验收的可用 Agent,演示怎么把 .qmd 文字章节、.ipynb 可运行实验、Mermaid 时序图拼成一本能在线读、能导出出版的书。


Continue reading

如何为你的服务创建统一的授权中心

Posted on 一 20 7月 2026 in Tech • Tagged with authorization, microservice, oauth2, opa, openfga, spiffe, keycloak, zero-trust, security, architecture

微服务各管一套权限,最后往往没人说得清谁能调用谁。本文给出统一授权中心的分层架构、协议选择、典型实例与演进路线,重点讲清身份、决策和执行如何分工。


Continue reading

重读软件设计的哲学:AI 能替我们把复杂性消灭掉吗

Posted on 日 19 7月 2026 in AI • Tagged with journal, software design, AI, complexity

AI 写代码越来越快,还会推理、能给出好几套方案,很多人以为软件开发那点"难"终于要被抹平了。重读 Ousterhout 的《软件设计的哲学》,我越发确信:AI 干得了参谋,列得出选项,却还挑不出"最适合你这个系统"的那一个。复杂性不是被消灭,而是成了 AI 能帮你走多远的天花板——它反而让"判断与拍板"这件事更值钱,而不是更没用。


Continue reading

LightRAG 精读:既然有了 GraphRAG,为什么还要"轻"一下

Posted on 日 19 7月 2026 in AI • Tagged with journal, AI, RAG, LightRAG, GraphRAG, knowledge-graph, llm

传统 RAG 把文档切碎成 chunk 各自嵌入,遇到"多个实体互相牵连"的问题就抓瞎。GraphRAG 用知识图谱补上了关系,却贵得离谱、更新一次能烧掉几百万 token。这篇精读港大与北邮的 LightRAG 论文(arXiv:2410.05779),先把传统 RAG 的老毛病摊开,再拆 LightRAG 的图索引 + 双层检索 + 增量更新,最后落到一张选型对照表。


Continue reading