AI / Agent / System Design

把复杂系统讲清楚

记录 AI、Agent、系统设计与工程实践。内容以一线问题、长期方法和可复用经验为主。

Knowledge Map

按主题查看长期知识资产

如果你更关心我已经沉淀了哪些长期主题,而不只是最近写了什么,可以直接从知识地图进入。

查看知识地图

最新文章

llm评测

少于 1 分钟阅读

简介(未完成) 挑战 评测流程 与时俱进 简介(未完成) 揭秘大模型评测:如何用“说明书”式方法实现业务场景下的精准评估 大模型评测的目标是通过设计合理的测试任务和数据集来对大模型的能力进行全面、量化的评估。 性能测试通过压测实现。 基础模型的Benchmark(基准测...

rl微调

1 分钟阅读

简介(未完成) RL赋能 实践 与文档解析 Query生成 tool-use rl 优化Planner 简介(未完成) 精心设计的奖励函数对于有效的强化学习训练至关重要,因为它提供了优化信号,引导策略朝着理想的行为发展。在...

分布式Agent与A2A

5 分钟阅读

简介 分布式Agent系统 挑战 协作方案 A2A 概念 通信 安全 A2A vs MCP 源码 low level a2a-python ...

deepresearch梳理

1 分钟阅读

简介 26年 Deep Search:搜索的本质与难点 能真正留住用户的,一定是”Deep”。 端到端 vs 固定工作流:两者的折中方案 端到端 RL赋能 模型怎么训练 怎么奖励? 数据 工程 ...