Agent
共 20 篇文章。
Agent 测试
把概率性的 Agent 拆成可验证的组件、轨迹与任务:测试夹具、Trace 回放、离线评测、安全对抗和 CI 门禁。
端到端与回归测试
关键用户旅程、Playwright隔离、异步等待、Trace证据、Flaky治理,以及 Agent 端到端如何验证工具与副作用。
Grafana 与信号关联
Grafana Data Source、Dashboard、Explore与Alerting,以及Metrics、Traces、Logs如何关联成AgentOps排障与回归闭环。
Logs 与 Loki
结构化日志、事件模型、Loki标签与Structured Metadata、LogQL、采集可靠性、隐私治理及Agent日志设计。
性能与可靠性测试
Benchmark、Load、Stress、Spike、Soak、容量模型、长尾延迟、故障注入,以及 Agent 的 Token、成本与工具链路性能。
测试
软件测试系列入口:基础、单元测试、集成与契约测试、端到端、性能可靠性,以及 Agent 测试。
测试基础
从测试对象、Oracle、测试分类与反馈层次,到覆盖率、Mutation、风险驱动和 Agent 系统的双重不确定性。
Traces 与 OpenTelemetry
Trace、Span、Context Propagation、采样、Collector、Tempo,以及Planner、Model、Tool与Retrieval的Agent Span设计。
单元测试
测试边界、AAA、Table-driven Test、Test Double、属性测试、Fuzz、并发与时间,以及 Agent 确定性组件的测试方法。
协议
从 Socket、TCP、HTTP、SSE 与 WebSocket,一路拆到 RPC、JSON-RPC 和 MCP;把分层、连接、流式传输、超时重试与 Agent 工程串成一条线。
Agent 评测
从检索排序指标、工具与轨迹评测,到数据集构建、离线与端到端测试、统计检验、Baseline 和回归门禁。
微调与 LoRA
区分 Prompt、RAG、Tool、LoRA 与全量微调,解释低秩更新、数据构造、评测和 Agent 项目落点。
Agent 运行时
结合 AgentOps 项目回答长任务状态、SSE 补放、Redis/SQLite 分工、取消语义与可审计 Trace。
SSRF
Agent HTTP Tool 的 SSRF 防护:窄参数、URL 校验、DNS Rebinding、Egress Policy、凭据隔离与审计。
Agent 架构
从受控行动循环出发,说明 Agent 核心组件、主流工具调用、思维链、ReAct 与多 Agent 编排难点。
Agent
Agent 运行时、检索、评测、工具编排、安全与微调的独立复习入口。
OpenViking 上下文数据库复习笔记
火山引擎开源的 AI Agent 上下文数据库:viking:// 文件系统范式、L0/L1/L2 分层加载、目录递归检索、三种上下文类型、会话与记忆提炼,以及 Go 客户端/Agent 的实现八股。
AgentOps 故障诊断平台复习笔记
整理 AIOps 多 Agent 故障诊断项目的关键点,覆盖 ReAct、Tool Calling、MCP、GraphRAG、Vector RAG、可观测性、审计链路和 RAG 评估。
从 Human-native 到 Agent-native:我对 AI-native 软件工程的理解
AI-native 不是用 AI 写代码,而是把项目组织成适合 AI Agent 理解、修改、验证和持续演化的工程系统。
多模态机器人对话导航系统:从感知到执行的 Agent 链路
基于 Python + Pydantic + FastAPI 风格 HTTP 服务搭建的多模态对话 Agent 原型,覆盖 VLM 图像理解、多轮状态管理、结构化输出校验、端云路由、工具调用、主动交互与 Case 分析,面向机器人交互场景的完整技术实践。