Etcetera · Agent 工程师 · 4 年工作经验

构建生产级 AI 智能体, 连接大语言模型与现代软件架构

向下展卷

Agent Skills · Harness · Memory · RAG · Prompt Caching

具备扎实软件架构能力的 Agent 工程师。擅长将大语言模型(LLM)能力与实际业务结合,开发高效、稳定的智能体(Agent)产品和跨平台客户端。深入理解并应用智能体技能(Skills)、上下文记忆(Memory)、检索增强(RAG)等前沿技术。同时在桌面端和前端架构(Vite+、Electron、Rust)上有深厚积累,注重系统设计的可观测性、可恢复性以及工程交付效率。

AI Engineering

智能体技能 (Skills)、运行环境 (Harness) 与 RAG 的闭环架构

将模型能力封装为 Skills,通过 MCP 协议扩展外部工具,并在具备可观测性的 Harness 环境中管理 Session 与 Memory——这一闭环确保智能体系统具备生产级的稳定性。

智能体工具与技能扩展 (Agent Skills & Tools)

将业务动作封装为可复用的智能体技能,通过模型上下文协议 (MCP) 接入外部能力。设计带有权限审批、结构化输出和流式交互的工具调用层,使用多智能体协作拆解复杂任务。

核心运行环境与架构 (Agent Harness)

把 Harness 视为决定模型能力兑现程度的产品层——与 Anthropic(Claude Code)、Cursor 的工程路线一致。构建生产级别的智能体运行环境,涵盖会话管理、状态机调度、生命周期钩子、工具权限与审批门控、事件溯源与中断运行自动恢复,保障系统的健壮性。

上下文与记忆工程 (Memory & Context)

精细化管理大模型上下文。利用短期记忆、图谱上下文、Prompt 缓存和 Token 预算控制等技术,在保证多步推理质量的同时,有效控制系统计算成本。

检索增强生成 (RAG & Retrieval)

搭建多维度的知识检索链路。结合文本分块、向量搜索、全文检索和标签倒排索引,并利用 LLM 重排优化召回策略,确保生成内容的准确性和可追溯性。

Selected Work

代表项目与工程交付

精选在智能体知识库、AI 辅助编程 (AI Coding)、加密通信及量化交易桌面端领域,真正落地交付并稳定运行的核心系统。

查看完整经历

DCS Procurement AI Workflow

工作流设计 / 全栈工程师 · 2026.03 - 至今

面向酒店采购场景的多智能体(Multi-Agent)决策工作流,覆盖投标收集、评审打分、合同审核与归档审计的完整闭环。负责智能体运行时、后端服务与 React 工作台的全栈落地,将专家级评审方法论沉淀为可审计、可复盘的自动化决策流程。

  • 设计了由主控智能体(Supervisor)与多个专项评审子智能体(Sub-agents)组成的协作架构,分别承担技术评审、商务评审与合同合规审核三条审查链路。
  • 联合领域教授将供应链、商务谈判与法律合规等专业评审方法论沉淀为子智能体的评分规则与专家角色画像,使每个子智能体都具备可解释的专业评审视角。
  • 实现了类 Slock 的子智能体「群聊式」协作机制:每个子智能体作为拥有独立身份与记忆的常驻成员加入共享频道(Channel),在共享上下文中以结构化消息相互交流,并由主控智能体进行轮次调度与 @ 点名转交,使多个专家智能体能在同一「会议室」内就同一份标书展开讨论并收敛出评审结论。

AI SDK · Multi-Agent · Agent Channels · Structured Output · React · Hono · PostgreSQL

Etyon 桌面端 AI 智能体工作台

Agent 架构工程师 · 2026.05 - 至今

一款本地优先的桌面端智能体(Agent)工作台。旨在通过可视化聊天、工作区工具、权限审批和可观测的运行记录,构建一个可随时恢复执行状态的健壮 Agent 核心系统,并从中沉淀出一套标准化的桌面应用开发架构。

  • 设计并实现智能体核心调度环境(Harness 层),将模型调用、上下文组装、工具执行、权限审批、子智能体委派与事件日志解耦为高内聚、可观测且支持断点恢复的模块,并接入 Anthropic、OpenAI、AI Gateway 等多 Provider(含 API 模式切换与代理感知的网络层)。
  • 刻意将工作区工具面收敛为最小可审计集合(read / ls / grep / edit / write,写操作强制审批),配合机密路径过滤与数据落库前的 secret 脱敏(API Key、Token 等自动擦除),把模型执行风险压在可审计、可控的范围内。
  • 开发运行检查器(Run Inspector)与持久化的待审批列表:每条助手消息可下钻到对应运行的工具调用与事件时间线,未完成的审批在应用重启后仍可从中断处继续(7 天自动过期)。

Vite+ · Electron · React · Hono · AI SDK · SQLite · Rust CLI

Internal Knowledge Agentic System

Agent 工程师 · 2025.01 - 至今

一款面向个人知识管理与间距重复(Spaced Repetition)的系统。提供基于 Agent 的辅助问答、强大的多维检索基底、图谱上下文关联以及跨平台富文本编辑体验。

  • 基于 Mastra 设计并落地由智能体驱动的业务架构,通过沙盒环境下的工具调用与审批流(增删改类工具强制审批、读类工具放行),安全地执行业务数据的增删改查。
  • 重构了多路召回引擎,融合大模型查询重写、全文检索(FTS)、标题匹配、标签倒排索引与向量检索(pgvector),并引入精准的大模型重排(LLM Reranker)策略。
  • 基于 xyflow 开发了知识图谱引擎,将笔记间的引用(/ref)和标签关联转化为高密度的图谱上下文,提升了大模型在跨长文内容的推理能力。

TanStack Start · React · TailwindCSS · React Native · Expo · Hono · oRPC

Cursor Hackathon · AI Coding Agent

Agent 工程师 · 2025.11 - 至今

一款类似 Claude Code 的 AI 编程助手,集成了会话管理、多样化工具流、规划与执行(Plan / Exec)机制以及上下文自动压缩功能。

  • 主导了该 AI 编程工具的整体架构设计、代码规范制定以及初始的 IDE 插件选型。
  • 开发了核心的会话管理模块,健壮地处理上下文拼接、状态机流转、生命周期钩子以及数据流底层机制。
  • 构建了支持流式输出、语法高亮和全键盘交互的 TUI / CLI 终端交互层。

AI Coding · TUI · CLI · LSP · Web Search · Agent Harness

Now

目前专注于 Agentic 产品工程、上下文工程 (Context Engineering) 及 AI 辅助编程工具链的开发。

联系我

刻一方印

至少两个字符起刻