项目经历

4 个项目,涵盖企业系统、数据可视化、AI 对话、在线教育。

EraHerm 个人 AI Agent 生态

云端部署 · 记忆内核 · 口袋客户端 全链路 AI Agent 实践

2026.07 - 至今运维工程师 + AI 系统开发 + Android 客户端开发

将开源 AI Agent 框架 Hermes Agent(Nous Research)部署到阿里云 ECS(1 核 1.6G),为其自研 EraHerm-Memory 记忆内核实现持久化语义记忆。1.6G 内存同时跑 Hermes + 记忆服务 + Nginx:通过 swap 兜底、fastembed 轻量化选型(ONNX 运行时仅 ~50MB、不装 PyTorch)和重负载构建外移 4G 构建机来规避 OOM,全程零 OOM 崩溃。记忆内核从 hashing 升级为 fastembed 语义 embedding(BAAI/bge-small-zh-v1.5),以 MCP Server 形式本机挂载,Hermes Agent 作为 MCP Host 原生调用 remember/recall/impact 记忆工具,零外部 API 费用。同时自研 HxSync 安卓客户端(Kotlin + Compose,AGPL-3.0 开源)把整套 Agent 装进口袋:远程 WebSocket / 直连 OpenAI 兼容 HTTP / 本地 Gemma 三模式上下文相互隔离、切换不串场,本地模式长对话自动开新会话防上下文膨胀,经 Nginx 反代 + 身份层(一人一 Key 双用户隔离)直连 Hermes,支持离线语音唤醒(sherpa-onnx KWS)、本机工具确认卡,构成部署、记忆、客户端完整的个人 AI 生态。

技术栈

LinuxNginxCloudflareFastAPIfastembedSQLiteMCPnftablesFail2banPythonKotlinJetpack ComposeAndroidWebSocketsherpa-onnx

核心功能

阿里云 ECS 初始化:系统优化、swap 配置、无用服务清理、内存水位监控
OOM 规避:swap 兜底 + fastembed 轻量化(ONNX 运行时 ~50MB,免装 PyTorch)+ 重负载构建外移 4G 构建机,1.6G 全程零 OOM 崩溃
Nginx 反向代理:HTTPS 证书自动续签、HTTP→HTTPS 强制跳转
nftables 防火墙:精细化规则,仅开放 22/80/443,默认 DROP
EraHerm-Memory 记忆内核:FastAPI + SQLModel + SQLite,六边形架构
语义 Embedding:hashing → fastembed(BAAI/bge-small-zh-v1.5,512维)
冲突检测与 Pinned 优先级机制:自动识别矛盾记忆,纠正版强制优先
MCP 分层:EraHerm-Memory 作 MCP Server 本机挂载(8000),Hermes 作 MCP Host 调用 remember/recall/impact 工具;手机端经 HTTP/WS 由 Hermes 代理,不直连 MCP
速率限制:每 IP 每秒 10 请求上限,连接数 50 并发限制
Fail2ban 自动封禁:5 分钟 3 次 404 自动封 2 小时
Cloudflare CDN:DDoS 清洗、真实 IP 隐藏、5 秒盾防 Bot
OpenAI 兼容 API 服务:HxSync 经 Nginx 80 反代直连 Hermes,SSE 流式对话
身份层一人一 Key:X-Hermes-Session-Key/Id 双用户隔离,长期记忆按 user_id 分域
HxSync 口袋客户端:远程 WebSocket / 直连 API / 本地 Gemma 三模式
状态隔离:三模式上下文相互独立,切换不串场;本地模式长对话自动开新会话防上下文膨胀
离线语音唤醒:sherpa-onnx KWS + 离线短指令 ASR,喊一声即可对话
本机工具确认卡:日历/闹钟必须用户确认才执行,安全边界清晰

项目亮点

  • 从裸机到生产环境,完整覆盖服务器初始化→服务部署→安全加固→CDN 接入全流程
  • 自研记忆内核从 hashing→fastembed 升级,语义召回从 0% 提升到 100%
  • MCP 协议集成实现 Agent 原生调用记忆工具,零 curl 零外部 API 费用
  • 自研 HxSync 安卓客户端打通云端 Agent:手机装进口袋,66 个 Kotlin 文件 / 7200+ 行
  • 一人一 Key 身份层:一个 Hermes 同时服务多人,对话与记忆双层隔离互不串味
  • 低配极限实践:1.6G 内存通过 swap + 轻量化 + 构建外移跑通完整 AI 生态,OOM 规避方案可复述可验证

企业OA办公自动化系统

Spring Boot + Vue 3 前后端分离办公平台

2026.04 - 至今全栈开发工程师

全栈自研的企业级办公OA系统,基于 Spring Boot 3.4 + Vue 3 + Element Plus 构建。系统涵盖用户权限管理、考勤打卡、审批流程、任务管理、通知公告、在线聊天等核心模块,支持动态菜单配置与角色权限分配。在线演示地址:https://oa.eraherm.com,演示账号:admin / 123456(随时可重置,放心体验)。

技术栈

Spring Boot 3.4Vue 3Element PlusMyBatis-PlusMySQLSpring SecurityJWTPiniaEChartsMaven

核心功能

审批流程引擎:费用报销、出差申请、转正/离职审批,支持多级会签
考勤管理:签到/签退打卡,迟到/早退判定,周报月报自动统计
用户权限:RBAC 角色权限模型,动态菜单路由
任务管理:个人任务与全局任务,进度跟踪
通知公告、在线聊天、日程管理
扩展中:采购管理模块(供应商管理、采购订单、审批流转)

项目亮点

  • 从0到1独立全栈开发,架构清晰、代码规范
  • 自研审批流引擎,支持多种审批类型与动态审批人配置
  • 考勤月报实现人员×天交叉表统计,支持应出勤天数编辑

项目截图

EraHerm-Memory 智能记忆内核

FastAPI + SQLModel + fastembed 持久化记忆系统

2026.07AI 系统开发者

为 AI Agent 设计的持久化记忆内核,采用六边形架构(Ports & Adapters),支持多层记忆(L1工作记忆/L2长期记忆/L3归档)、语义 embedding 召回、知识图谱、冲突检测与反馈闭环。集成 MCP 协议(Model Context Protocol),让 AI Agent 原生调用记忆工具。

技术栈

PythonFastAPISQLModelSQLitefastembedNetworkXAlembicMCPPydantic

核心功能

多层记忆架构:L1 工作记忆 / L2 长期记忆 / L3 归档,逐层衰减与晋升
语义 Embedding:fastembed(BAAI/bge-small-zh-v1.5),本地 ONNX 运行,零外部 API
知识图谱:自动抽取实体与关系,支持依赖影响分析
冲突检测:写入时自动对比已有记忆,识别矛盾并告警
Pinned 优先级:纠正版强制置顶,旧版不丢但不再优先
MCP 协议集成:Hermes Agent 原生调用 remember/recall/impact 工具
SDK 直调:Python SDK 零 curl 调用
SQLite 持久化:零运维,单文件存储

项目亮点

  • 六边形架构设计,边界清晰、测试友好
  • 100% 本地运行,不依赖任何外部 API,零成本运营
  • 从 hashing 升级到真实语义 embedding,召回准确率大幅提升

水库水文数据监测可视化系统

Flask + MySQL + ECharts 数据监控平台(毕业设计)

2025.12 - 2026.03全栈开发者(毕业设计)

基于 Flask 框架的水库水文数据监测系统,实现水位、降雨量、流量等水文数据的采集、管理、分析和可视化展示。支持多水库管理、智能预警、统计分析及地理信息展示,适用于水利管理部门的日常监测与决策支持。在线演示地址:https://shuiku.eraherm.com,演示账号:admin / admin123(随时可重置,放心体验)。

技术栈

Python FlaskMySQLBootstrap 5EChartsLeafletPandas高德地图API

核心功能

多水库管理:水位、降雨量、流量实时监测
智能预警:超阈值自动告警
数据分析:折线图、柱状图趋势展示
地图展示:Leaflet + 高德底图,水库地理分布可视化
数据导入导出:支持 CSV/Excel 批量操作
双角色权限:管理员与普通用户分级管理

项目亮点

  • 独立完成从需求分析到部署上线的完整项目开发
  • 结合 ECharts + Leaflet 实现数据与地理信息的双重可视化
  • 支持多水库管理、智能预警与数据导入导出

项目截图

AI 智能对话助手(小忺)

Python + Vue 3 + Ollama 本地大模型对话平台

2026.04 - 2026.05全栈开发者

支持本地大模型部署的智能对话助手,兼容 OpenAI API 格式。提供流式对话、历史记录管理、多会话管理等功能。后端基于 FastAPI 构建,前端使用 Vue 3,本地推理由 Ollama 驱动。

技术栈

Python FastAPIVue 3OllamaMySQLOpenAI APIElement PlusSSEDocker

核心功能

支持本地大模型部署(Ollama),数据不出本机
流式对话(Server-Sent Events),打字机效果
多会话管理:新建、切换、删除会话
对话历史持久化存储
兼容 OpenAI API 格式,可切换多种模型
支持 Markdown 渲染,代码高亮

项目亮点

  • 独立全栈开发,从模型部署到前后端交互完整实现
  • 支持本地部署与云端 API 双模式切换
  • 流式响应架构,对话体验流畅

项目截图