文档索引

Hetu 是本地优先的 AI 知识与 Agent 工作台。文档按功能域分页,每页包含该功能的操作路径、配置项、数据落点与常见排错。

第一次使用按 快速开始 → 笔记 → Agent 工作台 → Code 会话 读;关心实现细节直接看 架构与实现。
桌面外壳(Tauri 2) 窗口 · 托盘 · 自动更新 · sidecar 管理 浏览器(开发模式) http://localhost:5174 React 19 前端 页面 / 组件 / Zustand / TanStack Query SSE 事件流渲染 · 消息队列 · 工具面板 i18n(zh / en) · 深浅色主题 ASP.NET Core API REST(ApiResponse / PagedResult) + SSE /scalar/v1 接口文档 · /api/health 健康检查 领域服务(Hetu.Core) 笔记 / 对话 / 工作台 / 知识库 / 图谱 / Wiki / 记忆 仓储接口 · 后台任务协调器 · Agent 循环 模型供应商 OpenAI 兼容 · Anthropic(Key 加密存储) MCP 服务 stdio · JSON-RPC 2.0 · tools/list + tools/call Git 与 CLI 工作树 · gh / glab · 真实 PTY 外部检索 联网搜索(可开关) SQLite + sqlite-vec(默认) PostgreSQL + pgvector
一次请求会经过外壳或浏览器 → React 前端 → ASP.NET Core API → 领域服务 → 仓储 → 本地数据库;模型、MCP、Git 与搜索是外部依赖。

功能文档

页面覆盖内容
快速开始三种运行方式、首次配置模型与索引、数据目录位置
笔记双视图编辑、选区 AI 动作、笔记本与标签、历史版本、分享链接、回收站、导出
Agent 工作台会话与话题、SSE 事件、输入工具带、权限模式与运行模式、队列与运行中引导、蒸馏成笔记
Code 会话项目管理、工作树与分支、Git 同步、文件/更改/检查点/Git/PR/浏览器/终端、PR 集成
知识库来源与分块、向量索引、覆盖率、索引管理与批量补索引、语义搜索测试、维度配置
知识图谱与 Wiki实体与关系抽取、类型与可视化操作、Wiki 生成材料与阶段、套件结构
记忆与 Dream记忆字段与作用域、召回时机、Dream 参数与输出
看板与自动化任务看板列与状态、Agent 执行与运行步骤、工作流节点、后台任务类型、Cron、收件箱
扩展与集成智能体预设与工具策略、技能来源与调用、内置工具清单、MCP 配置、内嵌应用
模型与用量供应商协议、模型用途、按场景默认、代理接口与路由、用量指标、压缩管道
桌面应用双渠道、自动更新与镜像回退、托盘、sidecar 生命周期、工作树目录与清理、打包
数据与安全数据目录、备份与迁移、PostgreSQL 切换、向量存储、隐私与安全边界
架构与实现分层与依赖、请求流、数据模型、仓储与分页、SQLite 限制的处理、告警与质量约定
常见问题安装失败、模型不可用、索引不动、工作树、更新报错、性能
参与开发目录结构、构建与验证命令、易踩约定、发版流程

深入实现

写给要读代码或改行为的人:每个模块的关键机制、配置项与默认值、守卫与降级、以及排查方式。

模块覆盖内容
压缩管道两个入口、三种模式、十个节点的顺序与默认状态、LLM 摘要四道门槛、未变短保留原文、配置合并与升级语义
Agent 循环一次运行的六步顺序、迭代与工具上限、运行中引导的注入点、历史压缩边界、MCP 装载与降级、事件出口
权限与审批五档模式的具体行为、三层判定顺序、规则字段与匹配评分、autopilot 的影响、三条入口的差异
上下文与自动压缩占用三段算法与窗口解析、0.8 触发比例、保留最近 6 条、摘要重试与 60k 截断、写回语义
SSE 事件协议三种帧形态、完整事件清单与字段、工作流事件、两条流的差异、新增事件的适配流程
分块与向量索引LLM 与结构化分块参数、写入顺序与虚表 DELETE+INSERT、未变块复用向量、维度三级解析与重建、降级路径
语义检索笔记与分块两路召回与候选倍数、去重合并、结果投影、四类消费方、降级与质量实践
知识图谱抽取单轮抽取路径、JSON 输出契约与白名单、名称归一化与去重、按笔记清理与恢复、实体合并、失败路径
Wiki 生成资料采集与压缩、规划约束与回退、并发 4 的生成与续写机制、总览页要求、整套落库与过期判定、失败降级
记忆的写入与召回记忆模型与作用域、三条写入路径、召回打分公式的五个分量、topK 与访问副作用、存储介质
Dream 记忆巩固触发与执行条件、配置默认值与约束、贪心聚类与代表选择、合并统计、衰减与遗忘阈值、返回统计
任务看板与自动化状态机白名单与时间戳、卡片模型与自动化判定、触发点与执行门槛、评论回流、详情回填、条件轮询
工作流引擎定义模型与 JSON 落库、九个端点、图校验规则、十种节点执行器、运行上限与状态机、人审回传、SSE 事件
后台与定时任务后台任务唯一索引与入队去重、单消费者与 2 分钟巡检恢复、五类任务;定时任务字段、Interval/cron 排期、四个执行器
收件箱与通知通知模型与级别/类别常量、按 CategoryKey 聚合与合并动作、端点清单、状态与删除语义、前端行为

它解决什么问题

现状Hetu 的处理方式
笔记、聊天记录、代码改动分散在不同工具三者写同一份数据库;检索、图谱、记忆、Wiki 都建在这份数据上
AI 只能给建议,落地要人工复制Code 会话直接在仓库里工作:独立工作树、逐行 Diff、检查点回滚、Git 提交与 PR
长会话上下文爆炸、成本不可控压缩管道 + 用量统计(输入/压缩后/输出/缓存、延迟、按模型与来源分布)
担心数据与密钥外流无账号无遥测;Key 用 DataProtection 加密;请求只发往你配置的供应商