Auraxis Logo Auraxis Agent
v3.0.0

重点更新:Chat / Work / Code 三模式 · 工具 63 → 71 · 文档生成与云连接器 · Eywa 溯源记忆

MIT 开源 · v3.0.0 · 个人开发

Auraxis Agent
桌面端编程助手

Auraxis Agent 是一个基于 Electron 的桌面端编程助手,个人开发、MIT 开源。它提供 Chat / Work / Code 三模式、统一的 ReAct 步进引擎、71 个内置工具、多 Agent 调度、文档生成与云连接器,以及原生沙箱隔离。

Auraxis Agent 桌面端界面截图
Auraxis Agent — 桌面端界面预览
Auraxis Agent 桌面端界面预览

界面截图来自项目 README,实际效果以最新版本为准。

Features

核心能力

Auraxis Agent 把聊天与 Agent 执行收敛到同一套 ReAct 步进引擎,工具、调度与沙箱都在本地运行。

统一 ReAct 步进引擎

聊天与 Agent 共用 step-engine 单一步进循环,停止策略 / 上下文压缩 / 重试均为策略钩子;业务迭代上限 200 次,安全硬上限 500 次,API 失败 3 次指数退避重试。

多智能体调度器

优先级队列(high/normal/low)、默认并发 3、状态机实时广播;三级偏差检测(L1 工具失败 / L2 连续停滞 / L3 Replan 重规划)与 5 分钟计划审批流。

Code Mode

RunCode 将 TypeScript 程序放入 worker 线程执行,每个 tools.Name() 子调用回穿完整权限管线;并发安全工具最多 8 路重叠、变异工具串行、硬超时可强杀。

三模态权限看门狗

ask(默认)/ plan(计划审批)/ auto(全自动)三种审批策略;规则作用域 once/session/always;只读工具(Read/Grep/Glob)自动放行,危险调用必经拦截审查。

原生沙箱

Windows restricted token / AppContainer、Linux、macOS 四后端命令级隔离,另加 Git worktree 沙箱(.auraxis-sandbox/task-<id>)为并发 Agent 提供隔离分支。

持久化项目记忆

Eywa 溯源记忆(M1–M4):证据先于信念、不可变证据、规则信号与硬锚点校验,零 LLM 确定性读取路径;会话统一 append-only JSONL 事件日志 + SQLite 投影缓存 + FTS5 全文搜索。

MCP + 插件系统

MCP 客户端(JSON-RPC over stdio);渲染层插件提供 commands/tools/hooks/ui 四类扩展点,载入前扫描危险模式并需要用户确认。

DeepSeek 官方深度能力

默认 DeepSeek(内置 deepseek-v4-flash / v4-pro),支持 reasoning effort、strict tools、FIM 补全、计划 JSON 模式与最大 384K 输出;同时兼容 OpenAI / Anthropic 消息格式。

TS & Python 双 SDK

TypeScript SDK(TCP JSON-RPC)与 Python SDK,另有 headless CLI(--run / --sdk / --acp / --plugin)与 ACP 协议支持,可用于自动化集成。

Chat / Work / Code 三模式

三种产品形态共用同一套 ReAct 步进引擎,模式状态互不污染:Chat 会话时间线、Work 文档协作(代码只读硬边界)、Code Mode worker 线程工具编排。

文档生成与云连接器

ReadDocument / WriteDocument 读写 Word、Excel、PPT、PDF(CJK 字体自动嵌入);Slack / Google Drive / Notion 连接器令牌经 safeStorage 加密保存。

本地账户与分层设置

本地优先账户(scrypt 密码哈希)、分层 Instructions 面板、连接器 / MCP / 插件 / 权限档案管理,以及内嵌真实测试覆盖率报告。

界面与工程细节:终端抽屉 · PTY/SSH 会话 · 后台与定时任务 · 图片输入 · 撤销快照 · 冲突检测 · 中英双语界面 · 深浅主题(Windows 11 Acrylic)· 可选遥测

Demo

ReAct 循环演示

一段真实录屏,展示从用户输入到 <FINAL_ANSWER> 的 ReAct 循环:统一引擎驱动,权限看门狗把关,Code Mode 编排工具。

真实录屏演示
Tools

内置工具矩阵

智能体在每一步 ReAct 循环中,在权限约束下调用这些工具。

危险工具(需审批) 安全工具(静默放行)
工具定义与桌面端 electron/tool-defs.ts 保持同步。
Security

安全模型:权限与沙箱

每次危险调用都按固定顺序经过权限模式、沙箱门、审批与执行;路径边界、read-before-write、撤销快照与冲突检测作为兜底,覆盖工具调用的全生命周期。

Ask · 询问模式

默认模式。安全与效率的最佳平衡。

  • 只读工具(Read / Grep / Glob)自动放行
  • 危险工具弹窗确认,逐次可见
  • 规则作用域 once / session / always

Plan · 计划审批

先出计划,再动手。适合大型重构。

  • LLM 生成结构化任务计划交用户审批
  • 计划获批准后仅执行已批准步骤;计划被拒绝则回退 Ask
  • 审批等待 5 分钟超时,自动回退 Ask

Auto · 全自动

无人值守的自动化执行。

  • 所有工具自动批准,无弹窗打断
  • 工作区卫生检查(扩展名 / read-before-write / URL)仍然生效
  • 适合 CI 流水线与长时间后台任务

原生沙箱,四后端隔离

命令级隔离 + Git worktree 分支级隔离,并发 Agent 之间互不污染工作区。

Windows Restricted Token / AppContainer
Linux 隔离后端
macOS 隔离后端
Git Worktree 沙箱(.auraxis-sandbox/task-<id>)
沙箱权限档位
read(只读)/ workspace-write(工作区写入,默认)/ full(完全访问)
内置权限档案
标准(工作区写入 + 逐次确认)/ 只读(read + 逐次确认)/ 沙箱(工作区写入、网络拒绝、auto);另有 ask / auto / full / readonly 四个运行时预设

所有工具调用统一经过「权限模式 → 沙箱门 → 审批 → 执行」管线,并受路径边界、read-before-write、撤销快照与冲突检测约束。

Architecture

双进程架构

Auraxis Agent 的内部结构:主进程负责工具执行与调度,渲染进程负责界面,二者通过 IPC 通信。

渲染进程 (Renderer / React 18)
  • Ant Design 5 UI(深色 / 浅色 / 跟随系统)
  • 18 个 Zustand Stores(会话以主进程为权威)
  • Markdown + mermaid + KaTeX 渲染
  • 动态插件管理器(载入前安全审计)
IPC 双向传输
Context Bridge
domain:action 协议
主进程 (Main / Node.js Env)
  • 71 个工具执行器 + step-engine / agent-loop
  • 多智能体调度器与三级偏差检测
  • 原生沙箱(四后端)+ Worktree 隔离
  • 统一 JSONL 事件日志 + FTS5 全文搜索
Research & Systems

技术内核 · 论文驱动开发

Auraxis 以 11 篇论文的核心思想驱动工程落地:7 个研究模块 + 4 项缓存对齐技术,全部为原创客户端实现。

11 论文
7 研究模块
4 缓存技术

11 项实现均为原创代码:借鉴论文算法思想,未复制论文代码;缓存技术为 DeepSeek 官方前缀缓存的客户端适配。

研究驱动模块

01–07
01

Eywa · 溯源记忆

已落地

Eywa: Provenance-Grounded Long-Term Memory for AI Agents

证据先于信念:不可变证据、规则信号与硬锚点校验,零 LLM 确定性读取路径,支持信念审计与擦除。

MemoryEvidence
02

MAP-Graph · 共享记忆授权

已落地

MAP-Graph: Provenance-Aware Shared Memory for Multi-Agent Workflows

多智能体共享记忆的授权、来源信任与风险门控:高风险 Write / Edit / Bash 需要更高证据标准。

AuthorizationTrust
03

AGORA · 步级压缩

已落地

AGORA: Adapter-Grounded Observation-Action Retention for Inference-Free Prompt Compression in LLM Agents

免推理的整步保留 / 丢弃,绝不把工具调用与结果拆开,保护 Agent 的动作语法。

CompressionSteps
04

SWE-Touch · 漂移检测

已落地

SWE-Touch: Benchmarking Coding Agents When Users Touch the Code

用户或外部进程触碰代码后,下一轮迭代前检测工作区漂移,并定向验证受影响区域。

DriftVerify
05

Oversight · 审批疲劳防护

已落地

Oversight Has a Capacity: Calibrating Agent Guards to a Subjective, Fatiguing Human

把“是否升级给人审”当作资源分配问题:20 次决策滑动窗口 + 疲劳分数,输出 escalate / auto / balanced 建议。

FatigueApproval
06

AutoTool · 工具惯性图

已落地

AutoTool: Efficient Tool Selection for Large Language Model Agents

从历史工具轨迹构建有向图并预测下一个工具,观测层 + 预测层,可降低约 30% 推理成本。

InertiaPrediction
07

Verifier-as-Gatekeeper · 技能准入

已落地

When Self-Evolution Backfires: Pre-Commit Gating against Skill Contamination in LLM Agents

技能入库前做结构、行为与语义三重校验与边际增益子集选择,阻止不可逆的技能污染。

SkillGate

缓存对齐套件

STEP 01–04
STEP 01

RadixAttention · 规范历史重放

SGLang: Efficient Execution of Structured Language Model Programs (RadixAttention)

每轮把实际发送的完整消息数组写入 llm_context_v1,下一轮回放相同前缀,保持字节级稳定。

ReplayPrefix
https://arxiv.org/abs/2312.07104
STEP 02

Prompt Cache · 稳定块组织

Prompt Cache: Modular Attention Reuse for Low-Latency Inference

系统提示、工具定义、AGENTS.md 等静态块原位替换;升级或切换项目时才重新组装。

StableBlocks
https://arxiv.org/abs/2311.04934
STEP 03

Cache-Aware · 动态内容尾置

Cache-Aware Prompt Compression: A Two-Tier Cost Model for LLM API Caching

跨会话记忆不再前插到头部,而是作为独立字段放到当前用户消息之前或快照尾部,避免破坏前缀缓存。

TailDynamic
https://arxiv.org/abs/2607.15516
STEP 04

Byte-Exact · 字节精确去重

Byte-Exact Deduplication in Retrieval-Augmented Generation

回放时若新记忆块与快照末尾字节相同则跳过追加,防止同一检索内容逐轮累积。

DedupBytes
https://arxiv.org/abs/2605.09611
Ecosystem

扩展与集成

Auraxis Agent 提供 MCP 协议、CLI、SDK 与插件机制,方便脚本和外部程序接入。

Headless CLI

npm run cli -- --run "任务" 直接跑完整 ReAct 循环,模型、权限、沙箱与 JSON 输出均可配置。

npm run cli -- --run "任务"

TypeScript SDK

packages/auraxis-sdk 通过 TCP JSON-RPC 与桌面端通信,可嵌入自己的工具链。

packages/auraxis-sdk

Python SDK

python/auraxis_sdk 提供同构 API,Python 自动化脚本可直接驱动会话与工具。

python/auraxis_sdk

插件系统

commands / tools / hooks / ui 四类扩展点,载入前做危险模式扫描与能力确认。

commands / tools / hooks / ui
Developers

本地开发

Auraxis Agent 的源码在 GitHub 上,主进程与渲染进程均为 TypeScript。下面的命令可以克隆项目并在本地启动开发。

Vitest 覆盖率:行/语句 85.42% · 分支 79.08% · 函数 86.63%(门槛 80 / 70 / 80)
生产环境启用严格 CSP,主进程与渲染进程隔离
237 个测试文件 · 1740 个用例 · 15 条 Playwright E2E 链路
快速克隆并启动开发 TypeScript / Vite

// 1. 克隆底层核心仓库

git clone https://github.com/yth1120/Auraxis-Agent

// 2. 创建本地开发环境变量配置

cp .env.example .env

// 3. 安装依赖并启动 Electron 联动调试开发

npm install npm run electron:dev
Download

下载 Auraxis Agent

v3.0.0 · Electron 43 · MIT 开源。安装包托管在 GitHub Releases,点击下方按钮即可下载。

当前稳定版本

加载中...

系统要求

  • Windows 10+ (x64) · macOS 12+ · Linux (x64)
  • 内置 Node 24 运行时,无需额外安装
  • Shell 工具建议使用 Git Bash 或 PowerShell

v3.0.0 更新内容

  • Chat / Work / Code 三模式:统一 ReAct 引擎,模式状态互不污染,Work 文档协作 + Code Mode 工具编排
  • 工具 63 → 71:新增 Word / Excel / PPT / PDF 文档读写与 Slack / Google Drive / Notion 云连接器
  • Eywa 溯源记忆(M1–M4)与 MAP-Graph 共享记忆授权:证据先于信念,零 LLM 确定性读取路径
  • DeepSeek 官方深度能力:reasoning effort / strict tools / FIM / 最大 384K 输出 / 流式缓存命中显示
  • 本地账户系统、分层 Instructions 面板、设置面板重建与 Windows 11 Acrylic 侧边栏透明度
  • 237 个测试文件 · 1,740 个用例 · 15/15 Playwright E2E · 覆盖率 85.42% 行 / 79.08% 分支 / 86.63% 函数

下载遇到问题?前往 GitHub Releases 获取全部安装包(含 Apple Silicon arm64)。

FAQ

常见问题

关于模型、权限、沙箱与数据的一些说明。

需要 API Key 吗?支持哪些模型?

需要。Auraxis Agent 默认使用 DeepSeek API(内置 deepseek-v4-flash / v4-pro),同时兼容 OpenAI 与 Anthropic 消息格式;也可以在设置中添加自定义模型,或通过环境变量配置。

与 IDE 插件或纯 CLI 工具有什么区别?

Auraxis Agent 是独立的桌面客户端,把聊天与多 Agent 收敛到同一套可审计的 ReAct 引擎,工具、调度、沙箱都在本地。同时它也提供 headless CLI 与 SDK,方便自动化集成。

三种权限模式应该怎么选?

默认 ask 适合日常:危险工具逐个弹窗确认;plan 适合大型重构:先审批计划,批准后仅执行已批准步骤;auto(原 afe 拼写)适合 CI 与无人值守任务:全自动放行,工具仍走统一执行管线。另有四个运行时预设:ask / auto / full / readonly,组合审批策略、沙箱档位与卫生检查。

沙箱隔离到什么程度?

命令级隔离覆盖 Windows restricted token / AppContainer、Linux 与 macOS 四类后端;文件类工具受路径边界与扩展名白名单约束;Git 仓库中的并发任务还可以进入独立 worktree 分支。

我的数据存在哪里?

全部本地。会话为 append-only JSONL 事件日志,检索走 SQLite 投影缓存与 FTS5;长期记忆升级为 Eywa 溯源记忆(证据先于信念,零 LLM 读取路径),按项目隔离;API Key 与云连接器令牌使用系统 safeStorage 加密保存。

这个项目开源吗?

是的,MIT License。源码、架构文档与两份 SDK 都在 GitHub(yth1120/Auraxis-Agent)上。

需要自己安装 Node.js 吗?

不需要。安装包内置 Node 24 运行时,开箱即用;Shell 工具建议使用 Git Bash 或 PowerShell。

这个项目成熟吗?

不成熟。这是个人开发项目,处于持续迭代阶段,可能存在缺陷或缺失功能,请谨慎用于重要工作;发现问题欢迎在 GitHub 提交 Issue。

ask/plan/auto 和只读/工作区写入/完全访问是什么关系?

它们是两层:ask/plan/auto 是审批策略,决定危险工具是否需要确认(默认 ask;afe 为历史拼写,已归一为 auto);read/workspace-write/full 是沙箱权限档位,决定 Agent 能访问项目哪些范围(默认 workspace-write)。另有四个运行时预设(ask / auto / full / readonly)与内置权限档案(标准/只读/沙箱)组合这两层。

Auraxis Agent 会上传我的数据吗?

默认不会。会话、记忆与设置都保存在本地;遥测默认关闭,只有手动开启后才会以严格白名单脱敏的方式上报。API Key 使用系统 safeStorage 加密保存。

Chat / Work / Code 三种模式有什么区别?

三种模式共用同一套 ReAct 步进引擎,但互不污染状态:Chat 是日常对话与代码问答;Work 面向文档协作,默认先澄清需求,只允许写文档与非代码文件,代码写入会被硬拒绝;Code 模式用 RunCode 在 worker 线程编排工具,适合自动化编码任务。

文档生成和云连接器需要额外配置吗?

文档工具(Word / Excel / PPT / PDF)开箱即用,无需配置。Slack / Google Drive / Notion 需要在设置 → 连接器中填入令牌,令牌使用系统 safeStorage 加密保存;对应工具会在每次调用时提示外部副作用。