界面截图来自项目 README,实际效果以最新版本为准。
核心能力
Auraxis Agent 把聊天与 Agent 执行收敛到同一套 ReAct 步进引擎,工具、调度与沙箱都在本地运行。
统一 ReAct 步进引擎
聊天与 Agent 共用 step-engine 单一步进循环,停止策略 / 上下文压缩 / 重试均为策略钩子;业务迭代上限 200 次,安全硬上限 500 次,API 失败 3 次指数退避重试。
多智能体调度器
优先级队列(high/normal/low)、默认并发 3、状态机实时广播;三级偏差检测(L1 工具失败 / L2 连续停滞 / L3 Replan 重规划)与 5 分钟计划审批流。
Code Mode
RunCode 将 TypeScript 程序放入 worker 线程执行,每个 tools.Name() 子调用回穿完整权限管线;并发安全工具最多 8 路重叠、变异工具串行、硬超时可强杀。
三模态权限看门狗
ask(默认)/ plan(计划审批)/ auto(全自动)三种审批策略;规则作用域 once/session/always;只读工具(Read/Grep/Glob)自动放行,危险调用必经拦截审查。
原生沙箱
Windows restricted token / AppContainer、Linux、macOS 四后端命令级隔离,另加 Git worktree 沙箱(.auraxis-sandbox/task-<id>)为并发 Agent 提供隔离分支。
持久化项目记忆
Eywa 溯源记忆(M1–M4):证据先于信念、不可变证据、规则信号与硬锚点校验,零 LLM 确定性读取路径;会话统一 append-only JSONL 事件日志 + SQLite 投影缓存 + FTS5 全文搜索。
MCP + 插件系统
MCP 客户端(JSON-RPC over stdio);渲染层插件提供 commands/tools/hooks/ui 四类扩展点,载入前扫描危险模式并需要用户确认。
DeepSeek 官方深度能力
默认 DeepSeek(内置 deepseek-v4-flash / v4-pro),支持 reasoning effort、strict tools、FIM 补全、计划 JSON 模式与最大 384K 输出;同时兼容 OpenAI / Anthropic 消息格式。
TS & Python 双 SDK
TypeScript SDK(TCP JSON-RPC)与 Python SDK,另有 headless CLI(--run / --sdk / --acp / --plugin)与 ACP 协议支持,可用于自动化集成。
Chat / Work / Code 三模式
三种产品形态共用同一套 ReAct 步进引擎,模式状态互不污染:Chat 会话时间线、Work 文档协作(代码只读硬边界)、Code Mode worker 线程工具编排。
文档生成与云连接器
ReadDocument / WriteDocument 读写 Word、Excel、PPT、PDF(CJK 字体自动嵌入);Slack / Google Drive / Notion 连接器令牌经 safeStorage 加密保存。
本地账户与分层设置
本地优先账户(scrypt 密码哈希)、分层 Instructions 面板、连接器 / MCP / 插件 / 权限档案管理,以及内嵌真实测试覆盖率报告。
界面与工程细节:终端抽屉 · PTY/SSH 会话 · 后台与定时任务 · 图片输入 · 撤销快照 · 冲突检测 · 中英双语界面 · 深浅主题(Windows 11 Acrylic)· 可选遥测
ReAct 循环演示
一段真实录屏,展示从用户输入到 <FINAL_ANSWER> 的 ReAct 循环:统一引擎驱动,权限看门狗把关,Code Mode 编排工具。
内置工具矩阵
智能体在每一步 ReAct 循环中,在权限约束下调用这些工具。
执行代码片段或 TypeScript 工具编排程序(隔离临时目录)
运行脚本化多智能体工作流(预置或内联脚本)
列出本地技能目录中可用的技能
读取指定技能的完整 说明与资源
在项目目录执行 Shell 命令(默认超时 120s)
读取文件内容,返回版本哈希供写入校验
读取图片文件并供模型查看(PNG/JPG/GIF 等)
创建或覆盖文件,可携带版本号防并发覆盖
在文件中精确替换 old_string 为 new_string
单一用途文本编辑器:查看/新建/替换/插入
用正则表达式在项目文件中搜索
按 glob 模式查找文件
抓取 URL 内容并提取文本
使用 DuckDuckGo 搜索网络
创建并管理结构化任务清单跟踪进度
启动子智能体自主处理复杂多步任务
计划受阻时生成新的子计划继续执行
按 cron 语法创建定时或一次性任务
按 ID 取消已调度的 cron 任务
列出所有活动的 cron 任务
创建会话级定时跟进(延时/定点/周期)
按 ID 取消已调度的跟进任务
列出会话内已调度的跟进任务
读取后台任务或子代理的累计输出
按 ID 停止运行中的工具或子代理
进入规划模式,设计方案供用户审批
用户批准计划后退出规划模式开始实施
读取或修改 Jupyter 笔记本(.ipynb)单元格
创建隔离的 Git worktree 沙箱重定向后续调用
代码智能:定义/引用/实现/hover/诊断
运行构建/测试/类型检查/静态检查验证
删除项目内的文件或目录(可递归)
暂存全部改动并创建 git 提交
搜索历史会话记录回忆过往决策
读取溢出到磁盘的超大工具输出
向用户提出澄清问题并等待回答
管理持久交互式终端会话(create/write/read/close 等)
为当前任务打开持久终端会话
列出当前任务的终端会话
读取终端会话自上次读取以来的新输出
向终端会话发送输入(可回车提交)
向终端会话发送控制信号(SIGINT 等)
关闭终端会话并释放 shell 进程
检查运行时:可用工具、插件、技能(只读)
创建或覆盖可复用的技能说明(Markdown)
列出活动智能体与子代理及其状态
向后端子代理发送后续指令
按 ID 中断运行中的智能体或子代理
向启动你的代理发送进度报告
读取当前持久目标的文本、阶段与轮次
为当前运行创建持久目标
更新目标修订:编辑/暂停/恢复/完成/阻塞
动态挂载插件,注册新工具供模型调用
移除已挂载插件并注销其全部工具
以全新子代理迭代执行目标(Ralph 循环)
执行 PowerShell 命令(Windows 原生)
读取专业文档(.docx/.xlsx/.pptx/.pdf)并返回纯文本内容
按结构化规格创建或覆盖专业文档(Word/Excel/PPT/PDF)
列出配置的 Slack 机器人/用户可访问的频道
向 Slack 频道发送消息(外部副作用,需确认意图)
列出配置的 Google Drive 令牌可访问的文件/文件夹
按 ID 读取 Google Drive 文件(文本返回文本,其他返回 base64)
搜索 Notion 集成令牌可访问的页面/数据库
在父页面下创建 Notion 页面(外部副作用,需确认意图)
在会话事件流中搜索匹配文本或工具名
按序 号读取会话中的原始事件(含前后邻接)
读取会话谱系:父会话、分支、事件统计
列出后台 Shell 任务与运行中的代理
列出运行时已知的全部后台任务
按 ID 读取后台任务累计输出(不阻塞)
按 ID 停止运行中的后台任务
安全模型:权限与沙箱
每次危险调用都按固定顺序经过权限模式、沙箱门、审批与执行;路径边界、read-before-write、撤销快照与冲突检测作为兜底,覆盖工具调用的全生命周期。
Ask · 询问模式
默认模式。安全与效率的最佳平衡。
- 只读工具(Read / Grep / Glob)自动放行
- 危险工具弹窗确认,逐次可见
- 规则作用域 once / session / always
Plan · 计划审批
先出计划,再动手。适合大型重构。
- LLM 生成结构化任务计划交用户审批
- 计划获批准后仅执行已批准步骤;计划被拒绝则回退 Ask
- 审批等待 5 分钟超时,自动回退 Ask
Auto · 全自动
无人值守的自动化执行。
- 所有工具自动批准,无弹窗打断
- 工作区卫生检查(扩展名 / read-before-write / URL)仍然生效
- 适合 CI 流水线与长时间后台任务
原生沙箱,四后端隔离
命令级隔离 + Git worktree 分支级隔离,并发 Agent 之间互不污染工作区。
所有工具调用统一经过「权限模式 → 沙箱门 → 审批 → 执行」管线,并受路径边界、read-before-write、撤销快照与冲突检测约束。
双进程架构
Auraxis Agent 的内部结构:主进程负责工具执行与调度,渲染进程负责界面,二者通过 IPC 通信。
- Ant Design 5 UI(深色 / 浅色 / 跟随系统)
- 18 个 Zustand Stores(会话以主进程为权威)
- Markdown + mermaid + KaTeX 渲染
- 动态插件管理器(载入前安全审计)
- 71 个工具执行器 + step-engine / agent-loop
- 多智能体调度器与三级偏差检测
- 原生沙箱(四后端)+ Worktree 隔离
- 统一 JSONL 事件日志 + FTS5 全文搜索
技术内核 · 论文驱动开发
Auraxis 以 11 篇论文的核心思想驱动工程落地:7 个研究模块 + 4 项缓存对齐技术,全部为原创客户端实现。
11 项实现均为原创代码:借鉴论文算法思想,未复制论文代码;缓存技术为 DeepSeek 官方前缀缓存的客户端适配。
研究驱动模块
Eywa · 溯源记忆
已落地Eywa: Provenance-Grounded Long-Term Memory for AI Agents
证据先于信念:不可变证据、规则信号与硬锚点校验,零 LLM 确定性读取路径,支持信念审计与擦除。
MAP-Graph · 共享记忆授权
已落地MAP-Graph: Provenance-Aware Shared Memory for Multi-Agent Workflows
多智能体共享记忆的授权、来源信任与风险门控:高风险 Write / Edit / Bash 需要更高证据标准。
AGORA · 步级压缩
已落地AGORA: Adapter-Grounded Observation-Action Retention for Inference-Free Prompt Compression in LLM Agents
免推理的整步保留 / 丢弃,绝不把工具调用与结果拆开,保护 Agent 的动作语法。
SWE-Touch · 漂移检测
已落地SWE-Touch: Benchmarking Coding Agents When Users Touch the Code
用户或外部进程触碰代码后,下一轮迭代前检测工作区漂移,并定向验证受影响区域。
Oversight · 审批疲劳防护
已落地Oversight Has a Capacity: Calibrating Agent Guards to a Subjective, Fatiguing Human
把“是否升级给人审”当作资源分配问题:20 次决策滑动窗口 + 疲劳分数,输出 escalate / auto / balanced 建议。
AutoTool · 工具惯性图
已落地AutoTool: Efficient Tool Selection for Large Language Model Agents
从历史工具轨迹构建有向图并预测下一个工具,观测层 + 预测层,可降低约 30% 推理成本。
Verifier-as-Gatekeeper · 技能准入
已落地When Self-Evolution Backfires: Pre-Commit Gating against Skill Contamination in LLM Agents
技能入库前做结构、行为与语义三重校验与边际增益子集选择,阻止不可逆的技能污染。
缓存对齐套件
RadixAttention · 规范历史重放
SGLang: Efficient Execution of Structured Language Model Programs (RadixAttention)
每轮把实际发送的完整消息数组写入 llm_context_v1,下一轮回放相同前缀,保持字节级稳定。
Prompt Cache · 稳定块组织
Prompt Cache: Modular Attention Reuse for Low-Latency Inference
系统提示、工具定义、AGENTS.md 等静态块原位替换;升级或切换项目时才重新组装。
Cache-Aware · 动态内容尾置
Cache-Aware Prompt Compression: A Two-Tier Cost Model for LLM API Caching
跨会话记忆不再前插到头部,而是作为独立字段放到当前用户消息之前或快照尾部,避免破坏前缀缓存。
Byte-Exact · 字节精确去重
Byte-Exact Deduplication in Retrieval-Augmented Generation
回放时若新记忆块与快照末尾字节相同则跳过追加,防止同一检索内容逐轮累积。
扩展与集成
Auraxis Agent 提供 MCP 协议、CLI、SDK 与插件机制,方便脚本和外部程序接入。
Headless CLI
npm run cli -- --run "任务" 直接跑完整 ReAct 循环,模型、权限、沙箱与 JSON 输出均可配置。
npm run cli -- --run "任务" TypeScript SDK
packages/auraxis-sdk 通过 TCP JSON-RPC 与桌面端通信,可嵌入自己的工具链。
packages/auraxis-sdk Python SDK
python/auraxis_sdk 提供同构 API,Python 自动化脚本可直接驱动会话与工具。
python/auraxis_sdk 插件系统
commands / tools / hooks / ui 四类扩展点,载入前做危险模式扫描与能力确认。
commands / tools / hooks / ui 本地开发
Auraxis Agent 的源码在 GitHub 上,主进程与渲染进程均为 TypeScript。下面的命令可以克隆项目并在本地启动开发。
// 1. 克隆底层核心仓库
// 2. 创建本地开发环境变量配置
// 3. 安装依赖并启动 Electron 联动调试开发
下载 Auraxis Agent
v3.0.0 · Electron 43 · MIT 开源。安装包托管在 GitHub Releases,点击下方按钮即可下载。
当前稳定版本
加载中...
系统要求
- Windows 10+ (x64) · macOS 12+ · Linux (x64)
- 内置 Node 24 运行时,无需额外安装
- Shell 工具建议使用 Git Bash 或 PowerShell
v3.0.0 更新内容
- › Chat / Work / Code 三模式:统一 ReAct 引擎,模式状态互不污染,Work 文档协作 + Code Mode 工具编排
- › 工具 63 → 71:新增 Word / Excel / PPT / PDF 文档读写与 Slack / Google Drive / Notion 云连接器
- › Eywa 溯源记忆(M1–M4)与 MAP-Graph 共享记忆授权:证据先于信念,零 LLM 确定性读取路径
- › DeepSeek 官方深度能力:reasoning effort / strict tools / FIM / 最大 384K 输出 / 流式缓存命中显示
- › 本地账户系统、分层 Instructions 面板、设置面板重建与 Windows 11 Acrylic 侧边栏透明度
- › 237 个测试文件 · 1,740 个用例 · 15/15 Playwright E2E · 覆盖率 85.42% 行 / 79.08% 分支 / 86.63% 函数
下载遇到问题?前往 GitHub Releases 获取全部安装包(含 Apple Silicon arm64)。
常见问题
关于模型、权限、沙箱与数据的一些说明。
需要 API Key 吗?支持哪些模型?
需要。Auraxis Agent 默认使用 DeepSeek API(内置 deepseek-v4-flash / v4-pro),同时兼容 OpenAI 与 Anthropic 消息格式;也可以在设置中添加自定义模型,或通过环境变量配置。
与 IDE 插件或纯 CLI 工具有什么区别?
Auraxis Agent 是独立的桌面客户端,把聊天与多 Agent 收敛到同一套可审计的 ReAct 引擎,工具、调度、沙箱都在本地。同时它也提供 headless CLI 与 SDK,方便自动化集成。
三种权限模式应该怎么选?
默认 ask 适合日常:危险工具逐个弹窗确认;plan 适合大型重构:先审批计划,批准后仅执行已批准步骤;auto(原 afe 拼写)适合 CI 与无人值守任务:全自动放行,工具仍走统一执行管线。另有四个运行时预设:ask / auto / full / readonly,组合审批策略、沙箱档位与卫生检查。
沙箱隔离到什么程度?
命令级隔离覆盖 Windows restricted token / AppContainer、Linux 与 macOS 四类后端;文件类工具受路径边界与扩展名白名单约束;Git 仓库中的并发任务还可以进入独立 worktree 分支。
我的数据存在哪里?
全部本地。会话为 append-only JSONL 事件日志,检索走 SQLite 投影缓存与 FTS5;长期记忆升级为 Eywa 溯源记忆(证据先于信念,零 LLM 读取路径),按项目隔离;API Key 与云连接器令牌使用系统 safeStorage 加密保存。
这个项目开源吗?
是的,MIT License。源码、架构文档与两份 SDK 都在 GitHub(yth1120/Auraxis-Agent)上。
需要自己安装 Node.js 吗?
不需要。安装包内置 Node 24 运行时,开箱即用;Shell 工具建议使用 Git Bash 或 PowerShell。
这个项目成熟吗?
不成熟。这是个人开发项目,处于持续迭代阶段,可能存在缺陷或缺失功能,请谨慎用于重要工作;发现问题欢迎在 GitHub 提交 Issue。
ask/plan/auto 和只读/工作区写入/完全访问是什么关系?
它们是两层:ask/plan/auto 是审批策略,决定危险工具是否需要确认(默认 ask;afe 为历史拼写,已归一为 auto);read/workspace-write/full 是沙箱权限档位,决定 Agent 能访问项目哪些范围(默认 workspace-write)。另有四个运行时预设(ask / auto / full / readonly)与内置权限档案(标准/只读/沙箱)组合这两层。
Auraxis Agent 会上传我的数据吗?
默认不会。会话、记忆与设置都保存在本地;遥测默认关闭,只有手动开启后才会以严格白名单脱敏的方式上报。API Key 使用系统 safeStorage 加密保存。
Chat / Work / Code 三种模式有什么区别?
三种模式共用同一套 ReAct 步进引擎,但互不污染状态:Chat 是日常对话与代码问答;Work 面向文档协作,默认先澄清需求,只允许写文档与非代码文件,代码写入会被硬拒绝;Code 模式用 RunCode 在 worker 线程编排工具,适合自动化编码任务。
文档生成和云连接器需要额外配置吗?
文档工具(Word / Excel / PPT / PDF)开箱即用,无需配置。Slack / Google Drive / Notion 需要在设置 → 连接器中填入令牌,令牌使用系统 safeStorage 加密保存;对应工具会在每次调用时提示外部副作用。