界面截图来自项目 README,实际效果以最新版本为准。
核心能力
Auraxis Agent 把聊天与 Agent 执行收敛到同一套 ReAct 步进引擎,工具、调度与沙箱都在本地运行。
统一 ReAct 步进引擎
聊天与 Agent 共用 step-engine 单一步进循环,停止策略 / 上下文压缩 / 重试均为策略钩子;业务迭代上限 200 次,安全硬上限 500 次,API 失败 3 次指数退避重试。
多智能体调度器
优先级队列(high/normal/low)、默认并发 3、状态机实时广播;三级偏差检测(L1 工具失败 / L2 连续停滞 / L3 Replan 重规划)与 5 分钟计划审批流。
Code Mode
RunCode 将 TypeScript 程序放入 worker 线程执行,每个 tools.Name() 子调用回穿完整权限管线;并发安全工具最多 8 路重叠、变异工具串行、硬超时可强杀。
三模态权限看门狗
ask(默认)/ plan(计划审批)/ afe(全自动)三模式;规则作用域 once/session/always;只读工具(Read/Grep/Glob)自动放行,危险调用必经拦截审查。
原生沙箱
Windows restricted token / AppContainer、Linux、macOS 四后端命令级隔离,另加 Git worktree 沙箱(.auraxis-sandbox/task-<id>)为并发 Agent 提供隔离分支。
持久化项目记忆
LLM 驱动的对话记忆提取(user/feedback/project/reference 四类)按项目隔离;会话统一 append-only JSONL 事件日志 + SQLite 投影缓存 + FTS5 全文搜索。
界面与工程细节:终端抽屉 · PTY/SSH 会话 · 后台与定时任务 · 图片输入 · 撤销快照 · 冲突检测 · 中英双语界面 · 深浅主题(Windows 11 Acrylic)· 可选遥测
ReAct 循环演示
一段真实录屏,展示从用户输入到 <FINAL_ANSWER> 的 ReAct 循环:统一引擎驱动,权限看门狗把关,Code Mode 编排工具。
内置工具矩阵
智能体在每一步 ReAct 循环中,在权限约束下调用这些工具。
执行代码片段或 TypeScript 工具编排程序(隔离临时目录)
运行脚本化多智能体工作流(预置或内联脚本)
列出本地技能目录中可用的技能
读取指定技能的完整说明与资源
在项目目录执行 Shell 命令(默认超时 120s)
读取文件内容,返回版本哈希供写入校验
读取图片文件并供模型查看(PNG/JPG/GIF 等)
创建或覆盖文件,可携带版本号防并发覆盖
在文件中精确替换 old_string 为 new_string
单一用途文本编辑器:查看/新建/替换/插入
用正则表达式在项目文件中搜索
按 glob 模式查找文件
抓取 URL 内容并提取文本
使用 DuckDuckGo 搜索网络
创建并管理结构化任务清单跟踪进度
启动子智能体自主处理复杂多步任务
计划受阻时生成新的子计划继续执行
按 cron 语法创建定时或一次性任务
按 ID 取消已调度的 cron 任务
列出所有活动的 cron 任务
创建会话级定时跟进(延时/定点/周期)
按 ID 取消已调度的跟进任务
列出会话内已调度的跟进任务
读取后台任务或子代理的累计输出
按 ID 停止运行中的工具或子代理
进入规划模式,设计方案供用户审批
用户批准计划后退出规划模式开始实施
读取或修改 Jupyter 笔记本(.ipynb)单元格
创建隔离的 Git worktree 沙箱重定向后续调用
代码智能:定义/引用/实现/hover/诊断
运行构建/测试/类型检查/静态检查验证
删除项目内的文件或目录(可递归)
暂存全部改动并创建 git 提交
搜索历史会话记录回忆过往决策
读取溢出到磁盘的超大工具输出
向用户提出澄清问题并等待回答
管理持久交互式终端会话(create/write/read/close 等)
为当前任务打开持久终端会话
列出当前任务的终端会话
读取终端会话自上次读取以来的新输出
向终端会话发送输入(可回车提交)
向终端会话发送控制信号(SIGINT 等)
关闭终端会话并释放 shell 进程
检查运行时:可用工具、插件、技能(只读)
创建或覆盖可复用的技能说明(Markdown)
列出活动智能体与子代理及其状态
向后端子代理发送后续指令
按 ID 中断运行中的智能体或子代理
向启动你的代理发送进度报告
读取当前持久目标的文本、阶段与轮次
为当前运行创建持久目标
更新目标修订:编辑/暂停/恢复/完成/阻塞
动态挂载插件,注册新工具供模型调用
移除已挂载插件并注销其全部工具
以全新子代理迭代执行目标(Ralph 循环)
执行 PowerShell 命令(Windows 原生)
在会话事件流中搜索匹配文本或工具名
按序号读取会话中的原始事件(含前后邻接)
读取会话谱系:父会话、分支、事件统计
列出后台 Shell 任务与运行中的代理
列出运行时已知的全部后台任务
按 ID 读取后台任务累计输出(不阻塞)
按 ID 停止运行中的后台任务
安全模型:权限与沙箱
每次危险调用都按固定顺序经过权限模式、沙箱门、审批与执行;路径边界、read-before-write、撤销快照与冲突检测作为兜底,覆盖工具调用的全生命周期。
Ask · 询问模式
默认模式。安全与效率的最佳平衡。
- 只读工具(Read / Grep / Glob)自动放行
- 危险工具弹窗确认,逐次可见
- 规则作用域 once / session / always
Plan · 计划审批
先出计划,再动手。适合大型重构。
- LLM 生成结构化任务计划交用户审批
- 计划获批准后仅执行已批准步骤;计划被拒绝则回退 Ask
- 审批等待 5 分钟超时,自动回退 Ask
AFE · 全自动
无人值守的自动化执行。
- 所有工具自动批准,无弹窗打断
- 工具仍经过沙箱与路径、扩展名、URL 检查;无头流程按惯例豁免 read-before-write
- 适合 CI 流水线与长时间后台任务
原生沙箱,四后端隔离
命令级隔离 + Git worktree 分支级隔离,并发 Agent 之间互不污染工作区。
所有工具调用统一经过「权限模式 → 沙箱门 → 审批 → 执行」管线,并受路径边界、read-before-write、撤销快照与冲突检测约束。
双进程架构
Auraxis Agent 的内部结构:主进程负责工具执行与调度,渲染进程负责界面,二者通过 IPC 通信。
- Ant Design 5 UI(深色 / 浅色 / 跟随系统)
- 17 个 Zustand Stores(会话以主进程为权威)
- Markdown + mermaid + KaTeX 渲染
- 动态插件管理器(载入前安全审计)
- 63 个工具执行器 + step-engine / agent-loop
- 多智能体调度器与三级偏差检测
- 原生沙箱(四后端)+ Worktree 隔离
- 统一 JSONL 事件日志 + FTS5 全文搜索
扩展与集成
Auraxis Agent 提供 MCP 协议、CLI、SDK 与插件机制,方便脚本和外部程序接入。
Headless CLI
npm run cli -- --run "任务" 直接跑完整 ReAct 循环,模型、权限、沙箱与 JSON 输出均可配置。
npm run cli -- --run "任务" TypeScript SDK
packages/auraxis-sdk 通过 TCP JSON-RPC 与桌面端通信,可嵌入自己的工具链。
packages/auraxis-sdk Python SDK
python/auraxis_sdk 提供同构 API,Python 自动化脚本可直接驱动会话与工具。
python/auraxis_sdk 插件系统
commands / tools / hooks / ui 四类扩展点,载入前做危险模式扫描与能力确认。
commands / tools / hooks / ui 本地开发
Auraxis Agent 的源码在 GitHub 上,主进程与渲染进程均为 TypeScript。下面的命令可以克隆项目并在本地启动开发。
// 1. 克隆底层核心仓库
// 2. 创建本地开发环境变量配置
// 3. 安装依赖并启动 Electron 联动调试开发
下载 Auraxis Agent
v2.0.0 · Electron 43 · MIT 开源。安装包托管在 GitHub Releases,点击下方按钮即可下载。
当前稳定版本
加载中...
系统要求
- Windows 10+ (x64) · macOS 12+ · Linux (x64)
- 内置 Node 24 运行时,无需额外安装
- Shell 工具建议使用 Git Bash 或 PowerShell
v2.0.0 更新内容
- › 稳定 Windows CI 偶发超时用例,加大集成测试超时
- › 新增侧边栏透明度(Windows 11 原生 Acrylic)与设置面板内嵌真实测试覆盖率报告
- › 修复 shell 执行器吞掉 stdin EPIPE 异步错误,消除 Linux CI 未处理异常
- › 终端测试注入可控 PTY,规避 CI 真实 shell 依赖
下载遇到问题?前往 GitHub Releases 获取全部安装包(含 Apple Silicon arm64)。
常见问题
关于模型、权限、沙箱与数据的一些说明。
需要 API Key 吗?支持哪些模型?
需要。Auraxis Agent 默认使用 DeepSeek API(内置 deepseek-v4-flash / v4-pro),同时兼容 OpenAI 与 Anthropic 消息格式;也可以在设置中添加自定义模型,或通过环境变量配置。
与 IDE 插件或纯 CLI 工具有什么区别?
Auraxis Agent 是独立的桌面客户端,把聊天与多 Agent 收敛到同一套可审计的 ReAct 引擎,工具、调度、沙箱都在本地。同时它也提供 headless CLI 与 SDK,方便自动化集成。
三种权限模式应该怎么选?
默认 ask 适合日常:危险工具逐个弹窗确认;plan 适合大型重构:先审批计划,批准后仅执行已批准步骤;afe 适合 CI 与无人值守任务:全自动放行,工具仍走统一执行管线。
沙箱隔离到什么程度?
命令级隔离覆盖 Windows restricted token / AppContainer、Linux 与 macOS 四类后端;文件类工具受路径边界与扩展名白名单约束;Git 仓库中的并发任务还可以进入独立 worktree 分支。
我的数据存在哪里?
全部本地。会话为 append-only JSONL 事件日志,检索走 SQLite 投影缓存与 FTS5;长期记忆按项目隔离;API Key 使用系统 safeStorage 加密保存。
这个项目开源吗?
是的,MIT License。源码、架构文档与两份 SDK 都在 GitHub(yth1120/Auraxis-Agent)上。
需要自己安装 Node.js 吗?
不需要。安装包内置 Node 24 运行时,开箱即用;Shell 工具建议使用 Git Bash 或 PowerShell。
这个项目成熟吗?
不成熟。这是个人开发项目,处于持续迭代阶段,可能存在缺陷或缺失功能,请谨慎用于重要工作;发现问题欢迎在 GitHub 提交 Issue。
ask/plan/afe 和只读/工作区写入/完全访问是什么关系?
它们是两层:ask/plan/afe 是审批模式,决定危险工具是否需要确认(默认 ask);read/workspace-write/full 是沙箱权限档位,决定 Agent 能访问项目哪些范围(默认 workspace-write)。另有内置权限档案(标准/只读/沙箱)组合这两层。
Auraxis Agent 会上传我的数据吗?
默认不会。会话、记忆与设置都保存在本地;遥测默认关闭,只有手动开启后才会以严格白名单脱敏的方式上报。API Key 使用系统 safeStorage 加密保存。