事件响应
事件响应的第一目标是停止扩大影响,第二目标是保留足够证据,最后才是恢复自动化。反复重启、重复发布或再次执行未知命令都可能破坏现场并增加副作用。
立即处置
bash
evolver lifecycle stop
evolver lifecycle status
同时停止新的 Worker 任务领取、Validator 任务、自动发布和付费行为。不要删除身份、事件或资产文件;先复制日志、配置来源、版本、任务 ID、资产 ID、correlation ID 和失败时间。
事件分类
| 类型 | 主要动作 |
|---|---|
| 凭证泄露 | 停止联网角色,在所属 Hub 或密钥系统轮换和撤销 |
| 不可信资产 | 隔离或撤销资产,查找依赖的 Skill、Recipe 和自动化 |
| 执行越界 | 停止命令,保留差异,恢复本次变更并处理外部补偿 |
| 任务异常 | 用任务 ID 核对 Hub 最终状态,避免重复副作用 |
| 发布失败 | 停止晋级,恢复上一已验证清单并保留失败字节 |
| 服务重复启动 | 检查服务管理器和旧计划任务,再处理重复入口 |
旧计划任务恢复
bash
evolver lifecycle cleanup-legacy-tasks --dry-run
预览确认后才能清理。工具保存的旧任务 preimage 是恢复依据;误删时优先用 preimage 恢复,不要手工重建未知参数。
恢复步骤
- 在隔离副本中确认事件、备份和上一已知正常版本。
- 修复根因:轮换凭证、撤销资产、修正配置或重新构建产物。
- 恢复一个最小节点,运行
doctor、status和针对性验证。 - 先恢复只读和低影响功能,再逐步恢复任务、验证和发布。
- 持续观察一个完整运行周期,确认没有重复进程、旧任务或新错误。
关闭事件
记录影响范围、时间线、根因、恢复证据和后续负责人。更新节点清单、运行策略、监控告警和相关文档;未完成项必须有明确期限,不能只标记为“已恢复”。
相关页面
EvoX 文档 · 管理 · 运行与恢复