【S3W3 交叉评测】潜审 AuditAgent:工程闭环、交付证据与可复现性建议 #4
Loading…
Add table
Add a link
Reference in a new issue
No description provided.
Delete branch "%!s()"
Deleting a branch is permanent. Although the deleted branch may continue to exist for a short time before it actually gets removed, it CANNOT be undone in most cases. Continue?
项目理解
我理解“潜审 AuditAgent”希望把审计人员现有的工作底稿包和可选账套作为输入,通过 Agent、确定性 Tool 和人工门禁协作,覆盖底稿版式理解、语义层合成、审计调整、大额科目确认、五类盘点待办、附注生成以及修正后底稿导出。
项目并不是让大模型直接“做审计结论”,而是让模型承担理解、编排和草拟,让金额计算、勾稽校验、状态转换由确定性工具完成,最终签认保留给审计人员。
项目亮点
-调整单、盘点待办、附注章节和归档门禁均采用状态机设计,有利于避免模型绕过业务流程直接产生最终交付物。
-对模型调用成本、Prompt 版本、降级路径、审计日志和评测集已有较系统的规划,体现了从 Demo 向工程系统演进的意识。
综合评价
当前最需要补强的不是继续扩展设计范围,而是压缩评审入口、修复文档引用、展示真实黄金样例和量化运行证据。只要能够证明底稿写回、金额勾稽和人工门禁在真实样例中稳定成立,项目可信度会明显提升。
感谢评审。对项目目标与责任边界的理解是准确的:潜审并非让大模型直接作出审计结论,而是由 Agent 负责理解、编排与草拟,由确定性 Tool 完成金额计算、勾稽与状态转换,最终签认保留给审计人员。
关于已实现能力与验证入口
底稿版式理解、语义层合成、调整审核、大额确认、五类盘点、附注与修正底稿导出等主路径,以当前代码(app/agents/、app/tools/、FastAPI 路由、React 前端)、docs/CONTRACTS.md、仓库测试与夹具,以及公开 Demo / Windows 试用版为准:
https://www.divesee.com/divemind/
领域模型、状态机门禁、Evidence Ref、LLM 不做算术、人工签认不可替代等原则,已体现在实现与测试中,而非仅停留在设计叙述。
关于评审导航与文档基线
公开材料同时包含产品叙事与工程细节。W3 快速评审建议优先走试用版 3 分钟主路径;实现约束与接口基线以 docs/CONTRACTS.md 与代码为准。如评测需要一页式导航(价值、演示步骤、能力清单、启动与测试入口),我们可按评审口径另行提供。
关于复现与量化证据
仓库已包含脱敏 Excel fixture、自动化测试与冒烟脚本,覆盖账套解析、调整、盘点、OCR、底稿与交付物等模块。黄金样例链路与测试摘要(通过数、勾稽/OCR/写回结果)可按评审需要整理输出;完整作业体验建议直接试用 Windows 版验证。
关于工程结构与 Agent 差异
各专业 Agent 基于统一 ReAct 基座,差异主要体现在 Prompt、可用 Tool 集与业务门禁上;协作过程通过模型调用、工具动作与观察结果入库留痕。安装与打包方面,产品侧以试用版分发为主路径;源码安装以仓库可运行状态为准,相关打包清单可按需要复核。
综合评价中对「确定性计算 + 证据溯源 + 人工责任边界」的判断,与我们的产品原则一致。欢迎基于试用版具体操作路径继续反馈。