【交叉评测】对项目 Yorimi 的评测反馈 #4

Closed
opened 2026-07-23 13:15:27 +08:00 by Michael · 1 comment

1. 项目理解

我理解该项目主要面向 ACGN 用户、VTuber 社区、独立游戏 IP 创作者以及需要学习/日常陪伴的年轻用户。Yorimi 想解决的问题是:给虚拟角色赋予"存在感"——不仅是在线聊天,而是通过长期记忆、情感反馈、语音交互以及 3D 桌面实体设备,让虚拟角色真正"陪伴"在用户身边。

2. 项目优点

  • 产品定位清晰,提出了"AI character presence layer"这一创新概念,区别于普通聊天机器人
  • 已经有可运行的 Web 原型和 3D 硬件验证,Demo 已上线 Vercel
  • 团队展现了较强的产品视野,考虑了 Creator Studio 等创作者经济方向
  • 获得 UCWS 2026 Top 20 Finalist 的先前认可,说明产品方向有竞争力
  • 双语 README 展示了国际化意识

3. 当前不足

  • README 中产品功能描述较多,但缺少具体的技术架构说明和技术栈选型理由
  • 3D 桌面设备目前仅为 proof 阶段,未说明从原型到量产的路径
  • "长期记忆"功能的具体实现方式(向量数据库、存储方案等)未明确
  • 缺少竞品分析,未说明与 Character.AI、Replika 等已有产品的差异化细节
  • 未提及数据隐私和用户记忆数据的处理方式
  • 评测标准中提到的"early payment signal"缺少对应的商业模式说明

4. 建议

  • 补充技术架构文档,说明 AI 模型选型、记忆存储方案、3D 渲染技术栈
  • 增加与主流竞品的对比表格,清晰展示差异化优势
  • 补充用户隐私和数据安全方案,特别是记忆数据的处理
  • 明确 Wave 2 的具体交付物和里程碑,增加可执行性
  • 建议在 Demo 中加入更多真实使用场景的录屏或 GIF,帮助评审快速理解产品
## 1. 项目理解 我理解该项目主要面向 ACGN 用户、VTuber 社区、独立游戏 IP 创作者以及需要学习/日常陪伴的年轻用户。Yorimi 想解决的问题是:给虚拟角色赋予"存在感"——不仅是在线聊天,而是通过长期记忆、情感反馈、语音交互以及 3D 桌面实体设备,让虚拟角色真正"陪伴"在用户身边。 ## 2. 项目优点 - 产品定位清晰,提出了"AI character presence layer"这一创新概念,区别于普通聊天机器人 - 已经有可运行的 Web 原型和 3D 硬件验证,Demo 已上线 Vercel - 团队展现了较强的产品视野,考虑了 Creator Studio 等创作者经济方向 - 获得 UCWS 2026 Top 20 Finalist 的先前认可,说明产品方向有竞争力 - 双语 README 展示了国际化意识 ## 3. 当前不足 - README 中产品功能描述较多,但缺少具体的技术架构说明和技术栈选型理由 - 3D 桌面设备目前仅为 proof 阶段,未说明从原型到量产的路径 - "长期记忆"功能的具体实现方式(向量数据库、存储方案等)未明确 - 缺少竞品分析,未说明与 Character.AI、Replika 等已有产品的差异化细节 - 未提及数据隐私和用户记忆数据的处理方式 - 评测标准中提到的"early payment signal"缺少对应的商业模式说明 ## 4. 建议 - 补充技术架构文档,说明 AI 模型选型、记忆存储方案、3D 渲染技术栈 - 增加与主流竞品的对比表格,清晰展示差异化优势 - 补充用户隐私和数据安全方案,特别是记忆数据的处理 - 明确 Wave 2 的具体交付物和里程碑,增加可执行性 - 建议在 Demo 中加入更多真实使用场景的录屏或 GIF,帮助评审快速理解产品
Owner

Wave 3 整改回执(2026-08-04)

Michael 你好,感谢对 Yorimi 的具体评测。我们已将 #4 的建议纳入本轮整改。本回执以当前 main 的 3f604d1 为基线;下文“已完成”仅代表仓库已有代码、文档或测试证据,不代表长期产品假设已经验证。

1. 技术架构与 Agent/Skills 证据

  • add03c6 实现了单一 orchestrating Agent、8 个有界 Runtime Skills、Skill 路由、逐项 trace、确定性质量检查、session memory 与透明 fallback。
  • 成功的 /api/chat 响应现在包含机器可读 agent_run;GET /api/skills 公开 Skill 目录、触发条件和验收项。
  • 主要实现锚点:server/http/runtimeHandlers.js、server/engines/runtime/orchestrator.js、server/engines/runtime/skillRegistry.js、server/engines/openai/client.js、server/store/sessionStore.js、api/skills.mjs。
  • 架构取舍、接口和运行方法已写入 docs/submission/s3-wave3/01_AGENT_CARD.md、02_RUNBOOK.md、03_SKILLS_CATALOG.md 和 08_ISSUE_REMEDIATION.md。

2. 记忆与隐私边界

当前实现是带 TTL、容量限制和 reset 的进程内 session memory,只支持同一服务进程内的近期目标、偏好、check-in 与对话连续性;重启后会丢失,没有账户级、跨设备、数据库或向量存储,因此不再把它描述为生产级“长期记忆”。

持久化路线已调整为治理优先:先完成数据分类、用户同意、可查看/修改/删除/导出、retention 和身份方案,再选择存储,并用跨会话召回、错误纠正与删除有效性测试验收。运行日志默认不记录对话正文,相关限制见 07_LIMITATIONS_SAFETY.md 与 08_ISSUE_REMEDIATION.md。

3. 3D 设备与量产路径

assets/hardware-demo.gif、hardware-demo.mp4 和预设状态视频只证明实体形态与 presence proof,不证明 Web Agent 实时控制、可靠性、认证、量产或订单。

后续闸门已明确为:screen/device 对照验证 → realtime bridge → BOM、可靠性、认证、维修与售后评估 → 再决定是否工程化。Wave 3 的 judged path 不依赖硬件;当前没有预售或量产承诺。

4. 竞品定位与商业假设

08_ISSUE_REMEDIATION.md 已改为按可观察能力维度定位,并只使用 Character.AI、Replika、Talkie 与 LivingAI EMO 的官方资料作有限对照,不推导市场份额、留存或“Yorimi 领先”。

“early payment signal” 已从成果表述中撤回。当前没有收入、付费率、预售订单或 Creator Studio 试点。验证顺序为:先验证 Web Agent 是否产生重复使用,再测试可选 B2C 增强;Creator tools 与小批量硬件均保持为待验证假设。

5. Wave 3 交付物和 Demo 证据

  • a51cb74 在 frontend/static/nextstep-companion.html 与 frontend/companion-experience/features/chat/ 中增加 Agent Run 可视化、固定演示入口和诚实 fallback 标识。
  • 9827221 建立完整 Wave 3 提交包、Runbook、Specs 矩阵、Demo evidence 与整改映射。
  • 73e919a 将旧 Wave 1 材料明确归档。
  • fbccd963f604d1 保存交叉评测正文及真实 Issue 链接。
  • README 顶部和 Demo 段落已明确提醒评委:Vercel 在部分网络需要可访问 Vercel 的 VPN;无法使用 VPN 时按 Runbook 本地启动。

当前已有 Web 截图、硬件 GIF/视频和固定 Demo 脚本,但尚未单独提交完整的 Wave 3 Web Agent 屏幕录像;这一缺口已在 05_DEMO_EVIDENCE.md 标注。

6. 自动化验证

当前基线已执行并通过 npm run test:all,包括 test:agents、test:wave3、test:vercel、test:mart、test:api 和 test:d。覆盖 Agent/Skills contract、路由与 guard、session/fallback、Vercel adapter、API smoke path、Demo failure paths 和前端证据标记。

npm run test:all 不包含需要 OPENAI_API_KEY 的 test:openai,因此不能据此声称 live OpenAI 输出质量或完整人工 Demo 已通过。

7. 仍未验证的边界

截至本回执,我们仍不声称已经完成:

  • live OpenAI 环境的完整验收;
  • 生产级持久化记忆及跨设备召回;
  • Web/App 与 3D 设备实时联动、认证、量产或订单;
  • Creator Studio 产品或创作者试点;
  • 用户规模、留存、付费、角色一致性统计或设备对照结论;
  • 对竞品的总体优越性。

本轮关闭表示反馈已被吸收、落实为代码/文档/测试与后续闸门,不表示以上中长期假设已经验证。再次感谢评测。

## Wave 3 整改回执(2026-08-04) Michael 你好,感谢对 Yorimi 的具体评测。我们已将 #4 的建议纳入本轮整改。本回执以当前 main 的 [3f604d1](https://www.synnovator.com/mart/Yorimi/commit/3f604d1c9fcdc7d12acd63167476d72c6d999ead) 为基线;下文“已完成”仅代表仓库已有代码、文档或测试证据,不代表长期产品假设已经验证。 ### 1. 技术架构与 Agent/Skills 证据 - [add03c6](https://www.synnovator.com/mart/Yorimi/commit/add03c60fa314c3f83779e8cdeb86f56d5b0a45e) 实现了单一 orchestrating Agent、8 个有界 Runtime Skills、Skill 路由、逐项 trace、确定性质量检查、session memory 与透明 fallback。 - 成功的 /api/chat 响应现在包含机器可读 agent_run;GET /api/skills 公开 Skill 目录、触发条件和验收项。 - 主要实现锚点:server/http/runtimeHandlers.js、server/engines/runtime/orchestrator.js、server/engines/runtime/skillRegistry.js、server/engines/openai/client.js、server/store/sessionStore.js、api/skills.mjs。 - 架构取舍、接口和运行方法已写入 docs/submission/s3-wave3/01_AGENT_CARD.md、02_RUNBOOK.md、03_SKILLS_CATALOG.md 和 08_ISSUE_REMEDIATION.md。 ### 2. 记忆与隐私边界 当前实现是带 TTL、容量限制和 reset 的进程内 session memory,只支持同一服务进程内的近期目标、偏好、check-in 与对话连续性;重启后会丢失,没有账户级、跨设备、数据库或向量存储,因此不再把它描述为生产级“长期记忆”。 持久化路线已调整为治理优先:先完成数据分类、用户同意、可查看/修改/删除/导出、retention 和身份方案,再选择存储,并用跨会话召回、错误纠正与删除有效性测试验收。运行日志默认不记录对话正文,相关限制见 07_LIMITATIONS_SAFETY.md 与 08_ISSUE_REMEDIATION.md。 ### 3. 3D 设备与量产路径 assets/hardware-demo.gif、hardware-demo.mp4 和预设状态视频只证明实体形态与 presence proof,不证明 Web Agent 实时控制、可靠性、认证、量产或订单。 后续闸门已明确为:screen/device 对照验证 → realtime bridge → BOM、可靠性、认证、维修与售后评估 → 再决定是否工程化。Wave 3 的 judged path 不依赖硬件;当前没有预售或量产承诺。 ### 4. 竞品定位与商业假设 08_ISSUE_REMEDIATION.md 已改为按可观察能力维度定位,并只使用 Character.AI、Replika、Talkie 与 LivingAI EMO 的官方资料作有限对照,不推导市场份额、留存或“Yorimi 领先”。 “early payment signal” 已从成果表述中撤回。当前没有收入、付费率、预售订单或 Creator Studio 试点。验证顺序为:先验证 Web Agent 是否产生重复使用,再测试可选 B2C 增强;Creator tools 与小批量硬件均保持为待验证假设。 ### 5. Wave 3 交付物和 Demo 证据 - [a51cb74](https://www.synnovator.com/mart/Yorimi/commit/a51cb74b65d0a8f3ae8ebc11887206ae0410ea09) 在 frontend/static/nextstep-companion.html 与 frontend/companion-experience/features/chat/ 中增加 Agent Run 可视化、固定演示入口和诚实 fallback 标识。 - [9827221](https://www.synnovator.com/mart/Yorimi/commit/98272217d7379ff10a921e516259f44263060323) 建立完整 Wave 3 提交包、Runbook、Specs 矩阵、Demo evidence 与整改映射。 - [73e919a](https://www.synnovator.com/mart/Yorimi/commit/73e919a6d26d924ce0b4e946241790fa0ad2d24e) 将旧 Wave 1 材料明确归档。 - [fbccd96](https://www.synnovator.com/mart/Yorimi/commit/fbccd9631283fa615e8bfa99c54cdb54abd76768) 与 [3f604d1](https://www.synnovator.com/mart/Yorimi/commit/3f604d1c9fcdc7d12acd63167476d72c6d999ead) 保存交叉评测正文及真实 Issue 链接。 - README 顶部和 Demo 段落已明确提醒评委:Vercel 在部分网络需要可访问 Vercel 的 VPN;无法使用 VPN 时按 Runbook 本地启动。 当前已有 Web 截图、硬件 GIF/视频和固定 Demo 脚本,但尚未单独提交完整的 Wave 3 Web Agent 屏幕录像;这一缺口已在 05_DEMO_EVIDENCE.md 标注。 ### 6. 自动化验证 当前基线已执行并通过 npm run test:all,包括 test:agents、test:wave3、test:vercel、test:mart、test:api 和 test:d。覆盖 Agent/Skills contract、路由与 guard、session/fallback、Vercel adapter、API smoke path、Demo failure paths 和前端证据标记。 npm run test:all 不包含需要 OPENAI_API_KEY 的 test:openai,因此不能据此声称 live OpenAI 输出质量或完整人工 Demo 已通过。 ### 7. 仍未验证的边界 截至本回执,我们仍不声称已经完成: - live OpenAI 环境的完整验收; - 生产级持久化记忆及跨设备召回; - Web/App 与 3D 设备实时联动、认证、量产或订单; - Creator Studio 产品或创作者试点; - 用户规模、留存、付费、角色一致性统计或设备对照结论; - 对竞品的总体优越性。 本轮关闭表示反馈已被吸收、落实为代码/文档/测试与后续闸门,不表示以上中长期假设已经验证。再次感谢评测。
mart closed this issue 2026-08-04 02:32:55 +08:00
Sign in to join this conversation.
No labels
No milestone
No project
No assignees
2 participants
Notifications
Due date
The due date is invalid or out of range. Please use the format "yyyy-mm-dd".

No due date set.

Dependencies

No dependencies set.

Reference
mart/Yorimi#4
No description provided.