Skip to content
Merged
Show file tree
Hide file tree
Changes from all commits
Commits
File filter

Filter by extension

Filter by extension

Conversations
Failed to load comments.
Loading
Jump to
Jump to file
Failed to load files.
Loading
Diff view
Diff view
1,590 changes: 0 additions & 1,590 deletions analyze_wechat_databases.py

This file was deleted.

610 changes: 0 additions & 610 deletions design-qa.md

This file was deleted.

80 changes: 0 additions & 80 deletions desktop/tests/acceptance-stream-proxy.test.cjs

This file was deleted.

2 changes: 1 addition & 1 deletion docs/ai-assistant-development-status.md
Original file line number Diff line number Diff line change
Expand Up @@ -109,7 +109,7 @@
| AI Elements Vue、Tailwind 4、D01~D04 | `components/ai-elements/`、`agent.css`、输入框/来源/图片组件 | 320px、大视图、主题、中文输入、Enter 补充、停止与窗口切回 |
| 发送者与被谈论者分离、同名、旧来源与图片恢复 | `agent_references.py`、`agentMarkdown.js`、`AgentAnswer.vue` | 甲谈乙、多来源、半截引用、缺图、当前回答图片集合与零视觉副作用 |
| 报告/程序统计、阅读复制、旧总结/任务/提醒 | `agent_continuous.py`、`agent_workspace.py`、`AiSidebar.vue`、`AgentCopyAction.vue` | 原文一致性、分类与结论、旧 AI 功能回归 |
| 同版本 Mac 与源码/锁文件/脚本/记录交付 | `prepare_ai_acceptance.py`、`run_ai_acceptance.py`、`launch_ai_macos_acceptance.py` | Windows 全项通过后进入 Mac 独立目录;不默认签名和公开发布 |
| 同版本 Mac 与源码/锁文件/脚本/记录交付 | `prepare_ai_acceptance.py`、`run_ai_acceptance.py`、`launch_ai_macos_acceptance.py`(脚本已从仓库删除,可从 git 历史取回) | Windows 全项通过后进入 Mac 独立目录;不默认签名和公开发布 |

## 代码检查结果

Expand Down
2 changes: 1 addition & 1 deletion docs/ai-chat-ui-validation.md
Original file line number Diff line number Diff line change
Expand Up @@ -54,4 +54,4 @@

按用户提供的 Codex 截图修正:正文、工具图标、最终回答共用左边线;工具名称与展开详情缩进 26px。相邻相同工具、会话、查询、范围和输入版本的调用合并显示,详情保留每次调用及缓存复用;失败和进行中状态仍显露。工具数量、结果数量和耗时主要放入详情,用量入口移到回答下方。过程默认保留紧凑记录,完成或滚动不再自动收起,流式更新保留手动选择。

全部前端 217 项通过(`tmp/agent-indent-tests.log`);生产构建通过(`tmp/agent-indent-build.log`)。浏览器核对浅色、深色、498px 窄窗、工具详情及来源面板;实际测量正文/图标/答案 x=260,名称/详情 x=286。预览使用示例接口,本轮未新增真实模型调用。视觉对照和修订记录见项目根目录 `design-qa.md` 的最新验收。
全部前端 217 项通过(`tmp/agent-indent-tests.log`);生产构建通过(`tmp/agent-indent-build.log`)。浏览器核对浅色、深色、498px 窄窗、工具详情及来源面板;实际测量正文/图标/答案 x=260,名称/详情 x=286。预览使用示例接口,本轮未新增真实模型调用。
2 changes: 1 addition & 1 deletion docs/ai-compaction-ui-2026-09-14.md
Original file line number Diff line number Diff line change
Expand Up @@ -22,6 +22,6 @@

- 后端 87 项相关测试通过:新增持久化/访问隔离测试、锯齿压缩、上下文恢复、历史压缩和第二轮续聊范围回归。
- 前端 89 项相关测试通过:压缩生命周期、时间线、工具失败、聊天面板和资料读取。
- 浏览器验证 440px / 320px、深浅主题、键盘收起、摘要展开、失败提示及过程折叠后的顺序。详细证据见项目根目录 design-qa.md。
- 浏览器验证 440px / 320px、深浅主题、键盘收起、摘要展开、失败提示及过程折叠后的顺序。
- 项目已重启:前端返回 HTTP 200,后端 health=healthy,新接口已注册;真实历史压缩记录返回 HTTP 200,读回已保存摘要(仅验证可用性,不复制聊天内容)。
- 未重跑用户聊天任务;未为了触发压缩而调用真实模型。新压缩完整生命周期使用确定性模型与隔离存储验证,真实应用中的下一次自然触发仍需随正常使用观察。
2 changes: 1 addition & 1 deletion docs/ai-diagnostics.md
Original file line number Diff line number Diff line change
Expand Up @@ -97,7 +97,7 @@ Agent 进度使用单条长连接:事件写入 SQLite 后通过进程内条件

新增回归覆盖并发上下文和线程池、恢复执行 ID、HTTP 本机限制/体积/白名单、INFO/DEBUG/SDK/异常栈的敏感哨兵、跨天并发写入、重复初始化、目录重建、output 切换、模型错误与重试、流式日志条数、索引回滚、前端队列/SSE、通知阶段和桌面离线兜底。

`tools/benchmark_ai_logging.py --messages 100000 --output tmp/ai-key-logging-benchmark.json` 沿用现有合成 SQLite 消息场景,比较日志关闭和开启。收敛前记录 576 条、168370 字节;当前 INFO 策略记录 1 条已提交检查点、371 字节,日志体积降低约 99.8%。本轮索引耗时不足一分钟,因此未触发第二次进度记录;更慢的任务会每分钟记录进度。这个基准直接调用读取和提交方法,不包含完整任务启停、网络模型请求、真实 GPU 推理和桌面通知,不能将 371 字节当成全部 AI 使用的体积上限。
`tools/benchmark_ai_logging.py --messages 100000 --output tmp/ai-key-logging-benchmark.json` 沿用现有合成 SQLite 消息场景,比较日志关闭和开启。收敛前记录 576 条、168370 字节;当前 INFO 策略记录 1 条已提交检查点、371 字节,日志体积降低约 99.8%。本轮索引耗时不足一分钟,因此未触发第二次进度记录;更慢的任务会每分钟记录进度。这个基准直接调用读取和提交方法,不包含完整任务启停、网络模型请求、真实 GPU 推理和桌面通知,不能将 371 字节当成全部 AI 使用的体积上限。(该基准脚本已从仓库删除,可从 git 历史取回。)

本轮日志关闭/开启的读取及事务提交耗时为 44.323 → 33.482 秒,机器负载与缓存影响明显,不能将负增幅解释为日志带来加速或承诺固定开销。结果文件独立写到指定路径,不写入生产业务日志。新增回归还验证连续一千轮正常细节不写 INFO、异常仍可见、DEBUG 仍脱敏、进度按任务/执行限频,以及其他模块共享文件 handler 时 INFO/DEBUG 不受影响。

Expand Down
2 changes: 1 addition & 1 deletion docs/ai-macos-user-acceptance.md
Original file line number Diff line number Diff line change
Expand Up @@ -9,7 +9,7 @@
- 隔离源码目录:`~/WeChatDataAnalysis-ai-check-20260908`;独立 Electron 用户目录与后端 output,未覆盖已安装应用。
- 操作方式:通过 Tailscale / SSH,在 Mac 本机用 Playwright CDP 操作实际 Electron 页面;不是 Windows 浏览器,也不是组件 fixture 页。
- 在线服务:用户已有 DeepSeek 配置,先复制到隔离后端;随后在设置页点击「从上游获取」得到 3 个模型,并测试已选择的 `deepseek-v4-flash-vision-exp`。未将密钥写入本文或验收日志。
- 可核对聊天:`tools/seed_ai_acceptance.py` 创建专用账号,3 个会话、117 条消息,包含明确的旧价、新价、改期和责任人。它只负责准备数据库;后续全部通过正常聊天、搜索及 AI 接口读取。
- 可核对聊天:`tools/seed_ai_acceptance.py` 创建专用账号,3 个会话、117 条消息,包含明确的旧价、新价、改期和责任人。它只负责准备数据库;后续全部通过正常聊天、搜索及 AI 接口读取。(该脚本已从仓库删除,可从 git 历史取回。)
- 真实数据:使用 Mac 现有已解密账号的隔离副本,仅在「妈妈」聊天最近 30 天建立本地索引,该聊天未提交给在线回答模型。登录后的实时验收仅将用户与自己的会话中本日主动发送的三条验收消息用于在线提醒判断和总结。
- 切换测试数据组时预设隔离浏览器的账号偏好并导航到 `/chat`;不将这一步计为账号切换 UI 验收。现有账号切换入口对缺少密钥的导入快照不列为可切换账号。

Expand Down
2 changes: 1 addition & 1 deletion docs/ai-model-reasoning-picker-2026-09-14.md
Original file line number Diff line number Diff line change
Expand Up @@ -19,7 +19,7 @@

前端累计 326 项 Vitest 回归通过;后端相关 92 项通过(最终新增的火山参数用例包含在其中)。覆盖 SDK 构造出的请求体、非法/冲突参数拦截、配置覆盖、原生供应商无 api 字段、代理与 Coding Plan 隔离、保存重启、运行中补充与下一轮快照;没有调用付费模型。

浏览器使用真实组件检查浅色/深色、440/320px 侧栏、360px 窗口,以及模型列表、滑杆键盘操作、默认恢复、焦点和菜单关闭。验收报告见项目根目录 `design-qa.md`。
浏览器使用真实组件检查浅色/深色、440/320px 侧栏、360px 窗口,以及模型列表、滑杆键盘操作、默认恢复、焦点和菜单关闭。

重启前确认运行中/排队任务为 0。项目启动器 PID 38760;前端 3000、后端 10392 的健康检查均为 200,启动错误日志为空。真实已配置模型返回:deepseek-flash 为关闭与 low/high/max;mimo-v2.5 为开关。只读检查能力,不自动执行用户问题。

Expand Down
2 changes: 1 addition & 1 deletion docs/chat-agent.md
Original file line number Diff line number Diff line change
Expand Up @@ -78,7 +78,7 @@ AI 助手的搜索步骤显示实际返回的检索方式:关键词与语义

自动验收见 `tests/test_ai_agent_context.py`、`tests/test_ai_message_pages.py` 和 `frontend/tests/agent-materials.test.js`,覆盖多会话、多页、范围修改、原文引用、附件长文本、重启恢复、超限缩小、8K 窗口、接口隔离及十万条合成消息。十万条流式读取包含重复消息,测试断言 Python 分配峰值低于 8 MiB、首批读取后的进程常驻内存增长低于 32 MiB;十万条原文落库另与确定性计数基准对照。这些数值是测试输入下的工作集约束,不代表所有附件解析库的内存上限。

真实验收工具为 `tools/verify_agent_context.py`:读取现有模型配置,在独立状态目录保存任务与用量;支持 `--resume-run` 和连续 `--followup`,不会将密钥复制到验收记录,也不会修改用户的 AI 自动任务。
真实验收工具为 `tools/verify_agent_context.py`:读取现有模型配置,在独立状态目录保存任务与用量;支持 `--resume-run` 和连续 `--followup`,不会将密钥复制到验收记录,也不会修改用户的 AI 自动任务。(该脚本已从仓库删除,可从 git 历史取回。)

### 本次验收结果

Expand Down
2 changes: 1 addition & 1 deletion docs/deepagents-acceptance.md
Original file line number Diff line number Diff line change
Expand Up @@ -111,6 +111,6 @@ uv run python tools/verify_ai_runtime.py
node tools/build_ai_smoke.cjs
```

前端使用 Node 22 或支持当前 Vite 的更新版本,在 `frontend` 运行 `npm ci`、`npx vitest run`、`npm run generate`。真实模型验收工具为 `tools/verify_deepagents_real.py`;独立原文基线为 `tools/verify_deepagents_coverage.py`。这些命令可能产生模型费用,真实数据参数需使用本机有效配置。不会自动重新执行旧生产任务。
前端使用 Node 22 或支持当前 Vite 的更新版本,在 `frontend` 运行 `npm ci`、`npx vitest run`、`npm run generate`。真实模型验收工具为 `tools/verify_deepagents_real.py`;独立原文基线为 `tools/verify_deepagents_coverage.py`(这两个脚本已从仓库删除,可从 git 历史取回)。这些命令可能产生模型费用,真实数据参数需使用本机有效配置。不会自动重新执行旧生产任务。

尚未交付生产安装包;macOS 当前实跑、界面绘制时延以及完整报告最终事实质量是不能用模拟结果代替的验收项。未满足的项目必须保留为未通过,不应据此发布。
2 changes: 2 additions & 0 deletions docs/local-semantic-search.md
Original file line number Diff line number Diff line change
Expand Up @@ -103,6 +103,8 @@ GPU 进程故障、超时、缺库或显存不足时销毁故障进程,在独

## 2026-09-08 验收记录

> 本节提到的 `tools/verify_local_search_*.py` 验收脚本和 `tools/benchmark_local_search_reading.py` 已从仓库删除,可从 git 历史取回。

### 真实账号完整流程复测(效率与完成状态修复后)

- 使用用户已选择的两个聊天、最近 30 天、BGE Small 中文和 CUDA,通过正在运行的桌面应用本地后端完成重建;未扩大聊天范围。`tools/verify_local_search_live.py` 可复测重建、暂停继续、检索与重复检查,报告仅记录统计量,不保存聊天正文。
Expand Down
Loading
Loading