Files
reader/TODO.md
T

2.9 KiB

TODO

当前状态

项目当前已经进入“可交付给 OpenClaw 调用”的阶段。

当前主链路:

FreshRSS 未读 -> RSS 内容提取 -> LLM 总结 -> 规则过滤 -> OpenClaw delivery payload

当前已经完成:

  • FreshRSS greader API 接入
  • entry -> item 标准化映射
  • RSS-first 内容提取策略
  • LLM 摘要与校验闭环
  • 第一版规则引擎
  • ArticleCandidateRecord / OpenClawCandidateInput 分层
  • OpenClawDeliveryPayload 批量投递结构
  • 最终 payload 成功后才标记 FreshRSS 已读
  • MCP 工具 run_freshrss_openclaw_pipeline
  • 默认精简输出模式
  • 日报级 keywords 词元库与周期性词元清洗 skill 设计完成
  • 日报级 keywords 词元库与全局词频统计实现完成
  • keyword-cleanup-review skill 骨架与 review bundle 脚本实现完成
  • 词元清洗低复杂治理层落地:term_cleanup_policy / term_watchlist / term_change_log
  • 已支持人工确认采纳建议并写入 term_watchlist / term_change_log

P0 - 交接前后最优先

  • 为 OpenClaw 补齐交接文档
  • 将 MCP 工具作为统一生产入口
  • 将默认输出收敛为最小必要文件
  • 设计 OpenClaw webhook / delivery payload 的主动推送方式
  • 明确 OpenClaw 侧如何注册和启动本 MCP 服务

P1 - 下一阶段推进

  • 设计“人工确认后再沉淀知识库”的状态流转
  • 收敛 paywall 误判规则,降低中文文本误报
  • 细化过滤规则并引入更多个性化上下文
  • 将 keyword-cleanup-review skill 接入周期性执行流程,产出别名/停用词/兴趣词建议
  • 增加清洗前后效果对比报告,验证配置调整是否真的改善过滤质量
  • 增加批量 run 的保留策略与历史清理策略
  • 为 OpenClaw 补一份更正式的 MCP 调用示例和接线说明

P2 - 后续增强

  • 将 Markdown sink 进一步降级为 debug / fallback 能力
  • 增加按天聚合 ArticleCandidateRecord 的批处理能力
  • 让 OpenClaw 聚合候选内容并生成日级摘要
  • 将日级摘要写入知识库,并同步生成面向用户的日报消息
  • 支持更多 content_kind
  • 增加提取缓存、重试和更细粒度日志
  • 整理历史 rerun 目录与调试产物保留策略

当前建议的下一步

优先做这三件事:

  1. 将 keyword-cleanup-review skill 接入周期性执行流程
  2. 设计“人工确认后再沉淀知识库”的状态流转
  3. 收敛规则误判,尤其是 paywall 相关启发式

交接时优先阅读

  • README.md
  • docs/openclaw/openclaw-handoff.md
  • docs/openclaw/openclaw-candidate-input-field-spec.md
  • docs/openclaw/openclaw-delivery-payload-spec.md
  • docs/design/daily-keyword-index-design.md
  • skills/keyword-cleanup-review/SKILL.md
  • docs/current/context-reset-brief.md