工具 · 自动化 · 已完成 · 2026.03.15
CASE 01

AI日报自动生成工作流

让AI帮你完成每日资讯聚合与摘要生成

自动化 工具 信息聚合 已完成
发布2026-03-15
阅读8 分钟
技术Claude API · Cron · Webhook
方向工具 / 工作流优化
一句话核心

每日8点自动抓取5+头部AI媒体的最新资讯,AI去重+摘要生成日报,推送至飞书与知识库。

02BACKGROUND

背景

信息焦虑是AI从业者最常见的职业病

// 问题
每天早上打开手机,AI圈又炸了——新模型发布、新论文、新融资、新demo...信息源多到看不完,但真正有价值的又被淹没在噪音里。手动刷RSS、翻Twitter、看公众号,2小时过去了,还没开始干活。
// 痛点清单
  • 信息源分散:量子位、机器之心、36氪、Twitter、Arxiv...分布在10+平台
  • 重复内容多:同一个新闻被多平台转发,浪费时间筛选
  • 摘要质量参差:人工摘要耗时,且容易丢失关键信息
  • 沉淀困难:看完就忘,没有结构化归档
用户故事:作为AI个体创业者,我希望每天早上8点能收到一份AI圈当日要闻摘要,以便用15分钟掌握前沿动态,把节省的时间用于深度工作和创作。
03SOLUTION

方案

五个环节的自动化流水线

// 流程
① 定时触发每日8:00 ② 抓取源5+媒体RSS ③ AI去重语义相似度 ④ 摘要生成Claude API ⑤ 推送飞书+知识库
// 技术栈
  • 定时调度:Cron job,每日8:00触发
  • 数据抓取:RSS parser + Web scraping兜底
  • AI去重:embedding + 余弦相似度,阈值0.85
  • 摘要生成:Claude API,prompt工程控制结构(标题+摘要+标签)
  • 推送渠道:飞书Webhook + IMA知识库API
// 关键决策
为什么用Claude而不是GPT?中文摘要的连贯性和信息密度Claude表现更稳定,尤其在长文摘要场景。

为什么阈值设0.85?实测0.8会误杀相似但不同的新闻,0.9会漏掉真正的重复,0.85是平衡点。
04APPLICATION

应用

典型用户路径与适用范围

// 使用场景
  • 晨间速览:8:15起床,飞书收到日报,15分钟掌握昨日+今日AI圈动态
  • 选题灵感:日报中标注的"高热度"条目,直接作为今日内容创作选题
  • 知识沉淀:日报自动归档到IMA知识库,按主题可回溯检索
  • 周报素材:周末做内容周报时,直接从日报库提取本周TOP事件
// 典型用户路径
路径1(日常):飞书收到推送 → 扫一眼标题 → 标记感兴趣的 → 周末统一深度阅读

路径2(创作):日报库按主题筛选 → 找到3-5条相关 → AI辅助生成内容大纲 → 输出文章
"工具不是替代我思考,而是帮我过滤噪音——决策权始终在我手上。"
05RESULT

效果

运行4个月的数据复盘

120+
累计生成日报
2.3h
日均节省时间
85%
去重准确率
// 上线前后对比
维度上线前上线后
信息获取耗时2-3小时/天15分钟/天
信息覆盖率依赖个人习惯,约60%5+源聚合,约90%
重复信息处理手动判断,易疲劳AI去重,0误判
知识沉淀散落在各平台结构化归档
// 定性反馈
自我评价:"从信息焦虑到信息掌控,最大的改变不是省了多少时间,而是心态上不再怕漏掉重要信息,可以更专注做深度工作。"
06REVIEW

复盘

4个月运行后的真实复盘

// 做对了什么
  • 先MVP再优化:第一版只抓3个源、纯文本摘要,跑通后再加去重和结构化
  • 去重放核心:把语义去重作为第一优先级,比摘要质量更重要
  • 沉淀优先:日报不只是看,而是自动归档,形成可检索的知识库
// 踩了什么坑
  • RSS源不稳定:部分媒体RSS偶尔挂掉,需要Web scraping兜底
  • 摘要太长:早期prompt没控制长度,单条摘要写到300字,反而难读。后期限制在80字以内
  • 标签体系混乱:一开始用自由标签,导致同主题分散。后期统一标签词表
// 下一步迭代
v2 计划:
- 加入"个人偏好权重",对常读主题提升优先级
- 周报/月报自动生成,从日报库提炼趋势
- 接入更多源:Twitter KOL、Arxiv论文、GitHub trending
"最好的工具不是最强大的,而是你每天都在用的——这个工作流跑了4个月没停过,说明它真的解决了问题。"