Skip to main content

RSS Feed

当你希望工作流从直接 RSS 或 Atom feed URL 读取条目并将这些条目传递给后续步骤时,请使用 RSS Feed 该步骤仅读取 feed 文档。它不会从网站 URL 发现 feed,也不会抓取文章页面。要获取每个 feed 条目的文章内容,将 feed 输出发送到 Iteration 步骤,并在循环内使用 Website Scrape

配置

Search steps…Research 分组添加此步骤。

输出

该步骤返回归一化的 feed 元数据加上 items 数组:
在后续步骤中使用这些工作流变量:
对于单个(非并行)RSS feed 的 Iteration 步骤,将 Iterator 设置为:
在迭代主体内,使用 Iteration 步骤自身的标识符(例如若 Iteration 是 step_5)引用每条目的 URL,而不是字面量 iteration:

并行化的 RSS feeds

当 RSS 步骤启用了 Parallelization(多个 feed URL 作为版本)时,步骤输出会变成按版本顺序排列的 feed 对象数组。此时:
  • {{rss_step.output.items}} 会解析为 null(在数组上直接取字段名无效)。
  • {{rss_step.output.*.items}} 会抽取每个变体的 items 数组,得到数组的数组* 通配符不会展平。
  • 若要抓取所有 feed 中的每篇文章,请添加 Data Transform 步骤,模式为 Flatten array,源为 {{rss_step.output.*.items}},然后将 Iteration 的迭代器设为 {{flatten_step.output}}

示例:总结新的 feed 文章

创建以下工作流:
  1. 添加 RSS Feed 并将 Feed URL 设置为直接 feed URL。
  2. Item Limit 设置为每次运行所需的条目数量。
  3. 对于计划或重复部署的运行,保持启用 New items only
  4. 添加 Iteration 并将 Iterator 设置为 {{rss_step.output.items}}(单个 feed)。对于并行化的 feeds,请先按上文所述展平。
  5. 在迭代主体内,添加 Website Scrape 并将 URL 设置为使用 Iteration 步骤标识符的 {{iteration_step.item.url}}
  6. 在抓取步骤之后添加 AI Prompt 来总结文章内容。
  7. 从工作流输出中聚合或返回摘要。

备注

  • 支持 RSS 和 Atom feed URL。网站 feed 发现不属于此步骤的功能。
  • 当 feed URL 可以用作基准时,该步骤会将相对 item URL 归一化为绝对 URL。
  • 去重是用于重复运行的轻量级已见项目抑制。它不是 feed 历史或重放接口。
  • 文章抓取和摘要是独立的步骤,这样你可以明确控制抓取设置、提示词和聚合。
另见:Website Scrape测试与迭代计划部署