Skip to main content

Extract from File

当你希望工作流步骤从 Fetch Hive 内的公开文件 URL 读取结构化或文本数据时,请使用 Extract from File

配置

Search steps…Utilities 分组添加此步骤。 支持的格式: 表格输出会限制在你的套餐迭代上限以及平台 1,000 行的安全上限内。

输出

点击步骤标题中的 Run 来测试该步骤。运行完成后,Fetch Hive 会在 Output 中显示提取结果。 在后续步骤中使用变量选择器插入本次运行的确切输出路径。基础引用为:
对于 CSV 或电子表格文件,{{STEP_IDENTIFIER.output}} 就是行对象数组(没有 .rows.items 包装)。可直接传入 Iteration 步骤:
不要使用 {{extract_contacts.output.rows}}{{extract_contacts.output.items}} — 这些路径会解析为 null。

字段名

启用 First row is header 后,列标题会先转换为变量安全的 snake_case 键,再成为行对象属性: 重复的规范化键会加数字后缀(company_name, company_name_2)。 在迭代体内,引用每一行的字段:

示例

Utilities 分组添加 Extract from File File URL 设置为公开 CSV,例如 https://example.com/contacts.csv File format 保持为 Auto-detect,并启用 First row is header 添加 Iteration 步骤,来源为 {{extract_contacts.output}} 在循环内:
  1. {{contacts_loop.item.website}} 运行 Website Scrape
  2. 使用 AI Prompt 根据抓取结果编写独特的触达信息
循环结束后,使用 Data TransformGoogle Sheets 汇总丰富后的行。

备注

  • 请使用可直接访问的文件 URL。此步骤通过 HTTP 获取文件,不会从你的电脑上传文件。
  • HTML 提取返回整页文本,而不是表格行。
  • PDF 和 DOCX 提取返回适合后续 AI Prompt 步骤的文本。
  • 破坏性变更: 旧工作流若引用带空格的原始表头(例如 {{contacts_loop.item.Company name}}),需在重新运行 extract 步骤后更新为 snake_case 键。
另请参阅: Data TransformCreating and EditingTesting and IterationError Handling