> ## Documentation Index
> Fetch the complete documentation index at: https://docs.fetchhive.com/llms.txt
> Use this file to discover all available pages before exploring further.

# Extract from File

> Configura un paso de flujo de trabajo que obtiene un archivo desde una URL y extrae filas o texto para pasos posteriores

# Extract from File

Usa **Extract from File** cuando quieras que un paso del flujo de trabajo lea datos estructurados o de texto desde una URL pública dentro de Fetch Hive.

## Configuración

| Opción              | Requerido    | Descripción                                                                                                    |
| ------------------- | ------------ | -------------------------------------------------------------------------------------------------------------- |
| Name                | No           | Etiqueta del paso en el lienzo del flujo de trabajo.                                                           |
| File URL            | Sí           | URL en **File URL**. Este campo admite variables del flujo de trabajo mediante **Insert Variable**.            |
| File format         | No           | Detección automática por extensión de la URL, o elige manualmente JSON, CSV, XLSX, XLS, HTML, DOCX, PDF o XML. |
| Sheet index         | Solo tabular | Índice de hoja base cero para archivos XLS y XLSX. El valor predeterminado es `0`.                             |
| First row is header | Solo tabular | Cuando está habilitado, CSV y hojas de cálculo usan la primera fila como nombres de columna.                   |
| When the step fails | No           | Controla si el flujo de trabajo debe **Terminate Workflow** o **Continue** si este paso falla.                 |

Agrega este paso desde el grupo **Utilities** en **Search steps...**.

Formatos admitidos:

| Formato         | Forma de salida             |
| --------------- | --------------------------- |
| CSV, XLSX, XLS  | Arreglo de objetos por fila |
| JSON, XML       | Objeto o arreglo analizado  |
| HTML, DOCX, PDF | Cadena de texto plano       |

Las salidas tabulares se limitan al límite de iteración de tu plan y a un tope de seguridad de la plataforma de 1.000 filas.

## Salida

Haz clic en **Run** en el encabezado del paso para probarlo. Fetch Hive muestra el resultado extraído en **Output** cuando finaliza la ejecución.

Usa el selector de variables en un paso posterior para insertar la ruta de salida exacta de tu ejecución. La referencia base es:

```text theme={null}
{{STEP_IDENTIFIER.output}}
```

Para archivos CSV o de hoja de cálculo, `{{STEP_IDENTIFIER.output}}` es un arreglo que puedes pasar directamente a un paso **Iteration**:

```text theme={null}
{{extract_contacts.output}}
```

Dentro del cuerpo de la iteración, referencia campos de cada fila:

```text theme={null}
{{contacts_loop.item.name}}
{{contacts_loop.item.website}}
```

## Ejemplo

Agrega **Extract from File** desde el grupo **Utilities**.

Establece **File URL** en un CSV público como `https://example.com/contacts.csv`.

Mantén **File format** en **Auto-detect** y deja **First row is header** habilitado.

Agrega un paso **Iteration** con origen `{{extract_contacts.output}}`.

Dentro del bucle:

1. **Website Scrape** en `{{contacts_loop.item.website}}`
2. **AI Prompt** para escribir un dato único de outreach a partir del resultado del scrape

Después del bucle, usa **Data Transform** o **Google Sheets** para recopilar las filas enriquecidas.

## Notas

* Usa una URL de archivo directamente accesible. Este paso obtiene el archivo por HTTP; no sube archivos desde tu computadora.
* La extracción HTML devuelve texto de página completa, no filas de tabla.
* La extracción PDF y DOCX devuelve texto adecuado para pasos posteriores de **AI Prompt**.

Ver también: [Data Transform](./data-transform), [Creating and Editing](../../creating-and-editing), [Testing and Iteration](../../testing-and-iteration) y [Error Handling](../../error-handling)
