Aplicaciones/Operaciones con URLs/Obtener el HTML limpio de un artículo
Operaciones con URLs
Operaciones con URLs Acción

Obtener el HTML limpio de un artículo

Extrae el cuerpo principal de un artículo a partir de un documento HTML, eliminando el ruido alrededor como navegación, barras laterales y anuncios. Opcionalmente elimina las etiquetas HTML restantes para devolver texto plano.

+200 apps conectables·Tareas probadas y mantenidas·Soporte humano en español e inglés

En detalle

Qué hace y para qué sirve

Esta integración te permite extraer el contenido limpio de un artículo web, facilitando su análisis y procesamiento posterior. Con esta herramienta, puedes obtener el HTML depurado de una página específica, eliminando elementos no deseados y centrándote en el texto relevante.

Automatizar esta tarea con Botize te ahorra tiempo y esfuerzo, permitiéndote concentrarte en la información esencial de los artículos que necesitas procesar.

Cómo funciona

Así encaja en una tarea automática

Una tarea de Botize une un disparador con una o más acciones. Esta pieza es una de ellas.

Elige un disparador

El evento que inicia la tarea, de esta o de cualquier otra app.

Esta acción se ejecuta

Botize la realiza automáticamente usando los datos que entrega el disparador.

Actívala y olvídate

La tarea trabaja sola desde ese momento. Si algo no cuadra, la ajustas o te ayudamos.

Configuración

Opciones de personalización

Campos que puedes ajustar al usarlo en tu automatización.

Datos de salida

Información entregada

Al ejecutarse, esta operación entrega los siguientes datos, pudiendo ser utilizados en la misma tarea automática.

  • Etiquetas

  • HTML {{html}}

Aprende viendo

Tutoriales en vídeo

Vídeos cortos donde ves cómo se monta una tarea real de principio a fin.

Inspírate

Automatizaciones listas para usar

Tareas reales creadas con Operaciones con URLs: actívalas en minutos y ajústalas a tu gusto.

  • type
  • gspreadsheet → read_row
  • site_inspector → get_html
  • btztextparser → get_urls
  • site_inspector → get_cleaned_html_article_text
  • gspreadsheet → update_row_by_number
Obtiene el HTML de cada URL indicada en una hoja de Google Sheets, extrae el HTML correspondiente al artículo, las URLs y las añade al documento de Google Sheets

¿Necesitas ayuda?

Personas detrás, de verdad

Escríbenos por email

info@botize.com
De lunes a viernes de 7h a 13h (España).

Háblanos por Telegram

t.me/botize
De lunes a viernes de 7h a 13h (España).

Ven con una idea.
Vete con una automatización.

Crea tu primera tarea en minutos. Hazlo una vez y olvídate para siempre.

Empieza a automatizar