📌 ¿Qué datos de publicaciones públicas puedes extraer de las búsquedas por hashtag en X?
Esta plantilla recopila registros estructurados de las páginas de resultados de búsqueda, incluyendo Category, Keyword, Web_Page_URL, Tweet_Website, Author_Name, Author_Web_Page_URL, Tweet_Timestamp, Tweet_Content, Tweet_Image_URL, Tweet_Video_URL, Tweet_AD, Tweet_Number_of_Reviews y otros campos de salida publicados. Es útil para analistas de redes sociales, equipos de marca, investigadores y estrategas de contenido.
Los datos se recopilan de X (anteriormente Twitter). X es una red social para publicar posts y seguir conversaciones públicas en tiempo real.
💰 Precios
Precio actual: $0.3/1,000 líneas. La facturación se basa en el número de líneas de salida producidas por la tarea.
📦 Salida
La implementación publicada actual puede devolver los siguientes campos:
keycountfail_counthash_keymsg_typecontentCategoryKeywordWeb_Page_URLTweet_WebsiteAuthor_NameAuthor_Web_Page_URLTweet_TimestampTweet_ContentTweet_Image_URLTweet_Video_URLTweet_ADTweet_Number_of_ReviewsTweet_Number_of_RetweetsTweet_Number_of_LikesTweet_Number_of_Looks
{
"key": null,
"count": null,
"fail_count": null,
"hash_key": null,
"msg_type": null,
"content": null,
"Category": "TopPost",
"Keyword": "#fridayfeeling",
"Web_Page_URL": "https://twitter.com/search?q=#fridayfeeling&src=typed_query&f=top",
"Tweet_Website": "https://twitter.com/Printtapp/status/1768257041947062311",
"Author_Name": "printtapp",
"Author_Web_Page_URL": "https://twitter.com/Printtapp",
"Tweet_Timestamp": "2024-03-14",
"Tweet_Content": "POV: Walking past the office printing queue, knowing our freshly printed documents are waiting for us at home. #fridayfeeling",
"Tweet_Image_URL": null,
"Tweet_Video_URL": "https://twitter.com/Printtapp/status/1768257041947062311",
"Tweet_AD": "False",
"Tweet_Number_of_Reviews": null,
"Tweet_Number_of_Retweets": null,
"Tweet_Number_of_Likes": null,
"Tweet_Number_of_Looks": null
}
🎯 Casos de Uso
- Usa Keyword, Category y Tweet_Content para comparar conversaciones entre hashtags.
- Usa Tweet_Number_of_Retweets, Tweet_Number_of_Likes y Tweet_Number_of_Looks para comparar el engagement.
- Usa Author_Name y Author_Web_Page_URL para identificar las cuentas que contribuyen a un tema.
- Usa Tweet_Timestamp, Tweet_Image_URL y Tweet_Video_URL para estudiar los patrones de publicación y los formatos de los medios.
🐙 ¿Por qué Octoparse?
- Flujo de trabajo listo para usar: Los pasos de extracción para X (anteriormente Twitter) ya están configurados, por lo que no necesitas construir el scraper desde cero.
- Ejecución flexible: Ejecuta la tarea predefinida en la nube sin necesidad de mantener un ordenador local en línea para la recopilación.
- Salida estructurada y repetible: Los resultados se devuelven como filas consistentes que son más fáciles de comparar, filtrar, deduplicar y procesar que las páginas copiadas manualmente.
- Parámetros de entrada verificados: El formulario expone las entradas actuales, los valores seleccionables y los límites significativos configurados para esta plantilla.
- Transferencia de datos práctica: Revisa los resultados en Octoparse y expórtalos o procésalos utilizando las opciones compatibles con tu entorno de Octoparse.
📝 Entrada
Completa los siguientes campos:
- Palabras clave/ Hashtags (Requerido) — Hasta 3 entradas por ejecución.
- Número de desplazamientos hacia abajo (Opcional) — Número de veces que se desplaza hacia abajo. Rango aceptado: 1 a 200.
🚀 Cómo Usar
- Abre la plantilla y selecciona Probar o Iniciar.
- Completa los campos de entrada mencionados anteriormente.
- Inicia la tarea utilizando el modo de ejecución en la nube compatible.
- Revisa las filas de salida y exporta o procesa los datos estructurados.
⚠️ Limitaciones
Los resultados dependen de lo que el sitio de origen exponga en el momento de la ejecución. Un campo de salida listado puede estar vacío cuando la página de origen no proporciona ese valor. Los límites de entrada mostrados arriba son aplicados por la plantilla.
💡 Consejos
Usa entradas específicas y válidas y revisa un resultado representativo antes de iniciar un lote grande. Elimina las entradas duplicadas cuando no se necesiten registros repetidos.
❓ Preguntas Frecuentes
¿Cómo recopila Octoparse datos de X (anteriormente Twitter)?
La plantilla toma las entradas configuradas de Palabras clave/ Hashtags (hasta 3), Número de desplazamientos hacia abajo (hasta 200), envía cada valor proporcionado e itera los registros devueltos en las páginas de resultados de búsqueda de X (anteriormente Twitter), y luego emite filas estructuradas que contienen campos como Category, Keyword, Web_Page_URL, Tweet_Website, Author_Name.
¿Qué entrada requiere este Scraper de Twitter (por hashtag)?
Usa los campos y valores aceptados que se muestran en la sección de Entrada. Solo se enumeran los límites relevantes para el usuario y las opciones seleccionables.
¿Qué datos puedo extraer de X (anteriormente Twitter)?
Los campos de salida actuales y una Prevista de datos JSON representativa se enumeran en la sección de Salida. La disponibilidad de los campos puede variar cuando la página de origen no muestra un valor.
¿Cuánto cuesta este Scraper de Twitter (por hashtag)?
El precio actual es de $0.3/1,000 líneas, y la facturación se basa en el número de líneas de salida producidas por la tarea.
¿Por qué algunos campos de X (anteriormente Twitter) pueden estar vacíos?
Las páginas de origen no siempre exponen todos los valores para cada registro, y los diseños pueden variar según el elemento, el mercado o la respuesta actual del sitio. La plantilla devuelve un campo cuando la página actual lo proporciona.
¿Puedo exportar los datos recopilados de X (anteriormente Twitter)?
Puedes revisar las filas estructuradas en Octoparse y exportarlas o procesarlas utilizando las opciones compatibles con tu entorno de Octoparse.
🔗 Plantillas Relacionadas
- Twitter (X) Comments Scraper — Usa Twitter (X) Comments Scraper cuando se necesiten registros a nivel de reseña o comentario.
- Twitter Advanced Search Comments Scraper — Usa Twitter Advanced Search Comments Scraper cuando se necesiten registros a nivel de reseña o comentario.
- Twitter Scraper (by Account URL) — Usa Twitter Scraper (by Account URL) para un flujo de trabajo complementario en el mismo sitio de origen.