📌 ¿Qué datos de resultados de búsqueda de Xiaohongshu puedes recopilar a partir de las URL enviadas?
Esta plantilla recopila registros de resultados de búsqueda con Título, URL de la imagen, URL de la página de detalles, URL del autor, Fecha y hora, Autor y Recuento de 'Me gusta'. Es útil para investigadores de redes sociales, equipos de contenido, analistas de marca e investigadores de audiencia.
Los datos se recopilan de Xiaohongshu. Xiaohongshu es una plataforma de descubrimiento social centrada en publicaciones de usuarios, productos, temas de estilo de vida y recomendaciones.
💰 Precios
Actualmente, esta plantilla es gratuita y no tiene tarifa de uso por línea. Aún pueden aplicarse los límites del plan o de los recursos de Octoparse.
📦 Salida
La implementación publicada actualmente puede devolver los siguientes campos:
TitleImage_URLDetails_page_URLAuthorDatetimeAuthor_URLLike_count
{
"Title": "推荐3款自动爬虫神器,再也不用手撸代码了",
"Image_URL": "https://sns-webpic-qc.xhscdn.com/202511101556/e6aa53f42ed33364e0afd76422cd9bc3/1040g008314t3depl14005npqjgqg8e7a9v66v7g!nc_n_webp_mw_1",
"Details_page_URL": "https://www.xiaohongshu.com/search_result/66889d19000000000a026420?xsec_token=ABNlEB76L3vQ5N6cIYO-nnMuxpO0YslweSJOt3wLL32-8=&xsec_source=",
"Author": "Python大数据分析",
"Datetime": "2024-07-06",
"Author_URL": "https://www.xiaohongshu.com/user/profile/5f3a9c3500000000010038ea?channel_type=web_search_result_notes&parent_page_channel_type=web_profile_board&xsec_token=AB6uZC_94FYmu431pd_4pk8yP8HtOlqXAyi_kjD4UVbiA=&xsec_source=pc_search",
"Like_count": "511"
}
🎯 Casos de uso
- Construir un conjunto de datos de investigación estructurado y organizado por Título.
- Analizar el contenido de origen y la cronología a través del Autor, la URL del autor y la Fecha y hora.
- Medir la interacción de la audiencia o los clientes utilizando el Recuento de 'Me gusta'.
- Utilizar la URL de la imagen, la URL de la página de detalles y la URL del autor para auditar los registros de origen o para alimentar flujos de trabajo posteriores con páginas verificadas.
🐙 ¿Por qué Octoparse?
- Flujo de trabajo listo para usar: Los pasos de extracción para Xiaohongshu ya están configurados, por lo que no necesitas construir el scraper desde cero.
- Ejecución flexible: Elige el modo de ejecución local o en la nube compatible para adaptarlo a comprobaciones puntuales o a trabajos de recopilación repetibles.
- Salida estructurada y repetible: Los resultados se devuelven en filas consistentes que son más fáciles de comparar, filtrar, deduplicar y procesar que las páginas copiadas manualmente.
- Parámetros de entrada verificados: El formulario expone las entradas actuales, los valores seleccionables y los límites significativos configurados para esta plantilla.
- Transferencia de datos práctica: Revisa los resultados en Octoparse y expórtalos o procésalos utilizando las opciones compatibles con tu entorno de Octoparse.
📝 Entrada
Completa los siguientes campos:
- URL de resultados de búsqueda de Xiaohongshu (Requerido) — URL de resultados de búsqueda de Xiaohongshu. Hasta 10,000 entradas por ejecución.
- Inicio de sesión previo (Requerido) — Habilita el inicio de sesión previo antes de recopilar los resultados de búsqueda de Xiaohongshu.
🚀 Cómo usar
- Abre la plantilla y selecciona Probar o Iniciar.
- Completa los campos de entrada mencionados anteriormente.
- Inicia la tarea utilizando el modo de ejecución local o en la nube compatible.
- Revisa las filas de salida y exporta o procesa los datos estructurados.
⚠️ Limitaciones
Los resultados dependen de lo que el sitio de origen exponga en el momento de la ejecución. Un campo de salida listado puede estar vacío cuando la página de origen no proporciona ese valor. Los límites de entrada mostrados anteriormente son aplicados por la plantilla.
💡 Consejos
Utiliza entradas específicas y válidas y revisa un resultado representativo antes de iniciar un lote grande. Elimina las entradas duplicadas cuando no se necesiten registros repetidos.
❓ Preguntas frecuentes
¿Cómo funciona este scraper?
La automatización aplica las URL de resultados de búsqueda de Xiaohongshu (hasta 10,000) y el Inicio de sesión previo, procesa las páginas de búsqueda resultantes y sus elementos, y escribe filas estructuradas que incluyen Título, URL de la imagen, URL de la página de detalles y Autor.
¿Qué necesito introducir?
Utiliza los campos y los valores aceptados que se muestran en la sección de Entrada. Solo se enumeran los límites relevantes para el usuario y las opciones seleccionables.
¿Qué datos devuelve esta plantilla?
Los campos de salida actuales y una Prevista de datos JSON representativa se enumeran en la sección de Salida. La disponibilidad de los campos puede variar cuando la página de origen no muestra un valor.
¿Es esta plantilla de uso gratuito?
Actualmente es gratuita y no tiene tarifa de uso por línea. Aún pueden aplicarse los límites del plan o de los recursos de Octoparse.
¿Por qué algunos campos de salida pueden estar vacíos?
Las páginas de origen no siempre exponen todos los valores para cada registro, y los diseños pueden variar según el elemento, el mercado o la respuesta actual del sitio. La plantilla devuelve un campo cuando la página actual lo proporciona.
¿Puedo exportar los datos recopilados?
Puedes revisar las filas estructuradas en Octoparse y exportarlas o procesarlas utilizando las opciones compatibles con tu entorno de Octoparse.
🔗 Plantillas relacionadas
- Scraper de detalles de publicaciones de Xiaohongshu — Utiliza el Scraper de detalles de publicaciones de Xiaohongshu para enriquecer las URL descubiertas con datos de la página de detalles.
- Scraper de resultados de búsqueda de Xiaohongshu (por palabra clave) — Utiliza el Scraper de resultados de búsqueda de Xiaohongshu (por palabra clave) para un flujo de trabajo complementario en el mismo sitio de origen.
- Scraper de comentarios de Twitter (X) — Utiliza el Scraper de comentarios de Twitter (X) para recopilar datos comparables de redes sociales de otra fuente.