📌 ¿Qué resultados de publicaciones de Xiaohongshu puedes recopilar por palabra clave?
Esta plantilla recopila registros de resultados de búsqueda con Título, URL de la imagen, URL de la página de detalles, URL del autor, Fecha y hora, Autor, Palabras clave de entrada y Recuento de "Me gusta". Es útil para investigadores de redes sociales, equipos de contenido, analistas de marca e investigadores de audiencia.
Los datos se recopilan de Xiaohongshu. Xiaohongshu es una plataforma de descubrimiento social centrada en publicaciones de usuarios, productos, temas de estilo de vida y recomendaciones.
💰 Precios
Actualmente, esta plantilla es gratuita y no tiene una tarifa de uso por línea. Aún pueden aplicarse los límites del plan o de los recursos de Octoparse.
📦 Salida
La implementación publicada actualmente puede devolver los siguientes campos:
Input_keywordsTitleImage_URLDetails_page_URLAuthorDatetimeAuthor_URLLike_countRecommended_reason
{
"Input_keywords": "web scraping",
"Title": "推荐3款自动爬虫神器,再也不用手撸代码了",
"Image_URL": "https://sns-webpic-qc.xhscdn.com/202511101556/e6aa53f42ed33364e0afd76422cd9bc3/1040g008314t3depl14005npqjgqg8e7a9v66v7g!nc_n_webp_mw_1",
"Details_page_URL": "https://www.xiaohongshu.com/search_result/66889d19000000000a026420?xsec_token=ABNlEB76L3vQ5N6cIYO-nnMuxpO0YslweSJOt3wLL32-8=&xsec_source=",
"Author": "Python大数据分析",
"Datetime": "2024-07-06",
"Author_URL": "https://www.xiaohongshu.com/user/profile/5f3a9c3500000000010038ea?channel_type=web_search_result_notes&parent_page_channel_type=web_profile_board&xsec_token=AB6uZC_94FYmu431pd_4pk8yP8HtOlqXAyi_kjD4UVbiA=&xsec_source=pc_search",
"Like_count": "511",
"Recommended_reason": null
}
🎯 Casos de uso
- Crear un conjunto de datos de investigación estructurado y organizado por Palabras clave de entrada y Título.
- Analizar el contenido de origen y el momento a través de Autor, URL del autor y Fecha y hora.
- Medir la participación de la audiencia o de los clientes utilizando el Recuento de "Me gusta".
- Utilizar la URL de la imagen, la URL de la página de detalles y la URL del autor para auditar los registros de origen o para alimentar flujos de trabajo posteriores con páginas verificadas.
🐙 ¿Por qué Octoparse?
- Flujo de trabajo listo para usar: Los pasos de extracción para Xiaohongshu ya están configurados, por lo que no necesitas construir el scraper desde cero.
- Ejecución flexible: Elige el modo de ejecución local o en la nube compatible para adaptarte a comprobaciones puntuales o a trabajos de recopilación repetibles.
- Salida estructurada y repetible: Los resultados se devuelven como filas consistentes que son más fáciles de comparar, filtrar, deduplicar y procesar que las páginas copiadas manualmente.
- Barreras de entrada verificadas: El formulario expone las entradas actuales, los valores seleccionables y los límites significativos configurados para esta plantilla.
- Transferencia de datos práctica: Revisa los resultados en Octoparse y expórtalos o procésalos utilizando las opciones compatibles con tu entorno de Octoparse.
📝 Entrada
Completa los siguientes campos:
- Pre-login (Requerido) — Habilita el pre-login antes de buscar en Xiaohongshu.
- Palabras clave (Requerido) — Introduce las palabras clave de búsqueda de Xiaohongshu, una por línea. Hasta 100 entradas por ejecución.
🚀 Cómo usar
- Abre la plantilla y selecciona Probar o Iniciar.
- Completa los campos de entrada mencionados anteriormente.
- Inicia la tarea utilizando el modo de ejecución local o en la nube compatible.
- Revisa las filas de salida y exporta o procesa los datos estructurados.
⚠️ Limitaciones
Los resultados dependen de lo que el sitio de origen exponga en el momento de la ejecución. Un campo de salida listado puede estar vacío cuando la página de origen no proporciona ese valor. Los límites de entrada mostrados arriba son aplicados por la plantilla.
💡 Consejos
Utiliza entradas específicas y válidas y revisa un resultado representativo antes de iniciar un lote grande. Elimina las entradas duplicadas cuando no se necesiten registros repetidos.
❓ Preguntas frecuentes
¿Cómo funciona este scraper?
La automatización aplica el Pre-login y las Palabras clave (hasta 100 por ejecución), procesa las páginas de búsqueda resultantes y sus elementos de resultado, y escribe filas estructuradas que incluyen Palabras clave de entrada, Título, URL de la imagen y URL de la página de detalles.
¿Qué necesito introducir?
Utiliza los campos y los valores aceptados que se muestran en la sección de Entrada. Solo se enumeran los límites relevantes para el usuario y las opciones seleccionables.
¿Qué datos devuelve esta plantilla?
Los campos de salida actuales y una Prevista de datos JSON representativa se enumeran en la sección de Salida. La disponibilidad de los campos puede variar cuando la página de origen no muestra un valor.
¿Es gratuita esta plantilla?
Actualmente es gratuita y no tiene una tarifa de uso por línea. Aún pueden aplicarse los límites del plan o de los recursos de Octoparse.
¿Por qué algunos campos de salida pueden estar vacíos?
Las páginas de origen no siempre exponen todos los valores para cada registro, y los diseños pueden variar según el artículo, el mercado o la respuesta actual del sitio. La plantilla devuelve un campo cuando la página actual lo proporciona.
¿Puedo exportar los datos recopilados?
Puedes revisar las filas estructuradas en Octoparse y exportarlas o procesarlas utilizando las opciones compatibles con tu entorno de Octoparse.
🔗 Plantillas relacionadas
- Xiaohongshu Post Details Scraper — Utiliza Xiaohongshu Post Details Scraper para enriquecer las URL descubiertas con datos de la página de detalles.
- Xiaohongshu Search Results Scraper (por URL) — Utiliza Xiaohongshu Search Results Scraper (por URL) para un flujo de trabajo complementario en el mismo sitio de origen.
- Twitter (X) Comments Scraper — Utiliza Twitter (X) Comments Scraper para recopilar datos comparables de redes sociales de otra fuente.