Skip to main content
Firecrawl Research es un índice diseñado específicamente para agentes de investigación científica y de ingeniería. Ofrece un conjunto de herramientas orientado a la investigación para buscar artículos, inspeccionar sus metadatos, leer pasajes relevantes del texto completo y descubrir artículos relacionados mediante expansión estructural. El índice cubre aproximadamente 43 millones de resúmenes de artículos. La mayor parte del corpus corresponde a biomedicina y ciencias de la vida — PubMed, bioRxiv y medRxiv — junto con arXiv para física, matemáticas e informática. Se puede acceder a los artículos mediante sus IDs de origen, por lo que las referencias pmid:, pmcid: y doi: funcionan igual que las de arxiv:.
  • Encuentra artículos por tema, método, benchmark, autor o categoría
  • Inspecciona metadatos canónicos de los artículos e IDs de origen
  • Lee los pasajes de un artículo que responden a una pregunta específica
  • Amplía a partir de artículos semilla sólidos hacia artículos relacionados, citas o referencias
Para darle a tu agente acceso al Índice de investigación, te recomendamos encarecidamente utilizar nuestro CLI o MCP, junto con nuestra skill de investigación dedicada, que puedes instalar con:
Firecrawl tiene dos funciones llamadas “research”, y no son la misma: Use Índice de investigación para trabajar con bibliografía: buscar artículos, leerlos y seguir sus citas. Use categories: ["research"] cuando quiera páginas web habituales alojadas en dominios académicos.

Endpoints

Buscar artículos

Busca resúmenes de artículos con una consulta en lenguaje natural. La respuesta incluye artículos ordenados por relevancia con paperId canónico, primaryId preferido, IDs de origen, título, resumen, puntuación y señales de ranking opcionales.
Filtros opcionales:
  • authors: filtro por coincidencia parcial del autor; todos los filtros deben cumplirse
  • categories: filtro por categoría del artículo, como cs.LG
  • from: límite inferior inclusivo de creación/actualización, YYYY-MM-DD
  • to: límite superior inclusivo de creación/actualización, YYYY-MM-DD

Ejemplo biomédico

La mayor parte del índice está dedicada a las ciencias de la vida, por lo que las consultas clínicas y de biología molecular funcionan de la misma manera:
Los resultados incluyen un primaryId en el espacio de nombres que use la fuente, por lo que los resultados biomédicos se devuelven como pmid:<id>, pmcid:<id> o doi:<doi>. Pasa ese valor directamente a los endpoints de inspección, lectura y relacionados que se muestran a continuación.

Inspeccionar un artículo científico

Usa un paperId canónico o un primaryId específico de la fuente. Los formatos aceptados para primaryId son arxiv:<id>, pmid:<id>, pmcid:<id> y doi:<doi>; por ejemplo, curl -s ".../v2/search/research/papers/pmid:<id>" para un registro de PubMed.

Leer pasajes del artículo

Agrega query a la misma ruta del artículo para recuperar los pasajes más relevantes del texto completo para una pregunta. Esto es útil para verificar si un artículo candidato realmente contiene un método, un conjunto de datos, una restricción o un resultado antes de incluirlo.
Parte de uno o más artículos semilla mediante expansión semántica y clasifica los candidatos según una intent expresada en lenguaje natural.
Modos:
  • similar: vecindario de cocitación y acoplamiento bibliográfico
  • citers: artículos que citan el artículo semilla
  • references: artículos citados por el artículo semilla

Busca en el historial de GitHub

Los issues, los pull requests fusionados y los README de los repositorios ahora están disponibles en el Developer Index, que los clasifica según los pasajes coincidentes y añade fuentes de documentación seleccionadas. Usa GET o POST /search/developer o /search con categories: ["developer"].