LitSynthLitSynth
  • Características
  • Precios
  • Preguntas frecuentes
  • Revisión de literatura
  • Blog
  • Métodos

Loading…

LitSynthLitSynth

Transforme su flujo de trabajo de investigación con análisis y síntesis de literatura impulsados por IA

DiscordEmail
Producto
  • Características
  • Precios
  • Preguntas Frecuentes
Recursos
  • Blog
  • Métodos
  • Registro de cambios
Enlaces amigos
  • Buscar papers
  • LitFigure – Figuras científicas
Empresa
  • Contacto
Legal
  • Política de privacidad
  • Términos de servicio

Flujos de investigación

Explore guías enfocadas para revisiones bibliográficas, flujos PubMed, auditorías de citas y planificación PRISMA-lite.

generador de revisión de la literatura con IAherramienta de IA para revisión sistemáticaPRISMA litecribado de revisión sistemáticaextracción de datos revisión sistemáticagenerador de protocolo de revisión sistemáticarevisión sistemática de semaglutida ejemploIA en educación revisión de la literatura ejemplocambio climático salud revisión de la literatura ejemplo
©️ 2026 LitSynth. Todos los derechos reservados.
SCORED ONCE · OVERALL FAIL

Seguridad y carga de cribado, medidas en holdouts no tocados

En el holdout no tocado de 281 registros, LitSynth tuvo cero exclusiones falsas y protegió todos los registros relevantes. Pero el 82,9 % siguió exigiendo revisión manual y superó el techo preregistrado del 80 %. El resultado del holdout es, por tanto, un fallo.

TOPIC / CD000996

TASK / Intervention

RECORDS / 281

PROTOCOL VERSION / 1

POLICY VERSION / title-abstract-v3

PREREG COMMIT / 8fd1e19

BLIND HASH / 282a24a4830f…

STATUS / FAIL — NO RETEST

Recall protegido

100.0%

9/9 registros relevantes protegidos · PASS

Exclusiones falsas

0

0.0% de los registros relevantes

Revisión manual

82.9%

233/281 registros · FAIL (límite ≤80%)

Exclusión automática

15.7%

44/281 registros recomendados para exclusión

Resultado global

FAIL

había que superar ambas puertas; no hay puntuación de exactitud compuesta

01 / Bloqueado antes de desvelar etiquetas

El fallo forma parte del resultado.

La seguridad pasó. La carga de trabajo, no. La puerta de carga falló por 2,9 puntos porcentuales. Tras ver las etiquetas no revisamos la política bloqueada ni volvimos a ejecutar el corpus.

  1. LOCK 01

    Bloqueo del corpus

    CD000996: Inhaled corticosteroids for bronchiectasis. El commit de origen, el hash del tema, el hash de la lista PMID y las 281 registros son públicos.

  2. LOCK 02

    Bloqueo de la política

    title-abstract-v3, deepseek-v4-flash, temperature 0.1, batch size 5. Modelo, temperatura, tamaño de lote y hashes de origen están fijos.

  3. LOCK 03

    Predicciones antes de etiquetas

    Las 281 decisiones sin etiqueta deben escribirse y cifrarse con hash antes de poder obtener los qrels.

  4. LOCK 04

    Seguridad más carga

    Las exclusiones falsas y el recall protegido se publican junto al recuento UNSURE y la tasa de revisión manual. Una cola segura pero inutilizable no aprueba.

02 / Revisar la pista de auditoría

Reproduzca el orden, los recuentos y el fallo.

Predicciones selladas (UTC)
2026-09-01T02:31:50.490Z
Etiquetas obtenidas / desveladas (UTC)
2026-09-01T02:31:50.492Z
Predicciones ciegas en bruto · SHA-256
282a24a4830f59e1ce7e1b91c449e7dcc9171464784a3075f0cfea827693f486
Predicciones puntuadaspredictions.csvLibro de exclusiones falsasfalse-excludes.csvLibro de revisión manualmanual-review.csvMétricas y umbralesmetrics.jsonOrden de ejecución y hash ciegorun.jsonHashes de corpus y origenmanifest.jsonPredicciones ciegasblinded-predictions.jsonPreregistro legible por máquinapreregistration.jsonPreregistro legible por personaspreregistration.md

Limitaciones

Solo se ha puntuado un holdout no tocado: un tema CLEF TAR, 281 registros y 9 registros relevantes de oro, con títulos y resúmenes. El recall protegido cuenta registros relevantes marcados INCLUDE o UNSURE; no significa que todos se hayan incluido correctamente.

La revisión manual aquí es UNSURE / todos los registros (233/281). Es un tamaño de cola, no tiempo de revisor medido. Las recomendaciones INCLUDE y EXCLUDE siguen necesitando supervisión humana. La exclusión automática es la tasa de recomendación del modelo, no permiso para descartar sin revisión.

Lo que esto NO demuestra

  • Recall garantizado o ahorro de carga en otros temas, corpus, modelos o versiones de política.
  • Exactitud de elegibilidad a texto completo, extracción de datos, validez del riesgo de sesgo o calidad de síntesis citada a nivel de afirmación.
  • Superioridad frente a Rayyan u otra herramienta: no es una comparación directa.
  • Un sustituto del cribado independiente dual o de las decisiones finales de inclusión y exclusión.

El corpus de 277 registros ya no es una reivindicación de rendimiento

Sus etiquetas informaron la revisión de la política, así que permanece solo como archivo de regresión tras el análisis de errores. El holdout no tocado se puntuó una vez. La puerta de carga fallida está publicada y el corpus no se reciclará como evidencia no tocada.

Abrir el archivo histórico de desarrollo