GPT vs. Claude Evaluation
Bewertung einer Stichprobe (20 % pro Run) zur Validierung der LLM-Screening-Entscheidungen.
Manuelles Abstract-Screening
Bewertung zugewiesener PubMed-Abstracts: Include / Exclude für das systematische Review.