SLED Generating Benchmarks for Factuality Evaluation of Language Models Paper • 2307.06908 • Published Jul 13, 2023 • 8
Generating Benchmarks for Factuality Evaluation of Language Models Paper • 2307.06908 • Published Jul 13, 2023 • 8
text generation microsoft/biogpt Text Generation • Updated Feb 3, 2023 • 105k • 309 microsoft/MediPhi Text Generation • 4B • Updated Dec 15, 2025 • 715 • 24 google/medgemma-4b-it Image-Text-to-Text • 4B • Updated Oct 28, 2025 • 1M • 1.04k mistralai/Mistral-7B-v0.3 7B • Updated Jul 24, 2025 • 345k • 592
SLED Generating Benchmarks for Factuality Evaluation of Language Models Paper • 2307.06908 • Published Jul 13, 2023 • 8
Generating Benchmarks for Factuality Evaluation of Language Models Paper • 2307.06908 • Published Jul 13, 2023 • 8
text generation microsoft/biogpt Text Generation • Updated Feb 3, 2023 • 105k • 309 microsoft/MediPhi Text Generation • 4B • Updated Dec 15, 2025 • 715 • 24 google/medgemma-4b-it Image-Text-to-Text • 4B • Updated Oct 28, 2025 • 1M • 1.04k mistralai/Mistral-7B-v0.3 7B • Updated Jul 24, 2025 • 345k • 592