Accedi Pubblica

Valutazioni e benchmark di LLM

Set di test e benchmark per misurare la qualità di un modello, di un prompt o di un agente.

1 risultato/i