Developer
01.AI
6 indexed models; 4 currently meet the evidence threshold for the overall ranking. Together they have results from 17 evaluations.
Models by 01.AI
| Model | Evals | Components | Rank | Release date |
|---|---|---|---|---|
| Yi 34B Chat | 9 | 5/7 | 178 | 2023-11-23 |
| Yi 6B Chat | 5 | 5/7 | 194 | 2023-11-23 |
| Yi 1.5 9B Chat | 3 | 3/7 | 228 | 2024-05-13 |
| Yi 1.5 34B Chat | 4 | 4/7 | 234 | 2024-05-13 |
| Yi 1.5 6B Chat | 1 | 1/7 | — | 2024-05-13 |
| Yi 1.5 9B Chat 16K | 1 | 1/7 | — | 2024-05-13 |
Evaluations covering 01.AI models (17)
AILuminate General Purpose AI Chat · AIRBench 2024 Safety Scenarios · ChineseSafe · ChiSafetyBench · CMoralEval · COMPL-AI AI-Identity Disclosure · COMPL-AI LLM RuLES Multi-Turn Rule Following · COMPL-AI TensorTrust Goal-Hijacking Resistance · CRiskEval · DSPSafeBench · Enkrypt AI Safety Leaderboard · FinEval Financial Security Knowledge · S-Eval · SafeDialBench · SALAD-Bench · SORRY-Bench · SuperCLUE Safety
