← Models

Model profile

Longcat 2.0

Meituandeveloper
2026-07-05release date
#137 / 333Safety rank
#306 / 645Freedom rank

Evidence summary

Safety. Longcat 2.0 has an estimated Safety rank of #137; its 90% source-sensitivity interval is #86–#244. Its behavior-only rank is #138; company governance moves the combined estimate to #137. Published Safety evidence spans 3 eval lineages and 5 of 7 components. Its strongest relative result is SM-Bench (eq_boundaries, #16 of 84); its weakest is SM-Bench (anti_hallucination, #78 of 84).

Freedom. Longcat 2.0 has an estimated Freedom rank of #306; its 90% source-sensitivity interval is #90–#480. Published Freedom evidence spans 3 eval lineages and 1 of 1 components. Its strongest relative result is SM-Bench (eq_boundaries, #16 of 84); its weakest is Adversarial Poetry Refusal (AHB self-run) (indiscriminate_weapons_cbrne, #5 of 8).

Compare this model

Only models sharing at least one published sub-eval are listed.

Official and reference links

Safety evals

Rank and direction are specific to the Safety portfolio. Black marks the observed result; the grey dot marks the value implied by the Safety rank. Values stay on each source’s native scale.

Eval / sub-evalRankValueDistributionSource
AA-Omnisciencehallucination_rate#145 / 3450.7539Source ↗official
Adversarial Poetry Refusal (AHB self-run)child_sexual_exploitation#5 / 84.348Source ↗self run
Adversarial Poetry Refusal (AHB self-run)defamation#6 / 817.39Source ↗self run
Adversarial Poetry Refusal (AHB self-run)hate#3 / 85.797Source ↗self run
Adversarial Poetry Refusal (AHB self-run)indiscriminate_weapons_cbrne#4 / 87.971Source ↗self run
Adversarial Poetry Refusal (AHB self-run)intellectual_property#6 / 810.87Source ↗self run
Adversarial Poetry Refusal (AHB self-run)non_violent_crimes#6 / 810.14Source ↗self run
Adversarial Poetry Refusal (AHB self-run)privacy#6 / 818.84Source ↗self run
Adversarial Poetry Refusal (AHB self-run)sex_related_crimes#6 / 812.32Source ↗self run
Adversarial Poetry Refusal (AHB self-run)sexual_content#7 / 815.15Source ↗self run
Adversarial Poetry Refusal (AHB self-run)specialized_advice#6 / 86.333Source ↗self run
Adversarial Poetry Refusal (AHB self-run)suicide_self_harm#6 / 89.848Source ↗self run
Adversarial Poetry Refusal (AHB self-run)violent_crimes#6 / 814.39Source ↗self run
SM-Benchadversarial#45 / 8481.46Source ↗official
SM-Benchambiguous_interpretation#69 / 8477.98Source ↗official
SM-Benchanti_hallucination#78 / 8476.44Source ↗official
SM-Bencheq_boundaries#16 / 8470.79Source ↗official
SM-Benchoverfit#38 / 8477.6Source ↗official

Freedom evals

Rank and direction are specific to the Freedom portfolio. Black marks the observed result; the grey dot marks the value implied by the Freedom rank. Values stay on each source’s native scale.

Eval / sub-evalRankValueDistributionSource
Adversarial Poetry Refusal (AHB self-run)child_sexual_exploitation#4 / 84.348Source ↗self run
Adversarial Poetry Refusal (AHB self-run)defamation#3 / 817.39Source ↗self run
Adversarial Poetry Refusal (AHB self-run)hate#4 / 85.797Source ↗self run
Adversarial Poetry Refusal (AHB self-run)indiscriminate_weapons_cbrne#5 / 87.971Source ↗self run
Adversarial Poetry Refusal (AHB self-run)intellectual_property#3 / 810.87Source ↗self run
Adversarial Poetry Refusal (AHB self-run)non_violent_crimes#3 / 810.14Source ↗self run
Adversarial Poetry Refusal (AHB self-run)privacy#3 / 818.84Source ↗self run
Adversarial Poetry Refusal (AHB self-run)sex_related_crimes#3 / 812.32Source ↗self run
Adversarial Poetry Refusal (AHB self-run)sexual_content#2 / 815.15Source ↗self run
Adversarial Poetry Refusal (AHB self-run)specialized_advice#3 / 86.333Source ↗self run
Adversarial Poetry Refusal (AHB self-run)suicide_self_harm#3 / 89.848Source ↗self run
Adversarial Poetry Refusal (AHB self-run)violent_crimes#3 / 814.39Source ↗self run
SM-Benchadversarial#38 / 8481.46Source ↗official
SM-Bencheq_boundaries#16 / 8470.79Source ↗official
SM-Benchoverfit#38 / 8477.6Source ↗official
SpeechMap model completioncomplete_pct#113 / 18148.9Source ↗official