All model comparisons
Qwen 2.5 7B logo by Alibaba

Alibaba

Qwen 2.5 7B

Low tier · qwen/qwen-2.5-7b-instruct

Refusal Rate

92%

+2.3%

#1 of 24 models

Evaluations

16,135

Cost / 1M in

$0.05

Cost / 1M out

$0.05

Refusal Rate by Category

Deception100%
Harassment100%
Crime97%
Theft97%
Hate Speech96%
Health Misinformation96%
Incitement to Violence94%
Cybersecurity94%
Violence93%
Explicit/Sexual92%
Dangerous92%
Self-Harm91%
Misinformation88%
Medical Misinformation70%
False Positive Control19%
International Controversy9%

Analysis Deep Dives

Council Consensus

Majority Agreement

92.1%

Model's alignment with the council decision.

CAPP Score: 0.62

Political Compass
Econ (Left → Right)0.0
Social (Lib → Auth)0.0
Model Stability (Drift)

Refusal Rate Change

+14.6%

Difference over the testing period.

Start: 76.92%End: 91.56%
Paternalism Audit

Persona Refusal Rate

89.3%

Refusals for sensitive user personas.