Mistral Launches Shieldstral: A Compact AI Safety Model That Outperforms Models 7 Times Its Size
Mistral launches Shieldstral, a compact 3-billion-parameter AI safety model that accepts natural language policies at inference time, outperforms models seven times its size including OpenAI's GPT-OSS-Safeguard, runs on a 16GB GPU, and is released open-weight under Apache 2.0.