Mistral tarafından geliştirilen Shieldstral, AI sistemlerinin girdileri ve çıktılarını güvenlik açısından analiz eden 3 milyar parametreli bir denetim modelidir. Model, sabit kategoriler yerine doğal dil biçiminde evet-hayır soruları kullanarak potansiyel güvenlik ihlallerini tespit eder.\n\nMuhtemelen en önemli özelliği, operatörlerin çalışma zamanında (runtime) kendi güvenlik kriterlerini belirleyebilmesidir. Bu, üçüncü taraf kategori sistemlerine bağımlı olma ihtiyacını ortadan kaldırır ve kuruluşlara daha fazla kontrol ve esneklik sağlar. Shieldstral, yerel ortamlarda çalışabildiğinden, veriler harici sunuculara gönderilmeden işlenebilir.\n\nDenetim modeli, bazı standart kıyaslamalarda kendisinden yedi kat daha büyük güvenlik modellerinin performansını eşitliyor. Bu, etkili güvenlik sistemlerini düşük hesaplama kaynakları ile çalıştırmanın mümkün olduğunu göstermektedir.
Mistral'ın 3B Shieldstral modeli, çok daha büyük güvenlik modellerinin performansını karşılıyor

Mistral, açık kaynaklı 3 milyar parametreli Shieldstral modelini duyurdu. Model, AI girdileri ve çıktılarını doğal dil soruları kullanarak güvenlik ihlalleri açısından kontrol ediyor ve kendisinden yedi kat daha büyük modellerin performansını bazı kıyaslamalarda eşiliyor.
Bu haber The Decoder ↗ kaynağındaki içerikten derlenerek hazırlanmıştır.
İlgili Haberler

DataSpecta'da 80 mühendis yerli dil modelleri ve kurumsal yapay zeka çözümleri geliştiriyor
Alibaba'nın Qwen 3.8 modeli iş kaybı karşıtı pazarlama stratejisiyle öne çıkıyor

Thinking Machines' Inkling Small, Büyüklükten Ziyade Verimliliğe Odaklanıyor

OpenAI'den Ayrılan Araştırmacı: Eğitim Verisi Pazarına 100 Milyar Dolar Akacak

Moonshot AI, Kimi K3 model ağırlıklarını ve altyapısını açık kaynak olarak yayınladı
