APPERCASE
vasb@nccrepnfr.eh +7 499 302-34-17

Mistral представляет Shieldstral для легкой модерации AI-моделей с учетом политик

Французская компания Mistral AI представила Shieldstral — новый легковесный ИИ-модуль для модерации контента, который превосходит по эффективности другие модели, обеспечивая безопасность текстов и изображений.

В мире технологий, где безопасность контента становится все более актуальной, французская стартап-компания Mistral AI представила свою новейшую разработку — Shieldstral. Этот легковесный многомодальный ИИ-модуль способен классифицировать выходные данные AI-моделей, демонстрируя эффективность, превышающую другие крупные языковые модели в семь раз.

Shieldstral позволяет разработчикам формулировать политики в виде естественных языковых вопросов в реальном времени, а модель возвращает оценку безопасности. Она не требует специализированного переобучения и может обрабатывать как текст, так и изображения, предоставляя однозначный ответ в виде токена: "да" или "нет". Это делает результаты абсолютно ясными и понятными.

По данным компании, Shieldstral демонстрирует выдающиеся результаты в области текстовой безопасности, достигая или превышая показатели моделей, которые в семь раз больше по размеру, с общим средним баллом безопасности 84,9%. В области многомодальной безопасности изображений модель также показывает впечатляющие результаты — 83,8%, что превышает все оцененные базовые модели.

Работа Shieldstral основана на предоставлении разработчиками одной инструкции, которая четко формулирует задачу и контекст оценки. Например, можно задать вопрос: "Содержит ли эта реклама оскорбительный или небезопасный материал?" После этого модель анализирует предоставленный контент, будь то текст или изображение.

Интересно, что Shieldstral обучен различать, а не просто запоминать политики. Это означает, что в процессе рассуждений и классификации модель может применять две связанные, но разные политики и различать их. Например, она может определить, является ли контент инструкцией по созданию вредоносного ПО или обсуждением кибербезопасности, и соответственно отреагировать на каждую ситуацию.

С объемом всего в 3 миллиарда параметров, Shieldstral достаточно легковесен, чтобы работать на одном графическом процессоре с 16 ГБ памяти. Это позволяет ему эффективно функционировать даже в условиях ограниченных ресурсов, что делает его идеальным для использования в различных средах.

Mistral AI уверена, что Shieldstral станет важным шагом к более адаптивной модерации, которая сможет учитывать контекст, а не просто применять жесткие таксономические подходы. Это откроет новые горизонты для многоязычного и многомодального анализа безопасности в будущем.

Эта новость создана искусственным интеллектом на основе открытых данных и предназначена исключительно для информирования. Администрация сайта не несёт ответственности за её содержание. Новости агрегируются из различных источников, включая недружественные России страны и их средства массовой информации. Социальные сети Facebook, Instagram и WhatsApp принадлежат корпорации Meta, которая в России признана экстремистской организацией.

Администрация США разрабатывает систему на основе ИИ для борьбы с уклонением от уплаты пошлин, связанного с товарами, проходящими через третьи страны. Ожидается, что это поможет выявить незаконные схемы и защитить американский рынок.
На своей свадьбе Jarvis, известная как Human AI, представила уникальное платье в стиле стимпанк с 3D-элементами и металлическими деталями, отражающими её цифровую личность.
Открыт глобальный конкурс Capture-the-Flag в области ИИ и кибербезопасности с призовым фондом более ₹10 лакхов.
Написать нам