Илон Маск продолжает удивлять мир своими достижениями в области технологий. Недавнее исследование, проведенное агрегатором казино Relum, выявило, что Grok, его AI-чат-бот, имеет самый низкий уровень "галлюцинаций" среди десяти крупных моделей, составив всего 8%. Для сравнения, ChatGPT показал 35%, а Google Gemini — 38%. Эти результаты подчеркивают фактическую точность Grok, несмотря на его меньшую популярность на рынке.
В ходе исследования оценивались чат-боты по нескольким критериям: уровень "галлюцинаций", пользовательские рейтинги, согласованность ответов и время простоя. Grok получил 4.5 балла за пользовательский рейтинг, 3.5 за согласованность и всего 0.07% времени простоя, что дало ему общий риск-скор всего 6. Для сравнения, ChatGPT, с его высокими показателями ошибок и простоя, получил максимальный риск-скор 99.
Как отметил главный продуктовый директор Relum, использование AI-чат-ботов в компаниях США растет, и многие сотрудники делятся конфиденциальной информацией с этими инструментами. Это подчеркивает важность выбора надежных решений, которые соответствуют специфическим потребностям бизнеса. Grok, с его низким уровнем "галлюцинаций", становится отличным выбором для тех, кто ищет точность в своих приложениях.
Таким образом, исследование показывает значительный разрыв между популярностью AI-чат-ботов и их фактической производительностью. Grok, несмотря на свою меньшую известность, оказывается сильным кандидатом для применения в сферах, где точность имеет критическое значение.