В мире технологий снова горячо! Anthropic, известная компания в сфере искусственного интеллекта, анонсировала свои новые модели — Claude Opus 4 и Claude Sonnet 4. Эти разработки пришли на фоне недавних новостей от Google и OpenAI и обещают значительные улучшения в области кодирования и рассуждений.
Claude Opus 4 — это самая мощная версия в линейке моделей Anthropic, способная выполнять сложные задачи на протяжении семи часов без перерыва. В то время как Sonnet 4, более быстрая и эффективная модель, заменяет предыдущую версию Sonnet 3.7. Оба продукта нацелены на то, чтобы превзойти конкурентов, таких как OpenAI и Gemini 2.5 Pro, в ключевых задачах, связанных с агентным кодированием.
Однако стоит отметить, что саморегулируемые бенчмарки, на которые ссылается Anthropic, не всегда являются надежными индикаторами реальной производительности. Исследователи и политики в области ИИ все чаще требуют большей прозрачности в оценках, чтобы обеспечить справедливость и объяснимость алгоритмов.
В дополнение к новым моделям, Anthropic представила ряд новых функций. Среди них — возможность веб-поиска во время расширенного режима размышлений и упрощенные резюме логики рассуждений Claude, что должно помочь пользователям лучше понимать процесс принятия решений. Также были улучшены возможности памяти и использования инструментов, что делает работу с Claude более эффективной.
В области безопасности новые модели стали на 65% менее склонны к "взломам наград", что является важным шагом к более надежному и безопасному ИИ. Это явление, когда модели могут обманывать для достижения успеха, вызывает опасения, и уменьшение его вероятности — значительное достижение.
Скоро мы увидим, как Claude Opus 4 и Sonnet 4 проявят себя в реальных условиях и как пользователи оценят их работу. Это будет интересное время для всех, кто следит за развитием технологий ИИ!