APPERCASE
vasb@nccrepnfr.eh +7 499 302-34-17

Инфраструктура вывода Archon обещает ускорить работу LLM без дополнительных затрат

Исследователи из Стэнфорда представили Archon — фреймворк, который ускоряет работу больших языковых моделей, не требуя дополнительного обучения. Это открытое решение может значительно снизить затраты на разработку AI.

В мире искусственного интеллекта появился новый игрок — Archon! Этот фреймворк, разработанный в лаборатории Scaling Intelligence при Стэнфордском университете, обещает значительно ускорить процесс получения ответов от больших языковых моделей (LLM), не требуя дополнительных затрат на обучение.

Archon использует алгоритм поиска архитектуры во время вывода (ITAS), что позволяет улучшить производительность моделей без необходимости их переобучения. Он является модельно-агностичным и открытым решением, что делает его идеальным для разработчиков, работающих с различными AI-системами.

С помощью Archon разработчики могут применять несколько техник вывода, что позволяет сократить количество моделей, необходимых для получения ответов. Это особенно актуально в условиях растущих затрат на разработку LLM, когда компании стремятся к более доступным решениям.

В тестах Archon показал впечатляющие результаты, обойдя такие модели, как GPT-4o и Claude 3.5 Sonnet, на 15.1 процентных пункта. Однако стоит отметить, что фреймворк лучше всего работает с моделями, имеющими 70 миллиардов параметров и более, что ограничивает его применение на текущий момент.

Несмотря на некоторые ограничения, Archon открывает новые горизонты для разработки высокопроизводительных моделей, позволяя ускорить процесс без дополнительных затрат на обучение и вывод. Это может стать настоящим прорывом в области AI!

Эта новость создана искусственным интеллектом на основе открытых данных и предназначена исключительно для информирования. Администрация сайта не несёт ответственности за её содержание. Новости агрегируются из различных источников, включая недружественные России страны и их средства массовой информации. Социальные сети Facebook, Instagram и WhatsApp принадлежат корпорации Meta, которая в России признана экстремистской организацией.

Liberty Global переходит на OneStream для автоматизации финансового планирования, что поможет компании справляться с растущей сложностью структуры и улучшить отчетность.
Спрос на вычислительные мощности графических процессоров (GPU) стремительно растет, что приводит к популяризации модели GPU как услуги (GPUaaS). Эта модель позволяет пользователям получать доступ к высокопроизводительным вычислениям без необходимости приобретения оборудования.
Опера и Similarweb продолжают развиваться в условиях сложной экономической ситуации, что влияет на рекламные расходы в индустрии интернет-контента. Тем не менее, компании адаптируются к новым условиям и используют возможности, предоставляемые искусственным интеллектом.
Написать нам