В мире искусственного интеллекта появился новый игрок — Archon! Этот фреймворк, разработанный в лаборатории Scaling Intelligence при Стэнфордском университете, обещает значительно ускорить процесс получения ответов от больших языковых моделей (LLM), не требуя дополнительных затрат на обучение.
Archon использует алгоритм поиска архитектуры во время вывода (ITAS), что позволяет улучшить производительность моделей без необходимости их переобучения. Он является модельно-агностичным и открытым решением, что делает его идеальным для разработчиков, работающих с различными AI-системами.
С помощью Archon разработчики могут применять несколько техник вывода, что позволяет сократить количество моделей, необходимых для получения ответов. Это особенно актуально в условиях растущих затрат на разработку LLM, когда компании стремятся к более доступным решениям.
В тестах Archon показал впечатляющие результаты, обойдя такие модели, как GPT-4o и Claude 3.5 Sonnet, на 15.1 процентных пункта. Однако стоит отметить, что фреймворк лучше всего работает с моделями, имеющими 70 миллиардов параметров и более, что ограничивает его применение на текущий момент.
Несмотря на некоторые ограничения, Archon открывает новые горизонты для разработки высокопроизводительных моделей, позволяя ускорить процесс без дополнительных затрат на обучение и вывод. Это может стать настоящим прорывом в области AI!