hubris
Логотип Arcee AI — провайдер модели Arcee AI: Virtuoso Large

Arcee AI: Virtuoso Large

arcee-ai/virtuoso-large
arcee-ai
Выпущена 5 мая 2025 г.|131К контекст|84,72 ₽/М вход|135,55 ₽/М выход

Virtuoso-Large — это флагманская универсальная LLM от Arcee с 72 миллиардами параметров, настроенная для решения задач кросс-доменного рассуждения, творческого письма и корпоративного QA. В отличие от многих 70-миллиардных аналогов, она сохраняет контекст в 128 тысяч токенов, унаследованный от Qwen 2.5, что позволяет ей обрабатывать книги, кодовые базы или финансовые отчёты целиком. Обучение включало дистилляцию DeepSeek R1, многоэпохальную контролируемую fine-tuning и финальную стадию выравнивания DPO/RLHF, что обеспечило высокую производительность в тестах BIG-Bench-Hard, GSM-8K и Needle-In-Haystack с длинным контекстом. Предприятия используют Virtuoso-Large в качестве «резервного» мозга в конвейерах Conductor, когда другие SLM показывают низкую уверенность. Несмотря на свой размер, агрессивные оптимизации KV-кэша позволяют поддерживать задержку первого токена в диапазоне нескольких секунд на узлах с 8× H100, что делает её практичным производственным решением.

Провайдер для Arcee AI: Virtuoso Large

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

arcee-ai
Контекст
131К
токенов
Макс. ответ
64К
токенов
Вход
84,72 ₽
за 1М токенов
Выход
135,55 ₽
за 1М токенов

Модальности

Вход:ТекстВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Together
84,72 ₽135,55 ₽

Поддерживаемые параметры

frequency_penaltylogit_biasmax_tokensmin_ppresence_penaltyrepetition_penaltystoptemperaturetool_choicetoolstop_ktop_p

Другие модели от arcee-ai