hubris
Логотип Arcee AI — провайдер модели Arcee AI: Trinity Large Thinking

Arcee AI: Trinity Large Thinking

arcee-ai/trinity-large-thinking
arcee-ai
Выпущена 1 апреля 2026 г.|262К контекст|24,85 ₽/М вход|96,02 ₽/М выход

Trinity Large Thinking — это мощная open source модель для рассуждений от команды Arcee AI. Она демонстрирует высокую производительность в PinchBench, агентских рабочих нагрузках и задачах на рассуждение. Видео запуска: https://youtu.be/Gc82AXLa0Rg?si=4RLn6WBz33qT--B7

Эта модель оптимизирована для агентских рабочих процессов и показывает наилучшие результаты, когда рассуждения сохраняются (так называемое чередующееся мышление). Узнайте, как сохранить рассуждения, в нашей документации:

Провайдер для Arcee AI: Trinity Large Thinking

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

arcee-ai
Контекст
262К
токенов
Макс. ответ
262К
токенов
Вход
24,85 ₽
за 1М токенов
Выход
96,02 ₽
за 1М токенов
Кеш чтение
6,78 ₽
за 1М токенов

Модальности

Вход:ТекстВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Parasail
24,85 ₽96,02 ₽6,78 ₽99,9 %
Arcee AI
28,24 ₽90,37 ₽6,78 ₽99,9 %

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokenspresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Другие модели от arcee-ai

Arcee AI: Virtuoso Large

Virtuoso-Large — это флагманская универсальная LLM от Arcee с 72 миллиардами параметров, настроенная для решения задач кросс-доменного рассуждения, творческого письма и корпоративного QA. В отличие от многих 70-миллиардных аналогов, она сохраняет контекст в 128 тысяч токенов, унаследованный от Qwen 2.5, что позволяет ей обрабатывать книги, кодовые базы или финансовые отчёты целиком. Обучение включало дистилляцию DeepSeek R1, многоэпохальную контролируемую fine-tuning и финальную стадию выравнивания DPO/RLHF, что обеспечило высокую производительность в тестах BIG-Bench-Hard, GSM-8K и Needle-In-Haystack с длинным контекстом. Предприятия используют Virtuoso-Large в качестве «резервного» мозга в конвейерах Conductor, когда другие SLM показывают низкую уверенность. Несмотря на свой размер, агрессивные оптимизации KV-кэша позволяют поддерживать задержку первого токена в диапазоне нескольких секунд на узлах с 8× H100, что делает её практичным производственным решением.

131К контекст·от 84,72 ₽/М