Выпуск новостей завершён 15 сентября 2026. Материалы сохранены на дату публикации. Перейти к инструкциям →

Архив · Полный материал · Tproger

Inception выпустила диффузионную модель Mercury 2.5

По данным Inception, Mercury 2.5 выдаёт 1 107 токенов в секунду и поддерживает контекст на 260 тысяч токенов. Модель доступна через Inception API, Baseten и OpenRouter. — Читать дальше « Inception выпустила диффузионную модель Mercury 2.5 »

Разработка · TprogerАнна Летова1 минута
Перейти к тексту ↓
Inception выпустила диффузионную модель Mercury 2.5
Tproger
Коротко о главномРазвернутьСвернуть
  1. 8 сентября 2026 года Inception выпустила Mercury 2.
  2. 5, быструю и недорогую языковую модель для поиска, RAG-систем, голосовых агентов и других задач с множеством вызовов.
  3. По оценке разработчика, новая версия на 40% превосходит Mercury 2 по уровню «интеллекта» и сопоставима с экономичными моделями GPT-5.

8 сентября 2026 года Inception выпустила Mercury 2.5, быструю и недорогую языковую модель для поиска, RAG-систем, голосовых агентов и других задач с множеством вызовов. По оценке разработчика, новая версия на 40% превосходит Mercury 2 по уровню «интеллекта» и сопоставима с экономичными моделями GPT-5.6 Luna (Low), Gemini 3.5 Flash-Lite и Claude Haiku 4.5.

По данным Inception, скорость Mercury 2.5 составляет 1 107 токенов в секунду на распространённых GPU NVIDIA. Модель поддерживает контекст объёмом 260 тысяч токенов. Среди заявленных возможностей есть настраиваемый режим рассуждений, параллельные вызовы инструментов и генерация JSON по заданной схеме.

Базовая цена составляет $0,20 за миллион входных и $0,75 за миллион выходных токенов. На старте Inception предлагает скидку 80%: цена снижена до $0,04 и $0,15 соответственно.

Модель рассчитана прежде всего на разработчиков поисковых и RAG-систем, голосовых агентов и помощников для программирования. В таких продуктах один пользовательский запрос может запускать много обращений к модели, поэтому задержка и стоимость быстро накапливаются.

Mercury 2.5 доступна через Inception API, Baseten и OpenRouter. Для корпоративных клиентов предусмотрены выделенные мощности, автомасштабирование, настройки хранения данных и средства обеспечения соответствия требованиям.

Источники