throughput · циклы
Mercury 2 — чрезвычайно быстрый reasoning-LLM и первая диффузионная языковая модель (dLLM): вместо последовательной генерации токенов она формирует и уточняет несколько токенов параллельно, достигая очень высокой пропускной способности. Идеальна для агентских циклов и throughput-задач, где критична скорость; контекст до 128k токенов. Доступна по OpenAI-совместимому API через Mostline, оплата в рублях.
Цены ориентировочные; списание — по фактическому расходу (usage).
Любой OpenAI-совместимый клиент. Укажите базовый адрес и модель по имени:
curl https://api.mostline.ru/v1/chat/completions \
-H "Authorization: Bearer $MOSTLINE_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"mercury-2","messages":[{"role":"user","content":"Привет"}]}'