Краткий глоссарий для работы с LLM API через Heli: что такое токен, prompt и completion, как читать цену «за 1M токенов» и куда подставлять base URL getheli.ru/v1.
Токен (token)
Базовая единица текста для модели. Одно слово может быть одним токеном или несколькими; кириллица и код обычно «дороже» по числу токенов, чем короткий английский текст. Heli списывает баланс пропорционально количеству токенов на входе и выходе.
Prompt (вход)
Всё, что вы отправляете модели: system prompt, история диалога, прикреплённый контекст RAG. В API это поле messages или аналог; в биллинге — input / prompt tokens. На странице моделей цена входа указана как «Вход / 1M».
Completion (выход)
Текст, который сгенерировала модель в ответ. В биллинге — output / completion tokens. Выход часто дороже входа: длинный ответ стоит больше, чем короткий вопрос. Ограничивайте max_tokens, если нужен краткий ответ.
1M tokens (1 миллион токенов)
Стандартная единица тарификации в каталоге: цена за один миллион токенов в рублях. Пример: если вход стоит 40 ₽ / 1M, а ваш prompt — 500 токенов, списание ≈ 500 / 1 000 000 × 40 ₽. Точные тарифы — на /models.
Base URL
Адрес API без пути к конкретному методу. Для Heli:
https://getheli.ru/v1Клиент сам добавляет /chat/completions, /embeddings и т.д. Ключ передаётся как Authorization: Bearer sk-heli-…. Подробнее — в документации.
См. также
Попробуйте Heli за 30 секунд
Ключ sk-heli- и кабинет создаются сразу. После подтверждения почты — 50 ₽ на баланс.