Агрегатор
Сервис с единым API к моделям сразу многих провайдеров: один ключ и один баланс вместо нескольких аккаунтов.
Связанные термины: Прокси-сервис, OpenAI-совместимый API
Короткие определения без маркетинговых формулировок.
Найдено 60 терминов
Ничего не найдено. Измените запрос или сбросьте фильтры.
Сервис с единым API к моделям сразу многих провайдеров: один ключ и один баланс вместо нескольких аккаунтов.
Связанные термины: Прокси-сервис, OpenAI-совместимый API
Ограниченный доступ без оплаты: лимиты запросов, урезанный список моделей или небольшой тестовый баланс.
Связанные термины: Подписка, Rate limit
База данных для хранения эмбеддингов и поиска по смысловой близости.
Токены запроса: инструкции, контекст и история диалога. Обычно заметно дешевле выходных.
Связанные термины: Выходные токены, Токен
Токены, которые модель генерирует в ответе. Как правило, в 2–5 раз дороже входных.
Связанные термины: Входные токены, Токен
Уверенный по форме, но фактически неверный ответ модели. Риск снижают через RAG и проверку источников.
Попытка обойти ограничения модели специально составленным запросом.
Связанные термины: Prompt injection, Отказ модели
Полная стоимость запроса с учётом наценки прокси, комиссии платёжной системы и НДС, если применимо.
Связанные термины: Наценка прокси, Комиссия платёжной системы
Процент, удерживаемый при оплате картой, СБП или криптовалютой сверх стоимости токенов.
Связанные термины: Итоговая цена, СБП
Максимальный объём текста (в токенах), который модель может обработать за один запрос, включая ответ.
Связанные термины: Токен, Обрыв контекста
Скидка за повторяющуюся часть запроса: провайдер кэширует её и тарифицирует по сниженной цене.
Связанные термины: Входные токены, System prompt
Задержка между отправкой запроса и началом ответа. При работе через прокси обычно выше из-за дополнительного сетевого узла.
Связанные термины: Streaming, Throughput
Сохранение сервисом текста запросов и ответов. Политику логирования стоит проверять до передачи чувствительных данных.
Связанные термины: Утечка данных, PII
Наименьшая сумма пополнения баланса, установленная сервисом.
Связанные термины: Прокси-сервис, Pay-as-you-go
Автоматическая проверка запросов и ответов на запрещённый контент; иногда блокирует и безобидные запросы.
Связанные термины: Отказ модели
Модель, принимающая помимо текста изображения, аудио или видео (например, GPT-4o или Gemini).
Дополнительная комиссия за доступ к модели через прокси-сервис поверх официальной цены. В каталоге показана в процентах.
Связанные термины: Официальная цена, Прокси-сервис
Ситуация, когда диалог превышает контекстное окно: модель «забывает» начало переписки или запрос отклоняется с ошибкой.
Связанные термины: Контекстное окно, Токен
Ответ, в котором модель отклоняет запрос из-за встроенных правил безопасности.
Связанные термины: Модерация контента, System prompt
Модель с опубликованными весами (Llama, DeepSeek и др.): её можно запускать на собственном оборудовании.
Связанные термины: Self-hosting, LLM
Цена провайдера модели (OpenAI, Anthropic и др.) без наценок посредников. База для сравнения цен в каталоге.
Связанные термины: Наценка прокси, Итоговая цена
Оплата фиксированной суммы за период вместо оплаты за токены. Типична для веб-чатов, а не для API.
Связанные термины: Pay-as-you-go, Бесплатный тариф
Посредник, продающий доступ к ИИ-моделям через собственный API и принимающий оплату способами, доступными в России.
Связанные термины: Агрегатор, Наценка прокси
Текстовый запрос к модели. Формулировка промпта напрямую влияет на качество и стоимость ответа.
Связанные термины: System prompt, Температура
Регулярная замена API-ключей, ограничивающая ущерб при возможной утечке.
Связанные термины: API-ключ
Система быстрых платежей Банка России: перевод по номеру телефона или QR-коду. Распространённый способ оплаты рублёвых сервисов.
Связанные термины: Комиссия платёжной системы, Минимальный депозит
Параметр случайности генерации: при 0 ответы почти детерминированы, с ростом значения — разнообразнее, но менее стабильны.
Минимальная единица текста для модели: слово, часть слова или отдельный символ. Использование API оплачивается по числу токенов.
Связанные термины: Токенизация, Контекстное окно, Входные токены
Разбиение текста на токены. Алгоритмы у моделей различаются, поэтому один и тот же текст даёт разное число токенов.
Связанные термины: Токен
Попадание содержимого запросов третьим лицам. Риск выше при работе через посредников с непрозрачной политикой.
Связанные термины: Логирование запросов, API-ключ
Стандартная единица тарификации API: стоимость миллиона входных или выходных токенов.
Связанные термины: Входные токены, Выходные токены
Секретная строка для авторизации запросов. Ключ нельзя публиковать: любой владелец может расходовать ваш баланс.
Связанные термины: API, Ротация ключей
Пакетная обработка запросов без требований к скорости: результат в течение часов, обычно вдвое дешевле обычных запросов.
Связанные термины: API, Официальная цена
Представление текста числовым вектором: близкие по смыслу тексты получают близкие векторы. Основа семантического поиска и RAG.
Связанные термины: RAG, Векторная БД
Дообучение готовой модели на собственных данных под конкретную задачу, стиль или формат ответов.
Связанные термины: LoRA, Открытая модель
Механизм, позволяющий модели вызывать описанные разработчиком функции: поиск, базы данных, внешние сервисы.
Связанные термины: API, JSON-режим
Графический процессор — основное оборудование для запуска нейросетей; определяет скорость и стоимость inference.
Связанные термины: Inference, Self-hosting
Процесс генерации ответа моделью на входной запрос. Именно за inference берётся плата при использовании API.
Связанные термины: Streaming, Латентность
Режим, в котором модель обязана вернуть синтаксически корректный JSON — удобно для интеграций и автоматической обработки.
Связанные термины: Function calling, SDK
Метод экономного дообучения: обучаются небольшие добавочные матрицы, а не все веса модели.
Связанные термины: Fine-tuning, Self-hosting
API, повторяющий формат OpenAI: для перехода на другой сервис достаточно заменить базовый URL и ключ.
Связанные термины: Эндпоинт, Прокси-сервис
Оплата по факту использования: списывается только стоимость реально израсходованных токенов.
Связанные термины: Подписка, Цена за 1M токенов
Персональные данные: имена, телефоны, адреса, номера документов. В запросы к API их стоит передавать только обезличенными.
Связанные термины: Утечка данных, Логирование запросов
Атака, при которой вредоносная инструкция внедряется в обрабатываемый текст и меняет поведение модели.
Связанные термины: System prompt, Джейлбрейк
Архитектура, при которой модель получает выдержки из внешней базы знаний и отвечает с опорой на них, а не только на обучение.
Связанные термины: Embedding, Векторная БД
Ограничение числа запросов или токенов за интервал времени. При превышении API возвращает ошибку 429.
Модель, строящая перед ответом внутреннюю цепочку рассуждений. Точнее в сложных задачах, но расходует больше выходных токенов.
Связанные термины: LLM, Выходные токены
Requests per minute — допустимое число запросов к API в минуту; одна из составляющих rate limit.
Связанные термины: Rate limit, TPM
Готовая библиотека для работы с API на конкретном языке программирования: скрывает детали HTTP-запросов.
Связанные термины: API, OpenAI-совместимый API
Запуск открытой модели на собственном или арендованном сервере вместо обращения к облачному API.
Связанные термины: GPU, Открытая модель
Режим получения ответа по частям, токен за токеном, в реальном времени — не дожидаясь полной генерации.
Связанные термины: Inference, Латентность
Служебная инструкция, задающая модели роль и правила ответа. Передаётся отдельно от сообщений пользователя, оплачивается как входные токены.
Связанные термины: Промпт, Prompt injection
Скорость генерации ответа, измеряется в токенах в секунду.
Связанные термины: Латентность, Inference
Параметр отбора: модель выбирает следующий токен из наиболее вероятных вариантов с суммарной вероятностью p.
Связанные термины: Температура
Tokens per minute — допустимое число токенов в минуту; вторая составляющая rate limit.
Связанные термины: Rate limit, RPM
Доля времени, когда сервис доступен. Например, 99,9% допускает около 43 минут простоя в месяц.
Связанные термины: Латентность, Прокси-сервис