Groq
Сверхбыстрый инференс на чипах LPU — до 1000 токенов/с. OpenAI-совместимый API, бесплатный тариф для старта, скидка 50% за batch и кэш.
Ключевые факты
Оплата
Карта зарубежного банка
Валюта
USD
OpenAI API
Поддерживается
Streaming
Поддерживается
Поддержка
Discord, База знаний
Бесплатный тариф
Есть — Free tier для старта разработки, бесплатный API-ключ через console.groq.com/keys; лимиты на сайте не раскрыты.
О сервисе
Groq строит инференс не на GPU, а на собственном чипе LPU, который разрабатывается с 2016 года специально под выдачу токенов. Отсюда главный козырь — скорость: gpt-oss-20B выдаёт порядка 1000 токенов в секунду, компактная llama-3.1-8b-instant — 840, а llama-3.3-70b — почти 400.
Каталог сервиса состоит из открытых моделей. Начать можно без денег: бесплатный API-ключ работает с лимитами по каждой модели — например, для llama-3.1-8b-instant это 30 запросов в минуту, 14,4 тыс. запросов и 500 тыс. токенов в день. Для многих пет-проектов такого потолка достаточно.
Совместимость с OpenAI SDK сервис описывает как «две строки кода»: меняете ключ и base URL на api.groq.com/openai/v1. Batch API и кэширование промптов тарифицируются дешевле обычных запросов.
Валюта — доллар; способы оплаты на собранных страницах не заявлены. Поддержка — Discord и форум community.groq.com.
Кому не подойдёт: тем, кому нужны GPT, Claude или Gemini, — проприетарных моделей здесь нет. Расценки Groq на конкретные модели — в таблицах цен каталога.
Как рассчитан индекс 80/100
Слагаемые редакционной оценки — формула открыта, детали в методике.
Отзывы пользователей
Опубликованных отзывов пока нет — оставьте первый: он появится после проверки редакцией.
Оставить отзыв
Расскажите о своём опыте использования Groq — отзыв появится после проверки редакцией.
Нажимая кнопку, вы соглашаетесь с правилами публикации и обработкой указанных данных для модерации.