Fish Audio в Vercel AI Gateway: месяц бесплатного синтеза речи и транскрипции

Четыре модели Fish Audio для озвучки и расшифровки появились в Vercel AI Gateway: Vercel запустила их с бесплатным периодом до 18 сентября. Подключаются через AI SDK 7 как обычная модель, без отдельного провайдера для синтеза речи или транскрипции.
После акции тарифы стандартные: $15 за миллион символов в text-to-speech и $0.36 за час аудио в speech-to-text. Сейчас оба сценария нулевые.
Озвучка через generateSpeech, расшифровка через transcribe. Аудио можно передать буфером, строкой base64 или по URL; сегменты в ответе несут текст и время начала и конца в секундах, вплоть до отдельных слов.
Четыре модели
fish-audio/s2.1-pro: синтез с низкой задержкой для стриминга, клонирование голоса по референсной записи.fish-audio/transcribe-1: транскрипция с длительностью аудио и сегментами с таймкодами.fish-audio/s2-pro: около 80 языков; inline-теги в тексте меняют подачу отдельных слов и фраз.fish-audio/s1: маркеры эмоций, тона и звуковых эффектов прямо в тексте.
Как не получить счёт после 18 сентября
Имя модели без суффикса (например fish-audio/s2.1-pro) бесплатно только до конца акции, потом включается обычный биллинг. Чтобы модель перестала отвечать после дедлайна, добавьте -free: fish-audio/s2.1-pro-free.
Без кода можно попробовать в playground Vercel: откройте список моделей, выберите Fish Audio и отправьте текст или аудио в браузере.
Источник: Fish Audio models now available on Vercel AI Gateway for free.