эйай ньюз | Telegram Webview: ai

эйай ньюз

Distill-Whisper от 🤗 — в x6 раз быстрее оригинала!

Моделька Whisper от OpenAI для транскрипции аудио в текст (я писал о ней тут и тут) бодро разлетелась по множеству проектов. Вот только самая крупная ее версия, Large-v2, имеет 1.5 млрд параметров и не является самой быстрой.

Но для деплоя в прод очень хочется иместь что-то такое же точное как Whisper-Large-v2, но быстрое.

Парни из Hugging Face взяли и дистиллировали эту модель, добившись ускорения инференса в 6 раз, с потерей в точности только на 1% WER.

#ликбез:
Если на пальцах, дистилляция - это процесс перегонки знаний из большой модели в более маленькую, чтобы ускорить инференс, но сохранить точность. Работает это потому, что большие модели легче обучить до нужной точности, но как правило количество нейронов в таких моделях избыточно и может быть сокращено после того как тренировка завершена (например, в с помощью дистиляции или прунинга).

Энкодер оставили как есть и заморозили, а в декодере оставили только 2 слоя, так как большинсво операций происходит именно в декодере. Далее эту прелесть дистиллировали на 20к часах опенсорсных аудио-записей.

Веса опубликуют через пару дней под MIT лицензией!

❱❱ Код
❱❱ Статья

@ai_newz

www.group-telegram.com/us/ai_newz.com/2291

26.9K viewsedited Nov 2, 2023 at 14:31

group-telegram.com/ai_newz/2291

Create: 2023-11-02
Last Update: 2025-02-25 08:24:46

BY эйай ньюз

Share with your friend now:
group-telegram.com/ai_newz/2291

Telegram | DID YOU KNOW?

Distill-Whisper от 🤗 — в x6 раз быстрее оригинала!