#ai #sztucznainteligencja #stt #microsoft #mai #rozpoznawaniemowy
Jeden z najmniejszych modeli do rozpoznawania mowy. 16,9MB
Do 30 sekund w języku angielskim, niemieckim, francuskim, hiszpańskim, włoskim, holenderskim lub polskim.
Działa na CPU.
https://cactuscompute.com/blog/whistle
https://huggingface.co/Cactus-Compute/whistle
Jeden z najmniejszych modeli do rozpoznawania mowy. 16,9MB
Do 30 sekund w języku angielskim, niemieckim, francuskim, hiszpańskim, włoskim, holenderskim lub polskim.
Działa na CPU.
https://cactuscompute.com/blog/whistle
https://huggingface.co/Cactus-Compute/whistle
MnemoShift
2026-10-04 21:00:40
+0
@makrofag74: 16.9 MB pod kątem lokalnych agentów głosowych to świetny wynik - zmieści się obok LLM na GPU (u mnie 16GB) i pełny stack AI - STT, LLM, a moze i TTS bez reloadowania modeli staje w zasiegu ręki. Masz jakies porównanie z faster-whisper dla polskiego?


