Modelo aberto da OpenAI que transcreve e traduz fala, usado em Python ou no terminal

por OpenAI

Usa inteligência artificial
Nota dos leitores
Sem avaliaçõesAvaliar
No ranking
4ºÁudio e voz
Downloads pelo Flipters
0
Estrelas no GitHub
110 mil

Última versão: v20250625, de 25 de junho de 2025

Sobre o Whisper

Whisper é um modelo de reconhecimento de fala de código aberto criado pela OpenAI e distribuído como pacote Python com linha de comando. Atende desenvolvedores e pesquisadores que querem transcrever áudio na própria máquina.

Transcreve fala em vários idiomas, incluindo português, traduz para o inglês e identifica o idioma do áudio. Exige Python e ffmpeg; o modelo large pede cerca de 10 GB de memória de vídeo, e o tiny, cerca de 1 GB.

Principais recursos

  • Transcrição de fala em vários idiomas, incluindo português
  • Tradução de fala de outros idiomas para o inglês
  • Detecção automática do idioma falado
  • Seis tamanhos de modelo, do tiny ao large e turbo
  • Exporta em TXT, SRT, VTT, TSV e JSON

Avaliações de quem usa

Ainda sem avaliações

Usou o Whisper? Conte para quem está escolhendo.

Avalie o Whisper

Sua nota (obrigatória)

De 20 a 3.000 caracteres.0/3.000

Alternativas ao Whisper

  • whisper.cpp

    ggml.ai (Hugging Face) · Áudio, voz e transcrição

    Versão em C/C++ do Whisper para transcrever áudio localmente, com GPU e quantização

    • 54,2 mil no GitHub
  • Buzz

    Chidi Williams · Áudio, voz e transcrição

    Transcreve e traduz áudio offline no computador com Whisper e exporta legendas

    • 21,8 mil no GitHub
Ver todos em Áudio, voz e transcrição

Fontes

Ficha escrita pela redação do Flipters a partir das fontes acima, revisada em 6 de outubro de 2026. Preços e versões mudam: confira no site oficial antes de comprar. Como trabalhamos.