Tenha a qualidade do Wispr Flow por 0,30 $/mês

Tenha a qualidade do Wispr Flow por 0,30 $/mês

Escrito por

Alexander Winter

Alexander Winter

Como substituímos o Wispr Flow por cerca de 0,30 USD por mês

O Wispr Flow é uma excelente aplicação de ditado, mas custa cerca de 15 dólares por mês. Eis como obter a mesma qualidade por cerca de 0,30 dólares, com o OpenWhispr e a nossa própria chave da OpenAI.

Pontos-chave

  • O GPT-4o Mini Transcribe cobra por minuto de áudio, não por palavra nem por utilizador.

  • Duas horas mensais de áudio custam cerca de 0,20 a 0,35 dólares através da API.

  • Preencher o dicionário resolve melhor do que a correção por IA os erros que importam.

  • Por predefinição, a API da OpenAI não treina com o áudio enviado.

  • Mudar para um modelo local no OpenWhispr demora segundos para chamadas sensíveis.

Neste guia:

Secção

O Wispr Flow funciona muito bem, mas prende-me a cerca de $15 por mês por algo que, no fundo, é transcrição na nuvem. Esta é a configuração a que cheguei e que faz o mesmo por cêntimos.

A configuração

  1. A aplicação: uso o OpenWhispr, uma aplicação de ditado gratuita, de código aberto e multiplataforma. Sem subscrição, sem custo por utilizador. Funciona em Windows, macOS e Linux e suporta tanto modelos locais como fornecedores de cloud.

  2. O motor de transcrição: em vez da cloud gratuita limitada do OpenWhispr ou dos modelos locais mais lentos, introduzo a minha própria chave da API da OpenAI em Cloud Providers e escolho GPT-4o Mini Transcribe. Essa única alteração dá-me velocidade total de cloud, sem limite mensal.

  3. Limpeza: a cloud gratuita do OpenWhispr pode melhorar o texto, se quiser, por isso não acrescenta nada à fatura. Explico abaixo por que motivo a desativei.

OpenWhispr Speech-to-Text settings with Cloud Providers, OpenAI and GPT-4o Mini Transcribe selected

Porque custa quase nada

A OpenAI cobra a transcrição por minuto de áudio, não por palavra. Com cerca de 16.000 palavras por mês (cerca de duas horas de fala) e com o GPT-4o Mini Transcribe a $0.003 por minuto, a minha fatura fica entre $0.20 e $0.35. Mesmo que passasse para o GPT-4o Transcribe completo, continuaria a pagar apenas cerca de $0.70 por mês com esse volume.

Modelo

Preço por minuto

Custo mensal estimado (2 h de áudio)

GPT-4o Mini Transcribe

$0.003

~$0.20 a $0.35

GPT-4o Transcribe

Escalão superior

~$0.70

Subscrição do Wispr Flow

Valor fixo

~$15.00

Porque é tão bom como o Wispr Flow

O Wispr Flow executa a mesma classe de modelos de voz na cloud em servidores rápidos. Apontar o OpenWhispr diretamente para a OpenAI dá-me a mesma qualidade de modelo e a mesma velocidade de cloud. Pago apenas a utilização real, em vez de uma mensalidade fixa. Aplicações e serviços como o TurboScribe parecem rápidos porque executam modelos da classe Whisper em GPUs na cloud, que é exatamente o que a API me dá.

Para ditado do dia a dia, a diferença de qualidade entre o Wispr Flow e esta configuração é negligenciável. A diferença de preço é de cerca de 50 vezes.

Em vez da limpeza, o dicionário

Não uso a limpeza de texto por IA para isto. O maior salto de qualidade vem de preencher o dicionário personalizado do OpenWhispr com palavras da minha marca, nomes de produtos, nomes de empresas e termos técnicos. É isso que corrige os erros que realmente contam no meu fluxo de trabalho. Desativo a limpeza de texto e invisto esses dois minutos no dicionário.

OpenWhispr Language Models settings with text cleanup turned off

É a mesma lógica por detrás das ferramentas gratuitas de compressão de imagem que uso: escolhas baratas e direcionadas superam opções dispendiosas por defeito.

A única contrapartida

O meu áudio é enviado para a OpenAI. Por defeito, a API não treina com o áudio enviado, mas os dados saem do meu dispositivo. Em reuniões sensíveis com clientes, volto a colocar o OpenWhispr num modelo local. Para o ditado do dia a dia, a API é o melhor equilíbrio entre velocidade, precisão e custo.

O resultado final

~$0.30 por mês versus $15 por mês. A mesma experiência. Cerca de 50 vezes mais barato. Se ditar mais, as contas continuam a bater certo, porque a API escala com a utilização, não com o número de utilizadores.

Autor

Alexander Winter

Alexander Winter

Fundador e autor

Alexander é o fundador da HIVER e escreve sobre design, branding e a criação de produtos que as pessoas gostam de usar. Tem uma forte ligação ao universo SaaS, ao marketing tecnológico e ao branding.

Trabalha connosco diretamente.

Para projetos maiores, soluções à medida ou uma transformação completa, a HIVER trabalha marcas da estratégia ao lançamento.

Trabalha connosco diretamente.

Para projetos maiores, soluções à medida ou uma transformação completa, a HIVER trabalha marcas da estratégia ao lançamento.

Trabalha connosco diretamente.

Para projetos maiores, soluções à medida ou uma transformação completa, a HIVER trabalha marcas da estratégia ao lançamento.