Skip to content
Transcriwise
Central de Ajuda

Guia visual verificado

Tutorial completo do Transcriwise

Do primeiro arquivo aos fluxos avançados: veja o que cada página faz, como configurar cada ajuste de transcrição e quais cuidados considerar no estado atual do produto.

Saber mais: todas as funcionalidades →
17 capítulosCapturas reais do produtoRotas e passos reaisRevisado para a interface publicada em julho de 2026

As capturas usam contas de demonstração, sem dados pessoais, e podem aparecer em inglês ou português conforme a área registrada. Alguns recursos dependem do plano, da função do usuário, de saldo e de integrações autorizadas.

1. Primeiros passos

Defina seu perfil, idioma principal e a primeira ação. O checklist continua acessível pelo menu para retomar a configuração, e ao concluir o app oferece um tour guiado.

/transcription/onboarding
Página Primeiros passos
Primeiros passos concluídos: volte ao painel ou refaça o onboarding. O tour guiado fica em Configurações › Rever tour guiado.

Passo a passo

  1. 1Escolha o segmento (Jurídico, Reuniões, Educação ou Geral) e confirme o idioma da interface.
  2. 2Selecione a primeira ação: Enviar arquivo, Gravar ao vivo ou explorar os Templates.
  3. 3Conclua o checklist. Você pode voltar a esta página pelo menu lateral e refazer o tour a qualquer momento.

O que esta área oferece

  • O segmento aplica um preset de template e um perfil de fluxo às suas preferências.
  • O progresso fica associado à sua conta; pular o onboarding não impede o uso de nenhuma página.
  • Um tour guiado destaca as áreas principais do app e pode ser revisto quando quiser em Configurações › Rever tour guiado.

Atenção no estado atual

  • As três primeiras ações são Enviar arquivo, Ao vivo e Templates — não há “conectar calendário” nem “exemplo” neste passo.

2. Nova transcrição e todos os ajustes

Abra o diálogo Nova transcrição pelo ícone do dashboard. É aqui que ficam TODOS os ajustes reais de transcrição (a página Configurações apenas espelha os padrões). Envie áudio/vídeo, cole URL ou importe da nuvem, e configure reconhecimento, formatação, avançados e material de estudo.

/transcription
Diálogo Nova transcrição expandido
Tipo, catálogo dos 9 provedores do produto (filtrado conforme o tipo selecionado e a configuração do ambiente), modelo, origem do conteúdo e idiomas.
Idioma de saída, estilo e modo de formatação
Idioma de saída (traduz o documento), estilo do documento, template visual e modo de formatação.
Preset de processamento e falantes
Preset de processamento (controle principal), Tabelas Pro, diarização, nomes dos falantes e voz narrativa.
Configurações avançadas (parte 1)
Alta precisão (Beam Search), áudio ruidoso, baixar vídeo e área de conhecimento.
Configurações avançadas (parte 2)
Termos específicos, template de formatação, cache RAW, auto-aplicar correções e nível de auditoria.
Configurações avançadas (parte 3)
Nível de auditoria, nível de raciocínio, perfil de execução, tabelas, estilo, emojis e prompt customizado. O seletor de Modelo de IA aparece logo acima quando a conta tem mais de um modelo disponível.
Material de Estudo (parte 1)
Ativar material, resumo executivo, mapa mental e exercícios de fixação.
Material de Estudo (parte 2)
Mini mapas e questionários após cada tópico, diagramas visuais, ilustrações por IA e glossário de termos.
Origem do conteúdo e dropzone de arquivos
Arquivos, URLs públicas ou Importar da nuvem; a dropzone aceita 25 formatos de áudio (mp3, wav, m4a, flac, ogg, opus…), vídeo (mp4, mov, mkv, webm, avi…) e documentos (txt, md, pdf, docx).
Apostila ilustrada a partir de slides
Gerar apostila ilustrada: fonte dos slides (anexar/extrair do vídeo), dropzone (PDF/PPTX/JPG/PNG, máx. 50), modelos Pro, perfil e análise visual por IA.
Falantes e participantes
Diarização, identificação de nomes e voz narrativa.
Campos da Prática Jurídica (parte 1)
Modo de formatação jurídico, jurisdição, tipo de audiência, gerar ata formal, número do processo, vara/tribunal, comarca/cidade, data, observações e objetivo jurídico.
Campos da Prática Jurídica (parte 2)
Permitir discurso indireto, ata resumida, timestamps no resultado, participantes da audiência (papéis), prompt customizado e diarização — sempre ligada em audiência e legendas.

Passo a passo

  1. 1Clique em Nova transcrição e escolha a origem: Arquivos, URLs públicas ou Importar da nuvem.
  2. 2Escolha o Tipo de transcrição: Geral, Prática Jurídica, Reunião ou Legendas (SRT/VTT).
  3. 3Selecione o Provedor (topo do diálogo, 9 engines) e, para Whisper, o modelo; depois o idioma do áudio e o idioma de saída.
  4. 4Escolha o Modo de formatação e o Preset de processamento — o controle principal do job (Rápido, Padrão, Profissional ou Premium).
  5. 5Abra Configurações avançadas para reconhecimento, análise de conteúdo, auditoria e correções; e Material de Estudo para apêndices didáticos.
  6. 6Use o botão ⤢ para expandir o diálogo em tela cheia, confira o custo estimado e clique em Transcrever.

O que esta área oferece

  • ▸ CONTROLES PRINCIPAIS
  • Acompanhar ao vivo — acompanha a transcrição em tempo real enquanto o job processa.
  • Tipo de transcrição — escolhe o conjunto de modos: Geral, Prática Jurídica, Reunião ou Legendas (SRT/VTT).
  • Provedor de transcrição — o motor de reconhecimento (no topo), 9 engines (Whisper, Deepgram, AssemblyAI, ElevenLabs, Soniox, Gladia, Voxtral, iFlytek, Alibaba Cloud); a disponibilidade pode variar conforme a conta/configuração. Escolha por precisão × velocidade × cobertura de idiomas × custo.
  • Modelo Whisper — quando o provedor é Whisper, seleciona Large V3 Turbo (menor latência) ou Large V3 (mais preciso).
  • Origem do conteúdo — Arquivos, URLs públicas ou Importar da nuvem (a nuvem exige uma integração conectada).
  • Dropzone de arquivos — arraste ou clique; aceita 25 formatos: áudio (mp3, wav, m4a, aac, flac, ogg, opus, aiff…), vídeo (mp4, mov, mkv, webm, avi, wmv…) e documentos (txt, md, pdf, docx).
  • Idioma do áudio — o idioma falado; a lista varia conforme o provedor (100+ no Whisper/ElevenLabs/Gladia; subconjuntos menores nos demais engines); orienta o reconhecimento de fala (distinto do idioma de saída).
  • Idioma de saída (formatado) — a IA de formatação traduz o documento final para o idioma escolhido.
  • Estilo do documento — define o estilo visual do preview, especialmente das tabelas.
  • Template visual final (preview/export) — regra aplicada no fim do processamento; herda o padrão global se você não escolher.
  • Modo de formatação — define o resultado (Apostila, Fidelidade, Entrevista…). Fidelidade traz Estilo Didático/Natural e o opt-in Destaques editoriais.
  • ▸ PRESET E TABELAS
  • Preset de processamento — o CONTROLE PRINCIPAL: Rápido/Padrão/Profissional/Premium. Combina modelo base + perfil de execução + auditoria recomendada; ajustar algo abaixo torna o job “Personalizado”.
  • Tabelas Pro — gera os quadros-síntese com o modelo avançado, mantendo o corpo no modelo econômico (custo pequeno, tabelas mais precisas).
  • ▸ APOSTILA ILUSTRADA (a partir de slides)
  • Gerar apostila ilustrada — combina slides com a transcrição para produzir uma apostila visual com ilustrações alinhadas ao conteúdo.
  • Modelos Pro na apostila ilustrada — usa o modelo avançado na camada visual (mais pontos, qualidade superior).
  • Fonte dos slides — anexar slides ou extrair do vídeo.
  • Dropzone de slides — PDF, PPTX, JPG, PNG (máximo de 50 arquivos).
  • Perfil da apostila — Completa, Compacta ou Estudo.
  • Análise visual por IA — a IA lê slides com pouco texto, diagramas, gráficos e capturas para melhorar o alinhamento da apostila.
  • ▸ FALANTES E PARTICIPANTES
  • Diarização (identificar falantes) — separa as falas de pessoas diferentes.
  • Identificar nomes dos falantes — substitui os rótulos genéricos (Speaker A/B) pelo nome real no cabeçalho de cada turno.
  • Número estimado de falantes — ajuda a separar vozes em painéis com vários participantes, sem limitar o máximo.
  • Lista de falantes esperados (roster) — cole nomes + cargo + grupo; o AssemblyAI usa como ground truth e aumenta a precisão (e serve de ranking para outros provedores).
  • Voz narrativa do docente/palestrante — na apostila, troca o tom impessoal de manual por narrativa que credita o docente; na fidelidade, reescreve da 1ª pessoa (RAW) para a 3ª pessoa atribuindo as ideias ao docente/palestrante.
  • Participantes esperados — define os papéis para rotular as falas automaticamente (ex.: Professor, Aluno, Entrevistador).
  • Identificar por — rotular cada fala por Papel ou por Nome.
  • ▸ CONFIGURAÇÕES AVANÇADAS
  • Alta precisão (Beam Search) — mais lento, mas ideal para termos técnicos complexos.
  • Áudio ruim/ruidoso — reduz ruído e equilibra o volume antes do reconhecimento de fala.
  • Baixar vídeo para o player — baixa o vídeo (720p) de URLs (YouTube, Vimeo) para reproduzir; desligado = só áudio (mais rápido).
  • Área de conhecimento — organiza o contexto da transcrição e filtra os dicionários disponíveis; tem subárea opcional.
  • Termos específicos — nomes próprios, siglas e termos técnicos que precisam ser reconhecidos corretamente (separados por vírgula).
  • Análise do conteúdo (Speech Understanding) — entidades, sentimento, capítulos, frases-chave e resumo; oferecida apenas por AssemblyAI/Gladia/ElevenLabs (nenhum provedor tem as cinco análises); as análises da Gladia estão incluídas no preço base, enquanto AssemblyAI/ElevenLabs consomem pontos de IA.
  • Template de formatação — aplica um template de instruções durante o processamento (ver biblioteca ou criar novo customizado).
  • Usar cache RAW — reaproveita transcrições brutas anteriores do mesmo arquivo.
  • Revisão humana opcional da estrutura — o job entra em checkpoint antes da formatação final e abre um modal de revisão.
  • Auto-aplicar correções estruturais — aplica automaticamente as correções do auto_fix_apostilas após a auditoria.
  • Auto-aplicar correções de conteúdo (IA) — aplica correções de conteúdo via IA (requer RAW; usar com cautela).
  • Nível de auditoria — off (só formatação), fidelidade (inclui a checagem preventiva) ou completa (liga também legal e fontes).
  • Nível de raciocínio — profundidade de raciocínio do modelo de formatação.
  • Perfil de execução — Qualidade máxima, Seguro, Rápido ou Turbo.
  • Desabilitar tabelas/extras — suprime as tabelas e os extras por tópico.
  • Personalizar estilo completo — você controla estilo + tabelas em vez do padrão do modo.
  • Usar emojis nos destaques — emojis apenas nos blocos de citação (desligado por padrão).
  • Prompt customizado (Estilo completo) — com Personalizar estilo completo ligado, o prompt SUBSTITUI as regras de estilo e tabelas do modo (você controla parágrafos, destaques e quadros-síntese); sem ele, personaliza apenas TABELAS/EXTRAS preservando o tom do modo; carregável da biblioteca de prompts.
  • Dicionários de termos — ficam DENTRO das Configurações avançadas (não no corpo principal).
  • ▸ MATERIAL DE ESTUDO
  • Ativar material de estudo — liga um pacote recomendado com resumo, mapa mental, exercícios e glossário.
  • Resumo executivo — síntese com tópicos curtos e citações literais, inserida antes do conteúdo (prompt customizável).
  • Mapa mental do conteúdo — visão hierárquica de todos os tópicos ao final; número de mapas configurável + escopo/fallback de prompt.
  • Exercícios de fixação — múltipla escolha, verdadeiro/falso e dissertativa; IA decide entre 5–60 ou quantidade manual de 1–200.
  • Mini mapa mental após cada tópico — bullets hierárquicos logo após cada seção.
  • Questionário rápido após cada tópico — cinco questões por seção, com gabarito.
  • Diagramas visuais por tópico — fluxogramas Mermaid; no DOCX/PDF renderiza como imagem PNG ou, se indisponível, como esboço textual.
  • Ilustrações por IA — ilustrações conceituais fiéis à transcrição no apêndice final; alta fidelidade, ilustrar conceitos e ilustrar fluxogramas.
  • Glossário de termos — definições dos termos técnicos ao final do documento.
  • Material de estudo Pro — gera quiz, resumos, mapas e glossário com o modelo avançado (qualidade superior, custo maior); desligado, usa o modelo econômico padrão.
  • ▸ CAMPOS DA PRÁTICA JURÍDICA (quando o tipo é Jurídico)
  • Modo de formatação (jurídico) — Audiência, Depoimento, Perícia, Notarial, Sentença, Acórdão ou Voto.
  • Jurisdição — o país/sistema jurídico (Brasil, EUA, União Europeia…).
  • Tipo de audiência (ramo) — o ramo processual (Cível, Trabalhista, JEC, Criminal…).
  • Gerar ata formal — estrutura a transcrição como ata oficial conforme o tipo selecionado.
  • Número do processo/caso — identificação do processo (opcional).
  • Vara/Tribunal, Comarca/Cidade, Data da audiência, Observações — metadados do ato.
  • Objetivo jurídico — petição inicial, contestação, alegações finais, recurso, sentença ou extrajudicial.
  • Permitir discurso indireto — reescreve as falas em estilo indireto (ata).
  • Permitir ata resumida — condensa as falas mantendo decisões e próximos passos.
  • Incluir timestamps no resultado — timestamps no texto formatado; o RAW sempre os mantém para navegação e auditoria.
  • Participantes da audiência — papéis para rotular cada fala (Juiz, Advogado, Testemunha) por Papel ou Nome.
  • Prompt customizado (jurídico) — instruções extras específicas do ato.

Atenção no estado atual

  • Os padrões salvos em Configurações apenas espelham estes controles; o que vale para o job é o que você define aqui, no diálogo.
  • Fidelidade Natural desliga tabelas, quadros e material de estudo para preservar um texto limpo.
  • As Análises de conteúdo, o Premium e o modelo avançado consomem mais pontos de IA — confira o custo estimado antes de transcrever.

3. Provedores de transcrição: guia completo

O provedor de ASR é quem transforma áudio em RAW; a IA de formatação trabalha depois, sobre esse RAW. Este capítulo explica os recursos expostos de cada motor e como escolher sem confundir reconhecimento, tradução e formatação.

/transcription · /transcription/live

Comparativo dos provedores

ProvedorOnde funcionaMelhor usoRecursos no TranscriwiseCuidados
WhisperArquivosAulas longas, português, áudio técnico e máxima fidelidadeLarge V3 Turbo para velocidade; Large V3 para maior precisão; termos e pré-processamento de áudioNão oferece as análises de conteúdo nativas dos provedores cloud
AssemblyAIArquivos, Ao vivo e TranscriBotReuniões, múltiplos falantes, code-switching e contexto técnicoUniversal-3.5 Pro/Universal-2, diarização, roster, prompt/keyterms, Voice Focus e Speech UnderstandingDiarização, Voice Focus e análises podem ser adicionais cobrados
DeepgramArquivos, Ao vivo e TranscriBotBaixa latência e vocabulário médicoFlux ao vivo com fim de turno; Nova-3 geral/Medical em arquivos; keyterms, diarização e redação de PII nas rotas compatíveisFlux ao vivo não possui diarização; escolha Medical somente para conteúdo clínico
ElevenLabs ScribeArquivos e Ao vivoLegendas, timestamps por palavra e eventos sonorosScribe v2, 99+ idiomas, keyterms, contexto anterior, eventos sonoros, VAD/manual e entidadesKeyterms e entidades podem ter custo adicional; Scribe v1 é legado
SonioxArquivos, Ao vivo e TranscriBotCode-switching, legendas e tradução simultâneaSTT Async/Realtime v5, endpoint sensitivity, tradução one-way/two-way e diarizaçãoAtivar tradução ao vivo pode substituir o provedor escolhido
GladiaArquivos e Ao vivoÁudio multilíngue e análises sem custo adicional do recursoSolaria-1 generalista em batch/live; Solaria-3 para batch europeu monolíngue; diarização e análisesSolaria-3 exige um idioma fixo e não aceita code-switching; arquivos acima de 135 min são divididos
VoxtralArquivos e Ao vivoMultilíngue com contexto, timestamps e baixa latênciaVoxtral Mini Transcribe V2 em batch; Voxtral Realtime com atraso configurávelA diarização pertence ao batch; a rota ao vivo não separa falantes
iFlytekArquivos e Ao vivoChinês e idiomas cobertos pelo engine contratadoEngine LLM com português validado; Basic depende de backend e autorização específicosDisponibilidade e idiomas dependem do entitlement da conta
Alibaba CloudArquivos e Ao vivoLotes longos, chinês e detecção de emoção/ruídoQwen3-ASR Flash batch/realtime, emoção e tempos de sentença; Fun-ASR Flash contextual, Fun-ASR/Paraformer e SenseVoiceQwen não possui diarização nativa; Fun-ASR/Paraformer dependem de região e workspace

Passo a passo

  1. 1Defina primeiro o fluxo: arquivo gravado (batch), captura Ao vivo ou TranscriBot para Meet/Zoom/Teams.
  2. 2Escolha o idioma do áudio. No AssemblyAI, Universal-3.5 Pro prioriza precisão, code-switching e diarização conjunta em 18 idiomas; Universal-2 amplia a cobertura para 99 idiomas.
  3. 3Adicione Área de conhecimento, dicionários e Termos específicos para nomes, siglas e vocabulário técnico. O limite e a forma de envio variam por provedor.
  4. 4Ative apenas os adicionais necessários: diarização, identificação de falantes, análises de conteúdo, tradução ao vivo ou Voice Focus.
  5. 5Confira o custo estimado antes de iniciar. Provedor, duração e adicionais podem alterar o consumo; o modelo de formatação é cobrado em uma etapa separada.

O que esta área oferece

  • ▸ ASSEMBLYAI EM ARQUIVOS (ASYNC)
  • Universal-3.5 Pro — modelo recomendado nos 18 idiomas compatíveis, com code-switching dentro da mesma fala e diarização conjunta ao reconhecimento.
  • Universal-2 — alternativa de ampla cobertura para 99 idiomas; o Transcriwise pode usá-lo como fallback quando o idioma não pertence ao conjunto do Universal-3.5 Pro.
  • Prompt contextual — Área de conhecimento, subárea e contexto do job orientam o reconhecimento de nomes e expressões ambíguas sem alterar o conteúdo falado.
  • Keyterms — Termos específicos e dicionários reforçam nomes próprios, siglas e vocabulário técnico; no Universal-3.5 Pro, o motor aceita uma lista maior que no Universal-2.
  • Diarização — separa os participantes; Número estimado de falantes ajuda o modelo, e a lista de falantes esperados permite mapear rótulos genéricos para pessoas ou papéis conhecidos.
  • Speech Understanding — opções de redação de PII/LGPD, entidades, sentimento, capítulos automáticos e frases-chave. Cada opção aparece no diálogo e pode consumir pontos adicionais.
  • RAW rastreável — timestamps, palavras e turnos retornados pelo provedor alimentam o RAW/RAW limpo, a navegação do player e as auditorias de fidelidade.
  • ▸ ASSEMBLYAI AO VIVO E TRANSCRIBOT
  • Universal-3.5 Pro Realtime — disponível na captura Ao vivo e no bridge do TranscriBot, com texto parcial/final e separação de falantes quando a diarização está ativa.
  • Perfil de latência — Menor latência responde mais cedo; Equilibrado é o padrão; Máxima precisão espera mais contexto antes de fechar cada trecho.
  • Voice Focus — redução de ruído focada na voz principal: Microfone próximo para headset/celular e Sala/ambiente para microfone distante. Deixe desligado em áudio limpo ou quando sons não vocais forem relevantes.
  • Contexto do agente — envia a pergunta ou o contexto imediatamente anterior para reduzir erros em respostas curtas, nomes, e-mails e termos técnicos; não é uma instrução para reescrever a fala.
  • Termos importantes — lista de palavras priorizadas durante a sessão ao vivo. Use grafias exatas e evite listas genéricas ou excessivas.
  • Sync para clipes curtos — quando habilitado na implantação, o backend pode usar automaticamente a rota síncrona em ditados e notas de voz curtos; não há um seletor separado na interface.
  • ▸ RECURSOS AO VIVO DOS DEMAIS PROVEDORES
  • Deepgram Flux — detecta o fim de cada turno e permite ajustar termos importantes, limiar e tempo de espera. É otimizado para conversa; não oferece diarização nativa nessa rota. Nova-3 permanece disponível para arquivos e TranscriBot.
  • ElevenLabs Scribe v2 Realtime — aceita até 50 keyterms curtos, contexto imediatamente anterior, VAD ou confirmação manual, texto não literal e detecção de entidades (PII, PHI, PCI, entre outras). Keyterms e entidades podem ter cobrança adicional.
  • Soniox Realtime v5 — oferece code-switching, diarização e tradução em uma ou duas direções. O perfil de fim de fala controla quanto silêncio é esperado antes de fechar o trecho.
  • Mistral Voxtral Realtime — oferece transcrição incremental com latência configurável. Menor atraso responde antes; maior atraso usa mais contexto. A rota ao vivo não fornece diarização.
  • Alibaba Qwen3-ASR Flash Realtime — aceita contexto da aula/reunião e VAD configurável. A transcrição pode alternar idiomas, mas não inclui diarização nativa.
  • Gladia — Solaria-1 é o modelo generalista para batch e ao vivo, com code-switching; Solaria-3 pode ser ativado na implantação para arquivos com um único idioma fixo e volta automaticamente ao Solaria-1 quando a configuração é incompatível. Entidades, sentimento, capítulos e resumo pertencem ao processamento de arquivo.
  • iFlytek Realtime — usa o engine contratado para reconhecimento e, quando habilitado, interpretação chinês → inglês. Idiomas e duração dependem do entitlement da conta.
  • ▸ O QUE NÃO É ASR
  • Idioma de saída e Modelo de IA pertencem à formatação: Gemini, Claude, OpenAI, DeepSeek, Qwen ou GLM reorganizam, traduzem e auditam o RAW depois da transcrição; trocar esse modelo não faz o áudio ser reconhecido novamente.
  • Tradução ao vivo pertence ao fluxo de streaming compatível e pode forçar a troca para Soniox. Ela é diferente de escolher um idioma de saída para o documento final.
  • Pocket Voices e LLM Gateway são produtos separados da AssemblyAI e não fazem parte do fluxo de transcrição do Transcriwise.

Atenção no estado atual

  • Não ative todos os adicionais por padrão: eles podem elevar o custo e, em áudio limpo, não necessariamente melhoram o RAW.
  • O melhor provedor depende do áudio real. Para jobs críticos, teste um trecho curto com dois motores e compare o RAW antes de processar horas de conteúdo.

4. Resultado, análise, auditoria e exportação

Abra um job concluído para revisar o texto, ouvir o áudio, comparar versões, ver a análise por IA, auditar achados e exportar o documento.

/transcription?job={id}
Dashboard com jobs de transcrição
O dashboard reúne criação, jobs e visualização do resultado.
Visualização do resultado
Resultado com player, timestamps e as abas Preview, Exportar, Traduzir, Auditoria e IA.
Diálogo de exportação
Exportação: idioma, formato (DOC/PDF/TXT/MD/Google Docs), fonte do conteúdo, template visual, timestamps e falantes.
Aba de auditoria
Auditoria: nota de fidelidade, diagnósticos e central de revisão para conferir cada evidência.
Preview do documento em PDF
Documento (PDF): o documento formatado renderizado como ficará na exportação, com capa e template visual aplicados.
RAW Limpo e o seletor de layout do RAW
RAW Limpo: o reconhecimento sem formatação por IA, já sem hesitações e repetições. Acima, o seletor RAW VIEW alterna os layouts Clássico e Studio; à direita, o controle de parágrafos, falantes, timestamps e a sanitização por IA.
RAW no layout Clássico, com player
RAW no layout Clássico: texto corrido com timestamps e falantes, ao lado do player. Com Seguir mídia ligado, o texto acompanha a reprodução; o ajuste de sync (±40 ms) corrige defasagem entre áudio e legenda.
RAW no layout Studio
RAW no layout Studio: um cartão por trecho, com intervalo de tempo e campo de tradução por segmento; à direita, player e painel com Configurações, Traduzir, Notas e Resumo (modo segmentos ou texto, fonte, timestamps e rolagem automática).
Editor do documento formatado
Editor do documento formatado (botão Editar): abre o DOCX do job num editor completo — títulos, tabelas, imagens, notas de rodapé, sumário, comentários e controle de alterações. Salvar é explícito.

Passo a passo

  1. 1Abra um job pelo Dashboard ou por Arquivos.
  2. 2Use o player para acompanhar o áudio e os timestamps.
  3. 3Alterne entre Preview, Exportar, Análise (Speech Understanding), Traduzir, Auditoria e IA.
  4. 4Na Auditoria, leia cada achado, compare com o RAW e aplique apenas as correções adequadas.
  5. 5Na Exportação, escolha conteúdo, idioma, falantes, timestamps, agrupamento e template visual.
  6. 6Baixe em TXT, Markdown, SRT, VTT, DOCX, PDF ou Google Docs; JSON fica disponível para prática jurídica e reunião. Você também pode copiar para a área de transferência.

O que esta área oferece

  • O RAW permanece como fonte de referência para as versões formatadas e derivadas.
  • ▸ AS TRÊS VISÕES DO PREVIEW
  • Documento (PDF) — o documento já formatado pela IA, renderizado como sairá na exportação (capa, títulos, tabelas e template visual).
  • RAW — o reconhecimento literal, palavra por palavra, do jeito que o provedor devolveu. É a fonte de referência para conferir qualquer trecho.
  • RAW Limpo — o mesmo RAW sem hesitações, repetições e vícios de fala, sem passar pela formatação por IA. Fica entre o literal e o documento formatado.
  • Layout do RAW (RAW VIEW) — Clássico mostra o texto corrido com timestamps e falantes; Studio abre a leitura em colunas com navegação por trechos. Só muda a apresentação, não o conteúdo.
  • Controles do RAW — zoom, tamanho do parágrafo, exibir falantes, cadência dos timestamps e Sanitizar trechos com IA para limpar passagens pontuais.
  • Editor do documento formatado (Editar) — abre o DOCX do job num editor completo (títulos, tabelas, imagens, notas de rodapé, sumário, comentários, controle de alterações, cabeçalho e rodapé). Também há Editar Falantes para renomear quem fala.
  • Traduzir — gera uma versão do documento em outro idioma, que passa a conviver com o original; as versões traduzidas também podem ser baixadas pelo menu do arquivo em Arquivos.
  • A aba Análise traz entidades, sentimento, capítulos e frases-chave quando o provedor os fornece.
  • Relatórios jurídicos (Evidências, Validação, Timeline, Contradições) aparecem para os tipos de audiência.
  • O cabeçalho do resultado também permite Compartilhar e Adicionar à base de conhecimento.

Atenção no estado atual

  • Confirme achados de IA contra o áudio ou o RAW antes de incorporá-los.
  • Salvar uma edição do texto exige a ação de salvar exibida no editor; não presuma salvamento automático.

5. Arquivos e organização

Pesquise transcrições, organize-as em pastas e aplique ações individuais ou em lote.

/transcription/files
Biblioteca de arquivos
Visualização em cartões ou tabela, com busca, pastas e upload.

Passo a passo

  1. 1Pesquise por nome, idioma ou status.
  2. 2Alterne entre cartões e tabela. No celular, use os cartões.
  3. 3Crie uma pasta e mova os jobs pelo menu de ações ou pela seleção em lote.
  4. 4Abra o menu de um arquivo para visualizar, renomear, baixar, compartilhar, criar nota, mover ou excluir.
  5. 5Baixe também as versões traduzidas por idioma (TXT/MD/DOCX/PDF/SRT) direto do menu do arquivo.

O que esta área oferece

  • A página carrega até 200 jobs por vez.
  • Pastas possuem um nível de organização; a tabela permite ordenar.
  • O compartilhamento temporário, quando habilitado, cria um link com validade de sete dias.

6. Transcrição ao vivo

Capture o microfone ou o áudio de uma aba, acompanhe parciais e traduções, e salve o resultado ao final.

/transcription/live
Página de transcrição ao vivo
AssemblyAI ao vivo com latência, Voice Focus, diarização, contexto do agente e termos importantes.

Passo a passo

  1. 1Escolha Microfone ou Áudio da aba. Para uma aba, compartilhe a aba correta e marque o compartilhamento de áudio.
  2. 2Defina idioma automático ou fixo e, se necessário, tradução em uma ou duas direções.
  3. 3Escolha o provedor e a duração estimada; verifique se há saldo suficiente para iniciar.
  4. 4Inicie (Espaço) e acompanhe texto parcial, texto final, falantes e métricas. Renomeie falantes (nome + papel) durante a sessão.
  5. 5Ao terminar, use Parar e Salvar (o áudio é salvo junto); Cancelar (Esc) descarta a sessão.

O que esta área oferece

  • Mais de 99 idiomas, detecção automática e legenda sobreposta com 4 modos (off, CC, tradução, bilíngue).
  • Provedores em tempo real: ElevenLabs, AssemblyAI, Soniox, Deepgram Flux, iFlytek, Gladia, Mistral Voxtral e Alibaba Qwen (conforme disponibilidade).
  • Painel de custo em tempo real e cópia do original ou da tradução durante a captura.
  • Ajustes por provedor: termos-chave, contexto, entidades, confirmação manual, perfil de fim de fala ou atraso de streaming. O relay seguro mantém as chaves no servidor e encerra a conexão no limite reservado.

Atenção no estado atual

  • Ligar a tradução força um provedor compatível (centrado em Soniox) e pode trocar o provedor selecionado.
  • O seletor Meet/Zoom/Teams orienta a interface; ele não publica legendas nativas nessas plataformas por si só.
  • SRT e VTT ficam disponíveis depois que a sessão é salva como job.

7. Calendário e TranscriBot

Sincronize reuniões, escolha o motor por reunião, ative o auto-transcrever e configure como cada encontro será reconhecido, formatado e automatizado.

/transcription/calendar
Calendário de reuniões
Hub de reuniões: conecte Google/Microsoft Calendar em Integrações para sincronizar reuniões e configurar o TranscriBot.
Padrões do TranscriBot
Padrões do TranscriBot: abas Resultado, Reconhecimento, Templates e Automação (captura em português).

Passo a passo

  1. 1Conecte Google Calendar ou Microsoft Calendar em Integrações.
  2. 2No cartão da reunião, escolha o motor (bot ao vivo, bot pós-reunião ou importação de gravação) e ative o auto-transcrever se quiser o fluxo automático.
  3. 3Use Configurar/Padrões do TranscriBot para definir Resultado, Reconhecimento, Templates e Automação.
  4. 4Aplique o perfil só à reunião, a toda a série ou como padrão para novas reuniões.
  5. 5No horário, lance o TranscriBot (ou deixe o auto-dispatch) e acompanhe a captura RAW, a formatação e a auditoria.

O que esta área oferece

  • Perfis combinam captura ao vivo, pós-reunião ou importação de gravação com qualquer documento final compatível.
  • Defina idioma, provedor avançado, qualidade, diarização, falantes, papéis, timestamps, dicionários e templates; a aba Automação gera resumo e itens de ação.
  • Idioma do resultado traduz o documento; um pré-template orienta a base e vários pós-templates geram documentos derivados do mesmo RAW.
  • Meet recebe legendas como vídeo do bot; Zoom usa uma URL manual de captions; Teams usa a URL CART informada pelo organizador.

Atenção no estado atual

  • Templates e dicionários são congelados quando o bot lança o job.
  • Importações de gravações prontas podem usar um perfil fixo de reunião em vez do perfil completo do evento.

8. Integrações e automações

Conecte armazenamento, e-mail, calendários, videoconferência, CRM, gestão e colaboração; o catálogo separa conectores nativos de rotas Zapier/webhook.

/transcription/integrations
Catálogo de integrações
Catálogo pesquisável, filtrável por trilhas e ordenado por conectados.

Passo a passo

  1. 1Para adicionar o Zoom, pesquise por Zoom, clique em Conectar, entre na conta Zoom desejada e autorize os acessos exibidos na tela OAuth.
  2. 2Depois de conectado, use o calendário para sincronizar reuniões ou, em Nova transcrição, selecione Importar da nuvem > Zoom para escolher uma gravação em nuvem e iniciar o processamento.
  3. 3Para remover o Zoom, volte a Integrações, abra o cartão Zoom, clique em Desconectar e confirme. Você também pode revogar o aplicativo em Zoom App Marketplace > Manage > Added Apps.
  4. 4Para conectores marcados como Nativa, pesquise a integração e conclua o OAuth ou informe o token solicitado. Um selo Requer configuração indica que o administrador ainda precisa habilitar credenciais no backend.
  5. 5Expanda uma integração conectada para testar a conexão e configurar ações automáticas.
  6. 6Em serviços de nuvem, use a importação no diálogo Nova transcrição.
  7. 7Para uma rota Zapier/webhook, crie Webhooks by Zapier > Catch Hook, copie a URL, conecte o card Zapier no Transcriwise e cole essa URL.
  8. 8Depois, expanda o card Zapier conectado e crie uma auto-action send_event para o evento desejado; no Zapier, mapeie o payload recebido para o aplicativo de destino.

O que esta área oferece

  • Drive, OneDrive, Dropbox e Gmail podem fornecer arquivos para transcrição.
  • Zoom importa gravações; Meet importa artefatos nativos; calendários alimentam a agenda do TranscriBot.
  • Inclui CRM (HubSpot, Salesforce, Zoho), gestão (Trello, Asana, Monday, Jira), colaboração (Slack, Notion, Confluence) e exportação (Google Docs, Word).

Atenção no estado atual

  • O catálogo pode exibir integrações cujo uso depende de configuração administrativa, plano ou aprovação OAuth.
  • Os cards Via Zapier/webhook não são conectores diretos com o aplicativo indicado. O app oficial Transcriwise no Zapier ainda está em Preview por convite, e as receitas exibidas não são Zaps instaláveis prontos.

9. Notas

Crie notas livres com editor rico e busca por título ou conteúdo.

/transcription/notes
Editor de notas
Lista e editor lado a lado no desktop; abas no celular.

Passo a passo

  1. 1Clique em Nova nota e defina o título.
  2. 2Use títulos, negrito, itálico, listas, citação e alinhamento no editor.
  3. 3Aguarde o indicador de salvamento antes de trocar de nota ou sair.
  4. 4Pesquise pelo título ou por palavras do conteúdo.

O que esta área oferece

  • Salvamento automático após uma pequena pausa na edição.
  • Ordenação pela atualização mais recente; abas Notas/Editor no celular.

Atenção no estado atual

  • A exclusão atual não pede confirmação. Verifique o título antes de excluir.

10. Studio e base de conhecimento

Converse com uma biblioteca de transcrições e gere materiais de estudo ou síntese a partir de fontes selecionadas. No menu, esta área aparece como “Studio”.

/transcription/knowledge-base
Studio com fontes e gerações
Chat fundamentado nas fontes e gerações (mapa mental, flashcards, guia de estudo, FAQ, perguntas).
Chat do Studio
Chat do Studio: biblioteca global ou KB curada, fontes em escopo e sugestões de perguntas.

Passo a passo

  1. 1Escolha a biblioteca global ou uma base de conhecimento curada.
  2. 2Selecione as fontes e abra Chat para fazer perguntas com citações.
  3. 3Alterne entre Chat (perguntas com citações) e Studio (geração de conteúdo) pelo seletor no topo do painel.
  4. 4No Studio, escolha o que gerar — Mapa Mental, Flashcards, Guia de Estudo, FAQ/QA, Questões, Audio Overview, Briefing Doc ou Timeline — e o modelo de IA da geração.
  5. 5Abra o resultado gerado e salve o material quando a ação estiver disponível.

O que esta área oferece

  • Respostas apresentam fontes e relevância dos trechos recuperados.
  • A seleção trabalha com até 12 documentos por geração; a biblioteca lista até 200 jobs.

Atenção no estado atual

  • A rota é /transcription/knowledge-base (o menu a chama de “Studio”).
  • Relevância não é uma nota de veracidade. Abra as fontes e confirme afirmações importantes.

11. Templates e prompts

Reutilize modelos visuais, estruturais e instruções de IA na formatação de documentos.

/transcription/templates
Biblioteca de templates
Catálogo por categoria, domínio e jurisdição.
Diálogo Novo Template
Criação de template: nome, categoria, modo, descrição e instrução (prompt de IA) — captura em português.

Passo a passo

  1. 1Alterne entre Templates de formatação e Prompts.
  2. 2Filtre o catálogo e abra um modelo para visualizar sua estrutura.
  3. 3Duplique um modelo do sistema ou crie um template personalizado.
  4. 4Use o template em uma nova transcrição; para aplicar a um resultado existente, use a tela do resultado.

O que esta área oferece

  • Templates de estilo alteram apresentação; templates estruturais definem seções e campos obrigatórios.
  • Modelos do sistema são somente leitura e podem ser duplicados.

Atenção no estado atual

  • A criação de templates exige plano Pro ou superior.
  • Prompts personalizados desta aba ficam no navegador atual.

12. Bases e documentos derivados

Organize transcrições em bases curadas, converse com as fontes e gere materiais derivados no Studio unificado.

/transcription/knowledge-base
Bases de conhecimento no Studio
Bases: use a biblioteca inteira ou uma KB curada e gere materiais a partir dos documentos em escopo.
Diálogo Nova Knowledge Base
Criar KB: dê um nome à base e adicione as transcrições que devem formar seu escopo.

Passo a passo

  1. 1Clique em Criar KB, dê um nome à base e confirme.
  2. 2Selecione as transcrições que devem ficar em escopo para essa base.
  3. 3Use Chat para fazer perguntas fundamentadas nas fontes selecionadas.
  4. 4No Studio, gere Guia de Estudo, FAQ, Timeline, Flashcards, Mapa Mental, Áudio, Briefing, Tabela de Revisão ou Canvas.

O que esta área oferece

  • Biblioteca global e bases curadas com escopo próprio de documentos.
  • Flashcards, mapa mental, áudio em podcast/narração, Tabela de Revisão e Canvas vinculados às fontes.

Atenção no estado atual

  • A Tabela de Revisão abre em página própria (/review-tables/{id}), é somente leitura e sem exportação direta.
  • Se nenhuma fonte é marcada no Chat, o comportamento atual pode usar todas as fontes. Revise a seleção antes de enviar.

13. Workspace, equipe e segurança

Gerencie organização, membros, papéis personalizados, residência de dados, criptografia e log de auditoria.

/transcription/workspace
Equipe e segurança do workspace
Aba Equipe: membros, papéis, plano ativo e convites para o workspace.
Segurança do workspace
Residência de dados (padrão, GDPR ou LGPD), níveis de proteção e recursos sensíveis; os controles avançados de criptografia aparecem nos perfis Confidencial e Restrito.

Passo a passo

  1. 1Confira o workspace ativo e os dados da organização, na aba Equipe.
  2. 2Convide membros e atribua papéis; admins podem criar papéis a partir de um catálogo de 12 permissões.
  3. 3Na aba Segurança, defina residência de dados (Padrão/Europa-GDPR/Brasil-LGPD) e criptografia (modo, chave dedicada, ARN KMS/BYOK).
  4. 4Use a aba Auditoria (quando sua função permite) para ver o log com metadados e avisos de conformidade.

O que esta área oferece

  • Gestão de membros e convites; construtor de papéis personalizados por workspace.
  • Residência de dados GDPR/LGPD, criptografia com BYOK/KMS e perfis de segurança (Padrão/Confidencial/Restrito).
  • Toggles de live/bot e log de auditoria com avisos de residência para o modo Brasil-LGPD.

Atenção no estado atual

  • Auditoria e segurança são controladas por função/permissão; perfis avançados e BYOK dependem do plano Enterprise.

14. Configurações, padrões, dicionários, plano e API

Controle preferências gerais, padrões de novos jobs, vocabulário próprio, plano/consumo e chaves de API.

/transcription/settings
Configurações gerais
Aba Geral: aparência, idioma da interface e saída. A página tem cinco abas — Geral, Defaults de Transcrição, Perfis de automação, Dicionários e Plano e Billing.
Opções de formatação nas configurações
Formatação: estilo do documento, nível de raciocínio, perfil de execução, área de conhecimento e prompt customizado.
Defaults de transcrição
Padrões que espelham o diálogo: Transcrição, Formatação, Processamento, Geral e Material de Estudo.
Dicionários personalizados
Tela de dicionários: crie vocabulários pessoais, do workspace ou do sistema.
Aba Perfis de automação
Perfis de automação: os mesmos ajustes de Nova transcrição, salvos como perfil e aplicados aos jobs iniciados pelas automações (a origem e a pasta vêm da automação, não do perfil).
Aba Plano e Billing
Plano e Billing: resumo do ciclo, franquia de IA (pontos) e de ASR (horas, com minutos ponderados), estado do overage e crédito por documento. A sub-aba API Keys fica no topo deste painel (valores borrados nesta captura).

Passo a passo

  1. 1Em Geral, ajuste idioma da interface, tema, fonte, template visual padrão e formato de download.
  2. 2Em Defaults de Transcrição, configure o ponto de partida de novos jobs (espelha o diálogo).
  3. 3Em Perfis de automação, defina como as entradas automáticas (e-mail e pasta vigiada) serão reconhecidas e formatadas.
  4. 4Em Dicionários, crie um vocabulário, cole termos ou importe TXT, CSV, TSV ou JSON.
  5. 5Em Plano e Billing, acompanhe pontos, minutos, excedente, faturas e créditos por documento.
  6. 6Ainda em Plano e Billing, abra a sub-aba API Keys para criar chaves com os menores escopos necessários.

O que esta área oferece

  • Até 1.000 termos únicos por dicionário, com dedução sem diferenciar maiúsculas/minúsculas.
  • Dicionários pessoais, do workspace e do sistema, conforme a função do usuário.
  • Chaves de API com escopos de transcrição, tradução, resumo e leitura; o segredo aparece só na criação.

Atenção no estado atual

  • As chaves de API ficam DENTRO de Plano e Billing → aba API Keys; não há aba “API” separada.
  • Os padrões espelham o diálogo; revise-os na própria tela de Nova transcrição antes de transcrever.

15. IA do job e AI Companion

Use a IA dentro de uma transcrição concluída para resumir, conversar, extrair ações, aplicar templates e reaproveitar o conteúdo.

/transcription?job={id}&result_tab=ia
Aba IA do resultado
IA do job: Resumo, Follow-up, Chat, Ações, Templates, Repurpose e Insights sobre uma única transcrição.
Chat da IA do job
Chat: perguntas guiadas por ângulo (resumo, decisões, trechos relevantes, próximos passos), contadores de pontos-chave, ações e citações, e o painel de evidências ancoradas na transcrição.
Ações extraídas da transcrição
Ações: cada item vem com prioridade, responsável e prazo editáveis, com contador de concluídos (títulos borrados nesta captura).
Aplicar template ao resultado
Templates: aplique um modelo da biblioteca ao job já concluído, com busca por nome/categoria e a opção de usar o schema jurídico (extrai hints antes e valida a estrutura depois).
Repurpose de conteúdo
Repurpose: transforma a transcrição em outro formato (briefing, post, thread), com tom, idioma, limite de palavras, instruções extras e presets salvos.
AI Companion flutuante
AI Companion compacto (botão flutuante): chat sobre o job atual sem sair da tela em que você está.

Passo a passo

  1. 1Abra um job concluído e selecione IA.
  2. 2Escolha Resumo, Follow-up, Chat, Ações, Templates, Repurpose ou Insights.
  3. 3No Chat, selecione o modelo, use uma pergunta guiada ou escreva a sua.
  4. 4Verifique citações, falantes e timestamps antes de usar a resposta.
  5. 5Use o botão flutuante para abrir o AI Companion compacto no desktop.

O que esta área oferece

  • Resumo, pontos-chave, tópicos, decisões e próximos passos.
  • Follow-up com tom, destinatários, edição e envio por Gmail/Outlook conectado.
  • Ações com responsável, prazo, prioridade; templates estruturais, repurpose e insights de sentimento, fala e palavras-chave.

Atenção no estado atual

  • A conversa usa um único job, não várias fontes. Para múltiplas fontes, use o Studio e uma base curada.
  • Jobs longos enviam uma janela limitada do texto e do histórico para o modelo.

16. Biblioteca jurídica e rotas adicionais

A biblioteca integrada permite consultar os modelos jurídicos usados pelos modos de audiência. Outras rotas técnicas ou administrativas não fazem parte do fluxo comum.

/transcription/hearing-templates
Biblioteca de modelos jurídicos
Biblioteca somente leitura: 75 modelos organizados em 14 jurisdições, com busca e filtro.

Passo a passo

  1. 1No fluxo principal, abra Nova transcrição, escolha Prática Jurídica e selecione Audiência, Notarial etc.
  2. 2Escolha a jurisdição e o tipo de ato para preencher o modelo correspondente.
  3. 3Use a biblioteca separada apenas para consultar modelos por jurisdição, nome ou categoria.

O que esta área oferece

  • Biblioteca integrada com modelos organizados em 14 jurisdições.
  • Plano e cobrança ficam na aba canônica Configurações → Plano e Billing.

Atenção no estado atual

  • A biblioteca separada é somente leitura e não inicia uma transcrição, nem representa homologação oficial.
  • O painel /transcription/api-usage está em preparação e não deve ser usado como fonte de consumo.
  • Rotas administrativas exigem função de administrador e não fazem parte deste tutorial.

17. Ajuda, idiomas e guias de reunião

Consulte perguntas frequentes, o guia CART do Microsoft Teams e este tutorial. Toda a interface do app está traduzida em 7 idiomas.

/transcription/help
Central de Ajuda
FAQ, suporte, guia visual do Teams e link para este tutorial.

Passo a passo

  1. 1Abra Ajuda no menu lateral para respostas rápidas dentro do app.
  2. 2Em Configurações → Geral, troque o idioma da interface (Português, English, Español, Français, 中文, Italiano, Deutsch).
  3. 3No guia do Teams, ative Provide CART Captions e cole a URL CART na configuração da reunião.
  4. 4Use a Central de Ajuda pública para abrir este tutorial sem precisar entrar na conta.

O que esta área oferece

  • Interface totalmente traduzida em 7 idiomas (pt/en/es/fr/zh/it/de), selecionáveis nas Configurações.
  • Guia CART adaptado ao fluxo do Teams e do Transcriwise, FAQ contextual e canal de suporte.
  • Tutorial bilíngue e responsivo para desktop e celular.

Matriz rápida de tipos e modos

O tipo de transcrição escolhe o fluxo especializado; o modo de formatação define a estrutura do resultado. Use a tabela antes de iniciar o job. Os ajustes avançados refinam reconhecimento e apresentação, mas não devem contradizer o objetivo escolhido.

ResultadoControleObjetivoComportamento esperado
Fidelidade naturalModo de formataçãoLimpeza editorial discretaNão acrescenta conteúdo; desliga tabelas, quadros e material de estudo.
Fidelidade didáticaModo de formataçãoTexto fiel e pedagógicoDestaques editoriais e dicas só aparecem com o opt-in editorial ativo.
ApostilaModo de formataçãoMaterial de estudo estruturadoPode usar recursos pedagógicos, mapas, exercícios, glossário e ilustrações.
EntrevistaModo de formataçãoPerguntas, respostas e falantesAtive a diarização e, quando souber, informe a quantidade de pessoas.
Palestra/CongressoModo de formataçãoExposição organizada por tópicosPreserva os falantes: a diarização é ligada automaticamente pelo modo.
PodcastModo de formataçãoConversa pronta para leituraPreserva turnos e organiza o conteúdo editorialmente.
RAW / sem formataçãoModo de formataçãoRegistro direto do reconhecimentoSem formatação por LLM; pode manter falantes e timestamps.
Geral (aula, entrevista, palestra)Tipo de transcriçãoFluxo padrão do produtoTipo padrão: mantém disponíveis os sete modos de formatação acima.
JurídicoTipo de transcriçãoDocumento conforme a práticaSubstitui o modo de formatação por audiência, depoimento, perícia, notarial, sentença, acórdão ou voto.
Reunião/AtaTipo de transcriçãoDecisões, temas e próximos passosCompatível com captura manual ou perfil do TranscriBot; os modos de formatação seguem disponíveis.
LegendasTipo de transcriçãoSRT, VTT ou ambosSubstitui o modo de formatação pelo formato da legenda; geradas dos segmentos temporizados, com falantes quando disponíveis.

Pronto para usar o fluxo completo?

Comece com um arquivo curto, confira o RAW e o resultado formatado, e só depois salve seus padrões para conteúdos maiores.

Transcriwise