INVESTIGAÇÃO CENTRADA NA VOZ

Investigação na Swifly

A construir a camada de voz para o trabalho moderno. Exploramos a voz, o contexto, os modelos de linguagem e os fluxos de trabalho profissionais para transformar pensamentos falados em texto claro, preciso e profissional.

Os nossos pilares de investigação

Exploramos todas as camadas da voz e da linguagem para transformar conversas reais em texto claro, preciso e profissional que cumpre o seu propósito.

Ícone de onda sonora rosa com barras verticais de alturas variadas sobre um fundo preto.

Precisão da voz

A tornar a fala natural mais fiável.

Ícone verde estilizado de um cérebro com formas abstratas interligadas sobre um fundo cinzento.

Inteligência contextual

A compreender onde escreve e porquê.

Ícone amarelo de perfil de utilizador com um círculo como cabeça e uma meia-elipse como ombros.

Linguagem pessoal

A adaptar-se às suas palavras e ao seu tom.

Ícone amarelo de perfil de utilizador com um círculo como cabeça e uma meia-elipse como ombros.

Transformação multilingue

A preservar o significado entre idiomas.

Ícone roxo de documento com duas linhas horizontais e uma estrela à frente, no canto inferior direito.

Resultado estruturado

A transformar a fala em texto pronto a usar.

Ícone rosa de um raio com contornos irregulares.

Interface de voz invisível

A tornar o uso da voz simples e natural.

TECNOLOGIA DE VOZ COM PATENTE PENDENTE

Tecnologia de voz com patente pendente

Os nossos sistemas exclusivos combinam compreensão avançada da fala, reescrita contextual e inteligência de fluxo de trabalho para oferecer textos profissionais que parecem escritos por si — só que mais claros.

  • Geração de texto orientada por voz
  • Motor de reescrita contextual
  • Transformação multilingue
  • Automatização de fluxos de trabalho
Diagrama a mostrar as entradas voz, camada de contexto, modelo de linguagem ligados às saídas resultado profissional, integração de fluxo de trabalho.
INVESTIGAÇÃO E QUALIDADE

O Swifly Benchmark Lab

Avaliamos fluxos de trabalho reais de conversão de voz em texto quanto à precisão, latência, estabilidade em ditados longos e qualidade do resultado profissional — para lhe garantir transcrições cada vez melhores.

  • Taxa de erro de palavras (WER)
  • Taxa de erro de caracteres (CER)
  • Latência do endpoint
  • Fator de tempo real (RTF)
  • Precisão de entidades nomeadas
  • Estabilidade em ditados longos
  • Taxa de erro de diarização
  • Calibração de confiança
Painel com métricas de reconhecimento de voz, incluindo WER, CER, latência, gráfico de tendências, conjuntos de dados e definições do modelo.
Fale

Investigação em curso

Aquilo que estamos a explorar ativamente em matéria de precisão de voz, contexto e fluxos de trabalho multilingues.

PRECISÃO

Melhorar a fiabilidade de ditados longos

Reduzir falhas e melhorar a precisão em sessões de voz prolongadas.

Linhas de onda amarelas e simétricas sobre um fundo preto, representando um sinal sonoro ou áudio.
CONTEXTO

Tornar nomes e termos mais precisos

Tirar partido do contexto, memória e sinais de fluxo de trabalho para melhorar o reconhecimento.

Diagrama com um ícone verde central de utilizador ligado a ACME Corp., Atualização do 2.º trimestre, Dr. Patel e um ícone de documento.
MULTILINGUE

Conceber fluxos de trabalho de voz multilingues

Criar uma transformação de voz natural entre idiomas e equipas.

Ícone de globo ligado por linhas pontilhadas a saudações em espanhol, chinês, russo e francês.