> ## Documentation Index
> Fetch the complete documentation index at: https://doc.omnitechsolucoes.com.br/llms.txt
> Use this file to discover all available pages before exploring further.

# Boas Práticas para Assistentes

> Guia rápido para ajustar modo, transcrição, modelo e demais configurações para a melhor experiência em chamadas com IA.

> **Última atualização:** 1º de setembro de 2025

Obter ótimos resultados depende, na maioria das vezes, de **escolher corretamente as configurações do mecanismo**.\
Use este checklist ao configurar um assistente na **OmniTech IA**:

## 1. Escolha o Modo de Operação

| Modo                              | Por que escolher?                                   | Observações                                                                                          |
| --------------------------------- | --------------------------------------------------- | ---------------------------------------------------------------------------------------------------- |
| **Dualplex (Beta)**               | Alternância rápida de fala + vozes premium/clonadas | Modo padrão recomendado. Combine com **Gemini Flash 2.0/2.5** ou **GPT-5 Realtime**.                 |
| **Speech-to-Speech (Multimodal)** | Fluxo mais natural e menor latência                 | Modelo recomendado: **GPT-5 Realtime**.                                                              |
| **Pipeline**                      | Máximo controle de voz e respostas longas           | Modelo recomendado: **GPT-5 Mini**. Ao escolher Pipeline, configure também o **Transcritor** abaixo. |

Quer entender melhor as diferenças entre os modos? Consulte o guia\
<a href="/ai-assistants/assistant-modes">Modos do Assistente</a>.

<Note>
  Teste os três modos usando o mesmo cenário e compare tempo de resposta e satisfação do usuário.
</Note>

## 2. Escolha o Transcritor (somente Pipeline)

| Transcritor  | Precisão | Latência            | Melhor uso                                                                |
| ------------ | -------- | ------------------- | ------------------------------------------------------------------------- |
| **Azure**    | ⭐⭐⭐⭐     | ⏱️⏱️⏱️ (mais lento) | Quando a fidelidade da transcrição é prioridade máxima.                   |
| **Gladia**   | ⭐⭐⭐      | ⏱️ (mais rápido)    | Opção equilibrada para a maioria dos idiomas.                             |
| **Deepgram** | ⭐⭐⭐      | ⏱️ (mais rápido)    | Alternativa sólida — teste qual funciona melhor no seu idioma e ambiente. |

> **Dica:** Idioma, sotaque e ruído de fundo impactam cada engine de forma diferente. Faça testes A/B e mantenha o melhor desempenho.

## 3. Selecione o Modelo de IA (LLM)

| Modelo                     | Pontos fortes                              | Considerações                                   |
| -------------------------- | ------------------------------------------ | ----------------------------------------------- |
| **GPT-5 Mini**             | Bom equilíbrio entre raciocínio e latência | Pode ser mais lento que modelos realtime.       |
| **GPT-5 Realtime**         | Projetado para latência ultra-baixa em voz | Ideal para **Speech-to-Speech** e **Dualplex**. |
| **GPT-4o**                 | Excelente raciocínio e multimodalidade     | Latência mais alta.                             |
| **Gemini Flash 2.0 / 2.5** | Extremamente rápido em interações por voz  | Ideal para minimizar latência percebida.        |

Se velocidade for crítica, utilize **GPT-5 Realtime** (Speech-to-Speech) ou **Gemini Flash 2.0/2.5** (Dualplex).\
Para respostas mais elaboradas, use **GPT-4o** ou **GPT-5 Mini** e compense a latência com **áudios de preenchimento**.

## 4. Cancelamento de Ruído

Se o usuário estiver em viva-voz ou ambiente silencioso, mantenha o **cancelamento de ruído ATIVADO**.\
Caso palavras estejam sendo cortadas ou o volume seja baixo, **desative** para garantir melhor captação do áudio.

<Note>
  Se o assistente não estiver ouvindo corretamente, experimente desativar o cancelamento de ruído.
</Note>

## 5. Temporizadores de Conversa

| Parâmetro                      | Recomendado | Motivo                                                                            |
| ------------------------------ | ----------- | --------------------------------------------------------------------------------- |
| **Reengajamento**              | `≈ 30 s`    | Dá tempo suficiente para o usuário pensar, sem parecer insistente.                |
| **Duração máxima de silêncio** | `≈ 60 s`    | Evita desligamentos prematuros, encerrando apenas chamadas realmente silenciosas. |

Teste valores diferentes em chamadas reais — valores muito baixos interrompem, valores altos criam pausas desconfortáveis.

## 6. Mensagem Inicial

| Modo                 | Como é utilizada                          | Boa prática                                                                                          |
| -------------------- | ----------------------------------------- | ---------------------------------------------------------------------------------------------------- |
| **Pipeline**         | Lida **exatamente** como escrita (TTS).   | Escreva literalmente: “Olá, aqui é a OmniTech IA…”.                                                  |
| **Dualplex**         | Lida **exatamente** como escrita (TTS).   | Escreva o texto final e selecione a voz clonada.                                                     |
| **Speech-to-Speech** | Interpretada como **prompt** pelo modelo. | Inclua instruções como “Cumprimente o cliente e diga…” ou use `diga exatamente:` para saída literal. |

## 7. Som Ambiente

Ativado por padrão, o som ambiente adiciona ruído de fundo à voz do assistente, tornando-a mais natural.

<Note>
  Se houver dificuldade de compreensão, reduza o volume do som ambiente ou desative-o.
</Note>

## 8. Sensibilidade de Endpointing

Controle **quando o assistente começa a falar** usando o controle de sensibilidade de endpointing.

| Configuração            | Efeito                                             | Quando usar                      |
| ----------------------- | -------------------------------------------------- | -------------------------------- |
| **Menor sensibilidade** | Resposta mais rápida após o usuário parar de falar | Conversas ágeis e objetivas      |
| **Maior sensibilidade** | Aguarda mais antes de responder                    | Usuários que falam frases longas |

<Tip>
  **Dica avançada:** Se o assistente interrompe o usuário, **aumente** a sensibilidade.\
  Se as respostas parecerem lentas, **reduza**.
</Tip>

## 9. Depuração com Transcrição da Chamada

Para diagnosticar problemas:

1. Acesse a página **Histórico de Chamadas**
2. Clique na última chamada testada
3. Analise a transcrição completa, incluindo funções e parâmetros executados

## 10. Ainda tem dúvidas?

Caso tenha qualquer dúvida, utilize o chat de suporte dentro da plataforma **OmniTech IA**.

<Note>
  Teste diferentes combinações em chamadas reais — o melhor ajuste depende do fluxo de conversa e do comportamento dos usuários.
</Note>

***

Precisa da lista completa de todos os botões e controles?\
Consulte a\
<a href="/ai-assistants/settings/general">Referência completa de configurações do assistente</a>.
