Base de Conhecimento Avançada: Configurações de IA
Você pode escolher os seguintes modelos de IA no menu suspenso: GPT-4.1, GPT-4.1 mini, GPT-4.1 nano, GPT-4o, GPT-4o Mini e etc. Como você pode ver na imagem abaixo, cada modelo con
As configurações de IA da ChatCase fornecem ferramentas poderosas para ajustar o comportamento e desempenho do seu agente de IA. Essas configurações incluem o número máximo de tokens, temperatura, pedaços, contexto do sistema e prompt. Este tutorial explicará cada uma dessas configurações e como elas afetam sua Base de Conhecimento.
Escolha criar uma nova Base de Conhecimento** ou usar a default**.
Clique no ícone gear para acessar e configurar as configurações AI.
# # # Configurações da IA explicadasModelos de IA
Você pode escolher os seguintes modelos de IA no menu suspenso: GPT-4.1, GPT-4.1 mini, GPT-4.1 nano, GPT-4o, GPT-4o Mini e etc. Como você pode ver na imagem abaixo, cada modelo consome uma quantidade diferente de fichas.
### **Diferenças entre modelos OpenAI#
** GPT-4.1** Definição: A última geração na família GPT-4, oferecendo o mais alto nível de compreensão de linguagem e geração de texto. Mais adequado para cenários complexos onde precisão e contexto são críticos.
** Consumo de token: ** Custo maior por token, mas oferece desempenho superior.
** GPT-4.1 Mini** Definição: Uma variante mais leve e rápida do GPT-4.1. Ele fornece capacidades de linguagem sólidas a um custo muito menor, tornando-o perfeito para interações frequentes ou tarefas menos complexas.
** Consumo de token: ** Significativamente mais baixo, focado na eficiência e acessibilidade.
** GPT-4.1 Nano** Definição: O modelo mais leve da série GPT-4.1. Projetado para tarefas simples, respostas rápidas, ou quando os custos de execução devem ser mantidos mínimos.
** Consumo de token: ** O mais baixo entre todos os modelos, oferecendo máxima eficiência com capacidades limitadas.
** GPT-4o** Definição: Uma versão especializada do GPT-4, otimizada para certas tarefas ou indústrias, oferecendo melhorias de desempenho direcionadas.
Consumo de Token: Tipicamente superior ao GPT-4 Turbo, mas inferior ao GPT-4 padrão, devido a otimizações específicas.
** GPT-4o Mini**
Definição: Uma variante menor e mais eficiente do GPT-4o, projetada para aplicações que requerem menos potência computacional, enquanto ainda se beneficia de otimizações direcionadas. Token
Consumo: Baixo custo por token em comparação com o GPT-4o, visando proporcionar um equilíbrio entre desempenho e uso de recursos.
Descrição do produto
O quê? -------------------------------------------------------------------------------------------------------------------------------------------------------------------
□ GPT-4.1 □ Última geração da família GPT-4, com maior precisão e raciocínio. □ Mais alto custo, melhor desempenho
O GPT-4.1 Mini, variante leve e eficiente GPT-4.1, habilidades sólidas de linguagem a um custo mais baixo. O custo muito mais baixo do que GPT-4.1, grande para interações freqüentes
Nano GPT-4.1 Modelo Ultra-light para tarefas simples e custos mínimos. □ Custo mais baixo, projetado para máxima eficiência
GPT-4o** Versão especializada do GPT-4 para tarefas direcionadas * Muito alto custo (segundo apenas para GPT-4 legado), melhor para aplicações multimodais ricas
O GPT-4o Mini** O menor e eficiente variante do GPT-4o, o custo muito menor que o GPT-4o, bom equilíbrio entre desempenho e eficiência
Número máximo de fichas
Definição: Tokens são as palavras que a IA usa para processar e gerar respostas. O número máximo de tokens controla o comprimento das respostas.
Impacto: Um limite de token maior permite respostas mais longas e detalhadas. Um limite inferior restringe o comprimento, tornando as respostas mais curtas e potencialmente mais concisas.
** Como Configurar**:
Localize a configuração Número máximo de itens nas configurações de IA.
Digite o número desejado de fichas, até um máximo de 9999 (por exemplo, 100, 200, 500).
# # # **3. Temperatura #
Definição: A temperatura controla a aleatoriedade das respostas da IA. A ** menor** temperatura torna as respostas ** mais determinística e focada**, enquanto uma temperatura mais alta torna-as mais criativas e variadas.
Impacto: Ajustar a temperatura ajuda a equilibrar entre consistência e criatividade nas respostas.
** Como Configurar**:
Localize a configuração Temperatura.
Defina o valor da temperatura (por exemplo, 0,2 para respostas mais focadas, 0,8 para respostas mais criativas).
Definição: Chunks são porções de conteúdo que a IA usa para criar respostas. Quebrar conteúdo em blocos ajuda a informação do processo de IA de forma mais eficiente.
Impacto: O bom blocagem garante que a IA pode lidar com grandes documentos ou conjuntos de dados sem problemas de desempenho.
Definição: O contexto do sistema fornece ao IA informações de fundo ou diretrizes que influenciam seu comportamento e respostas. Ele define o tom geral e direção para a IA.
Impacto: Um contexto de sistema bem definido ajuda a IA a entender seu papel e o tipo de respostas que deve gerar.
** Como Configurar**:
Localize a configuração Contexto do sistema.
Insira as informações de contexto, como "Você é um assistente de suporte ao cliente útil."
Use esta opção para obter fontes você precisa de documentos usados para gerar a resposta. Tenha em mente que isso consome mais tokens do que recuperação regular de KB.
** Definição:** HyDE é uma técnica de recuperação avançada. Em vez de pesquisar diretamente a sua Base de Conhecimento com a pergunta do usuário, ChatCase primeiro pede à IA para gerar uma resposta hipotética para essa pergunta, e então usa a incorporação dessa resposta hipotética para pesquisar os pedaços mais relevantes em sua Base de Conhecimento. A intuição é que uma resposta escrita está semanticamente mais próxima dos documentos armazenados em seu KB do que de uma breve e muitas vezes ambígua consulta do usuário.
Impacto: Habilitar o HyDE tipicamente melhora a relevância do conteúdo recuperado, especialmente para perguntas curtas, vagas ou pobres em palavras-chave, o que resulta em respostas mais você precisa e on-topic. O trade-off é consumo de token maior, porque cada mensagem do usuário desencadeia uma chamada LLM adicional para gerar a resposta hipotética antes das etapas de recuperação e resposta reais.
Use o Cache
Definição: Quando Use Cache é ativado, ChatCase armazena a resposta da IA para cada questão única. Na próxima vez que um usuário perguntar a mesma (ou uma pergunta muito similar), a resposta em cache é devolvido imediatamente, sem executar o pipeline de recuperação e geração completo novamente.
Impacto: Respostas de cache são retornadas muito mais rápido e ** não consomem tokens adicionais**, o que reduz a latência e os custos operacionais. Isto é especialmente valioso em chatbots de alto tráfego onde as mesmas perguntas são feitas repetidamente. Por outro lado, se você acabou de atualizar o conteúdo da Base de Conhecimento, as respostas em cache podem não refletir essas alterações até que a entrada de cache seja atualizada. Enquanto o cache está habilitado, a resposta é entregue como um único bloco, então a visualização do streaming não está disponível.
Agente AI Fine-tuning e Prompt
Agora que você definiu suas preferências de IA, você pode ir ainda mais longe e começar a elaborar seu prompt dentro do Flow. Por favor, note que cada agente de IA que você criar pode ter different configurações de IA se você preferir.
Definição: O prompt é a instrução inicial fornecida à IA, orientando-a sobre como gerar respostas com base na entrada do usuário.
Impacto: O prompt molda o entendimento inicial da IA e a geração de resposta.
Digite um prompt claro e conciso, baseado no que você gostaria de alcançar com um agente de IA específico, como abaixo.
Configurando configurações de IA - Recapitular1. **Configurações de IA de acesso**: Vá para o ícone de engrenagens para as configurações **AI** sob a guia **Bases de conhecimento**.
2. **Ajustar o número máximo de itens**: Defina o limite de token desejado com base na complexidade e duração das respostas que você precisa.
3. **Set Temperatura**: Escolha um valor de temperatura que equilibre criatividade e consistência.
4. **Definir Chunks**: Determine o tamanho adequado do pedaço para otimizar o desempenho.
5. **Contexto do sistema de entrada**: Fornecer informações de base relevantes ou diretrizes para moldar o comportamento da IA.
Lembre-se, embora sejam configurações gerais de IA, você ainda pode configurar as configurações de cada agente de IA dentro do Design Studio de acordo com suas necessidades específicas
Melhores práticas* Experimento com Configurações: Ajuste as configurações de forma incremental e teste as respostas para encontrar a configuração ideal para o seu caso de uso.
Monitor Performance: Reveja regularmente o desempenho da IA e faça ajustes conforme necessário para manter a qualidade das respostas.
** Mantenha o Contexto Relevante**: Certifique-se de que o contexto do sistema e o prompt são relevantes para a Base de Conhecimento específica e interações do usuário.
ConclusãoA configuração das configurações de IA para sua Base de Conhecimento no ChatCase permite que você ajuste o comportamento e a qualidade de resposta do agente de IA. Ao entender e ajustar o número máximo de tokens, temperatura, pedaços, contexto do sistema e prompt, você pode melhorar a eficácia e eficiência de seu Agente de IA.