Configurações de IA e provedores (usuário master)

Antes de qualquer usuário conversar com a Filipa, o usuário master precisa fazer duas coisas: cadastrar pelo menos um provedor de IA (a conta do ChatGPT, do Claude ou uma assinatura hospedada pela própria empresa) e, nas Configurações de IA, ligar cada função da Filipa apontando o provedor e o modelo que ela deve usar. Este artigo percorre as duas telas campo a campo, explica os tipos de provedor, orienta a escolha de modelos por função e mostra como limitar a concorrência. Ao final, a sua instalação estará pronta para liberar a Filipa nos perfis.

Quem acessa e onde fica

O que mudou na versão de setembro de 2026: a tela de Configurações de IA ganhou a aba Limites de uso da IA, com dez grupos de tetos que substituem o antigo campo único “Máximo de execuções simultâneas”, e dois botões novos no rodapé dessa aba, Restaurar padrões e Filipa? Sugerir limites!. Os rótulos da seção Filipa também foram corrigidos. Depois disso, os limites foram enxugados (alguns campos técnicos saíram e as chamadas internas de ferramentas foram consolidadas em dois campos), a duração máxima do turno passou a 600 segundos e os ciclos de ferramentas do servidor por turno passaram a 15.

As duas telas estão no menu Filipa IA, Configurações de IA e aparecem apenas para o usuário master, desde que a instalação tenha o pacote de IA contratado. As configurações valem para a instalação inteira (todas as empresas dela); as permissões de quem usa são definidas por perfil e por empresa.

Tela: menu configuracoes de ia v2 (computador)
Subgrupo Configurações de IA no menu lateral com os itens Provedores de IA e Configurações de IA

Provedores de IA

Um provedor é uma conta em um serviço de IA, com credencial e lista de modelos permitidos. Você pode cadastrar mais de um (por exemplo, um do ChatGPT para conversas e um do Claude para arquivos) e escolher qual usar em cada função. A lista mostra o nome, o tipo, o modelo padrão, se o provedor está ativo e se a credencial está configurada ou ausente.

Tela: lista provedores de ia (computador)
Lista de provedores de IA com nome, tipo, modelo padrão e situação da credencial

Tipos de provedor

TipoO que éCredencial
ChatGPTConta na API da OpenAI. O consumo é cobrado por uso na conta da empresa.Chave de API da OpenAI.
ClaudeConta na API da Anthropic. Cobrança por uso na conta da empresa.Chave de API da Anthropic.
Via assinatura ChatGPT/CLI hospedado pelo clienteUsa a assinatura do ChatGPT (Codex) instalada em um servidor da própria empresa, por meio do serviço Vendelo HostedAgents. Indicado para agentes autônomos e geração de arquivos com custo fixo de assinatura.O conteúdo completo do arquivo auth.json gerado pelo login do CLI no servidor da empresa; outro formato é recusado.
Via assinatura Claude/CLI hospedado pelo clienteO mesmo, com a assinatura do Claude (Claude Code) no servidor da empresa.Credencial gerada pelo comando de configuração de token do Claude.

Os tipos “via assinatura” exigem a instalação do serviço Vendelo HostedAgents no ambiente da empresa, feita em conjunto com a Vendelo. Os tipos ChatGPT e Claude funcionam apenas com a chave de API.

Cadastrando um provedor

  1. Apelido: um nome para reconhecer o provedor nas outras telas, como “OpenAI produção”.

  2. Ativo: deixe ligado. Um provedor inativo não pode ser escolhido nas Configurações de IA.

  3. Tipo de provedor: um dos quatro tipos da tabela acima.

  4. Endpoint do provedor: aparece e é obrigatório só nos tipos via assinatura, com a URL do serviço HostedAgents da empresa. Para ChatGPT e Claude o campo não é exibido.

  5. Credencial/Token: cole a chave ou credencial. Ela é gravada criptografada e nunca é exibida de novo; ao editar, o campo mostra “vazio preserva o atual”. Para trocar, cole a nova. No tipo via assinatura ChatGPT, cole o conteúdo completo do arquivo auth.json. A opção “Remover a credencial/token atual” só fica disponível quando o provedor não está em uso em nenhuma função, e só pode ser salva com o provedor inativo.

  6. Modelos disponíveis: digite ou selecione os modelos que a empresa autoriza e pressione Enter para cada um. Só esses modelos aparecem nas outras telas. Cadastre apenas modelos homologados (veja o aviso abaixo).

  7. Modelo padrão: escolha um dos modelos da lista. É o sugerido nas Configurações de IA e no cadastro de agentes.

  8. Salvar.

Tela: cadastro provedor de ia (computador)
Formulário de provedor de IA preenchido, com a lista de modelos e o modelo padrão

Modelos homologados. A Filipa foi homologada com os modelos gpt-5.6-luna e superiores (ChatGPT) e claude-sonnet-5 e superiores (Claude). O cadastro permite incluir modelos inferiores, mas eles não foram validados com a Filipa: podem seguir mal as instruções, errar ou abandonar consultas ao Vendelo, gerar arquivos incompletos ou nem ser aceitos pelo provedor. Use modelos inferiores por sua conta e risco, e prefira os homologados em todas as funções (conversas, relatórios e arquivos, e agentes).

A credencial dá acesso à conta de IA da empresa e ao seu saldo. Cole apenas em Provedores de IA. Não a compartilhe por e-mail ou chat.

Configurações de IA

A tela tem duas seções, Filipa e Agentes autônomos. Cada função tem uma caixa de seleção com o próprio nome da função, para ligar e desligar, e, quando aplicável, o provedor e o modelo. As listas de provedor só mostram provedores ativos e com credencial.

SeçãoCamposEfeito
Conversas interativas com a FilipaConversas interativas com a Filipa (liga); Provedor para conversas interativas; Modelo para conversas interativasLiga a conversa (janela, botão flutuante, app no navegador). Desligada, a janela informa que o copiloto foi desativado pelo administrador.
Geração de relatórios e arquivosGeração de relatórios e arquivos (liga); Provedor para relatórios e arquivos; Modelo para relatórios e arquivosLiga a criação de arquivos na conversa e a tela Arquivos gerados pela Filipa.
Transcrição de áudio da FilipaTranscrição de áudio da Filipa (liga); Provedor de transcriçãoLiga o botão de microfone. Só aparecem na lista provedores ChatGPT com o modelo padrão gpt-4o-mini-transcribe.
Agentes autônomosAgentes autônomos habilitados; Provedor dos agentes autônomosLiga o subgrupo Agentes. Os modelos disponíveis no cadastro do agente são os do provedor escolhido aqui.
Tela: configuracoes de ia preenchida (computador)
Parte superior da tela de Configurações de IA: seção Filipa com as funções ligadas e provedores escolhidos, e a seção Agentes autônomos

Ao salvar, aparece “Configurações de IA atualizadas”. O serviço de IA aplica a mudança na hora; o menu e o botão da Filipa dos demais usuários se atualizam no próximo login ou troca de empresa.

Limites de uso da IA

A tela agora tem duas abas: Configurações de IA, com as funções descritas acima, e Limites de uso da IA, novidade desta versão. A segunda aba reúne, em dez grupos, os tetos que protegem a instalação contra consumo excessivo e travamentos: quantas conversas e gerações rodam ao mesmo tempo, quanto tempo cada uma pode esperar e durar, quantos tokens e caracteres podem circular, quantas ferramentas a Filipa pode chamar, o tamanho dos relatórios e dos arquivos e por quantos dias os arquivos ficam guardados. Antes, só existia um campo, o máximo de execuções simultâneas; agora esse controle está detalhado por tipo de trabalho (conversa ou geração de arquivo) e por usuário.

A própria tela avisa: não altere estes valores sem conhecimento técnico. Limites inadequados podem interromper operações ou comprometer o funcionamento da aplicação. Eles são globais e afetam todas as empresas da instalação. Na dúvida, mantenha os padrões ou use a sugestão da Filipa descrita adiante.

GrupoO que controlaCampos e padrões
Execuções simultâneasQuantos trabalhos rodam ao mesmo tempo, no total e por usuário.Conversas simultâneas globais (10) e por usuário (2); gerações simultâneas globais (2) e por usuário (1).
Filas de esperaQuantos pedidos podem aguardar na fila antes de a Filipa recusar novos.Conversas pendentes globais (50) e por usuário (2); gerações pendentes globais (50) e por usuário (2).
PrazosTempo máximo de espera na fila e de duração de cada trabalho.Espera máxima de conversa na fila (300 s); espera máxima de geração na fila (43.200 s, 12 horas); duração máxima do turno (600 s, 10 minutos); duração máxima da geração completa (7.200 s, 2 horas); validade de interação pendente (300 s).
Consumo de tokensTetos de tokens por conversa e por geração de arquivo.Entrada nova acumulada por conversa (250.000) e por geração (1.000.000); saída acumulada por conversa (50.000) e por geração (256.000); saída por chamada em conversa (8.000) e em geração (16.000).
FerramentasQuanto resultado de consulta a Filipa pode receber e quantas vezes pode chamar ferramentas.Resultado de ferramenta em conversa (64.000 caracteres); chamadas internas de ferramentas em conversa (32) e em arquivos e agentes (80); ciclos de ferramentas do servidor por turno (15). As chamadas internas valem para ChatGPT e para os tipos via assinatura; não têm efeito no Claude via API.
Aplicação das políticas e cacheChaves gerais de proteção.Habilitar cache de orquestração (ligado); aplicar política de consumo e ferramentas (ligado).
Mensagens e contextoTamanho da mensagem do usuário, do histórico enviado ao modelo e do resumo de contexto.Mensagem do usuário (8.000 caracteres); instruções de geração pela API (250.000); mensagens recentes enviadas ao modelo (8); histórico recente total (24.000) e por mensagem (6.000); referência para compactar contexto (72.000); resumo do contexto anterior (12.000).
Relatórios na conversaTamanho dos relatórios visuais que a Filipa monta no chat.Relatório estruturado (250.000 caracteres); blocos visuais (12); ações (6); pontos por gráfico (200); séries por gráfico (30); séries por mapa de calor (12); pontos de tendência por indicador (24); colunas (50) e linhas (200) por tabela; itens (12) e critérios (30) por matriz de comparação.
Áudio e transcriçãoLimites da gravação de voz.Duração máxima do áudio (240 s); tamanho máximo do áudio (26.214.400 bytes, a tela mostra cerca de 26,2 MB); prazo de transcrição (120 s).
Arquivos e retençãoTamanho do arquivo gerado e por quanto tempo ele fica disponível.Tamanho máximo do arquivo final (500.000.000 bytes); retenção de arquivos (7 dias, aceita de 1 a 365.000).

Cada campo traz, logo abaixo, uma frase explicando o que ele controla (por exemplo, “Conversas distintas que um usuário pode executar simultaneamente. A mesma conversa executa um turno por vez.”). Nas filas, o valor zero desativa a espera: pedidos além da capacidade são recusados na hora. Nos campos de bytes e de segundos, a tela mostra também o valor equivalente em unidades legíveis (por exemplo, “26.214.400 bytes equivalem a 26,2 MB” ou “43.200 segundos equivalem a 12 hora(s)”), para você conferir o que digitou. Um valor fora da faixa ou incompatível com os demais limites é marcado com a mensagem “Valor inválido ou incompatível com os demais limites” e impede o salvamento.

Tela: limites de uso da ia (computador)
Aba Limites de uso da IA com o aviso em destaque, os grupos Execuções simultâneas e Filas de espera com a explicação de cada campo, e os botões do rodapé
Tela: limites prazos (computador)
Grupo Prazos da aba de limites, com a duração máxima do turno em 600 segundos e o equivalente em unidades legíveis abaixo de cada campo
Tela: limites ferramentas (computador)
Grupo Ferramentas com os quatro campos atuais e a explicação de que as chamadas internas não têm efeito na Anthropic

O campo “Retenção de arquivos (dias)” é o que define o prazo de sete dias citado nos artigos de arquivos e agentes. Se a sua empresa precisar guardar por mais tempo, é aqui que se muda.

Restaurar padrões e pedir sugestão à Filipa

Dois botões no rodapé da aba de limites ajudam a não errar a mão (o botão Salvar aparece quando há alteração):

  • Restaurar padrões: preenche todos os limites com os valores padrão definidos pela Vendelo no servidor (hoje, os da tabela acima). Nada é gravado até você revisar e tocar em Salvar.
  • Filipa? Sugerir limites!: abre a Filipa com uma tarefa especial. Ela recebe o número de empresas acessíveis, de usuários confirmados e o tamanho conhecido das bases de dados, além do valor atual, do padrão, da unidade, da faixa e da descrição de cada campo; não consulta dados de negócio. A Filipa mostra a tabela “Limites de IA em revisão” (Campo, Atual, Padrão, Sugestão, Motivo), explica as premissas e você pode conversar com ela sobre os valores. Ao tocar em “Preencher com estas sugestões”, o Vendelo preenche o formulário e exibe “Sugestões da Filipa preenchidas. Revise os campos e salve para aplicar.” Se a resposta trouxer campo inválido, aparece “A sugestão contém campos ou valores inválidos. Peça à Filipa para corrigir antes de aplicar.” Se você tiver alterado algum campo enquanto a Filipa trabalhava, a sugestão é descartada com um aviso, para não misturar valores.
Tela: botoes restaurar e sugerir limites (computador)
Rodapé da aba de limites com o botão "Filipa? Sugerir limites!", identificado pelo rosto da Filipa, e o botão Restaurar padrões

A sugestão da Filipa consome tokens como qualquer interação e exige a função Conversas interativas ligada. Ela é um ponto de partida informado pelo uso real, não uma regra: o administrador continua responsável pelos valores salvos.

Escolhendo provedor e modelo por função

Em qualquer função, parta dos modelos homologados: gpt-5.6-luna e superiores no ChatGPT, claude-sonnet-5 e superiores no Claude. Dentro deles, as orientações abaixo ajudam a escolher.

  • Conversas: priorize velocidade de resposta. Um modelo rápido e com boa capacidade de usar ferramentas atende bem, porque cada pergunta gera várias consultas ao Vendelo.
  • Relatórios e arquivos: priorize qualidade. Esses pedidos rodam em segundo plano, então um modelo mais capaz não prejudica a experiência. Os tipos “via assinatura” são uma boa opção aqui pelo custo previsível.
  • Transcrição: um provedor ChatGPT com credencial válida. A transcrição consome pouco.
  • Agentes: priorize capacidade de seguir instruções longas. Os agentes executam sem ninguém olhando; erros custam mais. O cadastro de cada agente permite escolher entre os modelos do provedor.
  • Concorrência: comece com os padrões (10 conversas e 2 gerações simultâneas no total; 2 e 1 por usuário) e ajuste conforme a equipe crescer e o provedor suportar. Muitas execuções simultâneas aumentam a chance de esbarrar nos limites do provedor.

Cadastre o modelo padrão de cada provedor com o modelo que você quer que a maioria use. Ele é sugerido automaticamente no cadastro de agentes e reduz escolhas erradas.

Ordem recomendada de configuração

  1. Cadastre o provedor com a credencial, os modelos e o modelo padrão.

  2. Ligue “Conversas interativas com a Filipa” apontando esse provedor e um modelo. Deixe os limites de uso nos padrões nesta primeira etapa.

  3. Libere a permissão Chat da Filipa, assistente de IA em um perfil de teste e converse com a Filipa para validar a credencial.

  4. Ligue as demais funções (arquivos, transcrição, agentes) conforme a necessidade, testando cada uma.

  5. Libere os perfis definitivos conforme o artigo de permissões.

Resumo dos campos

CampoObrigatoriedadeDescrição
Apelido (provedor)ObrigatórioNome de identificação do provedor.
Tipo de provedorObrigatórioChatGPT, Claude ou via assinatura hospedada.
Endpoint do provedorObrigatório só nos tipos via assinaturaURL do serviço HostedAgents da empresa.
Credencial/TokenObrigatório quando o provedor está ativo e ainda não tem credencialChave de API, auth.json ou token do CLI. Criptografada e nunca reexibida.
Modelos disponíveisObrigatórioUm ou mais modelos autorizados.
Modelo padrãoObrigatórioModelo sugerido nas outras telas.
Provedor e modelo por funçãoObrigatório quando a função está ligadaDefinidos nas Configurações de IA.
Limites de uso da IAObrigatórioDez grupos de tetos com valores padrão; use Restaurar padrões ou a sugestão da Filipa antes de alterar à mão.

Perguntas frequentes

Salvei a credencial errada. Como corrijo?

Edite o provedor e cole a credencial certa no campo; o valor novo substitui o antigo. Não é preciso remover antes.

Posso usar o mesmo provedor para todas as funções?

Sim. É a configuração mais simples. Separe provedores quando quiser custos ou contas diferentes por função.

Desliguei as conversas. Os agentes continuam rodando?

Sim. Cada função é independente. Os agentes seguem o que está na seção Agentes autônomos.

Como sei se a credencial está válida?

Faça uma pergunta simples à Filipa. Se a credencial estiver inválida ou sem créditos, ela avisa na conversa.

Qual a diferença entre “Claude” e “Via assinatura Claude/CLI hospedado pelo cliente”?

“Claude” usa a API com cobrança por uso. “Via assinatura” usa uma assinatura do Claude instalada em um servidor da empresa, com o serviço Vendelo HostedAgents fazendo a ponte. O segundo tem custo fixo e exige instalação.

O modelo que quero não aparece na lista.

Adicione-o em “Modelos disponíveis” do provedor. As telas só mostram modelos cadastrados ali.

Posso usar um modelo mais simples para economizar?

O cadastro permite, mas não é recomendado. A Filipa foi homologada com os modelos gpt-5.6-luna e superiores (ChatGPT) e claude-sonnet-5 e superiores (Claude). Modelos inferiores não foram validados: a economia de tokens tende a sair cara em respostas erradas, relatórios incompletos e agentes que falham sem ninguém olhando.

Mudei um limite e a tela não deixa salvar. Por quê?

Algum valor ficou fora da faixa aceita ou incompatível com outro limite (por exemplo, um teto por usuário maior que o teto global). O campo fica marcado com a mensagem de valor inválido; corrija ou use Restaurar padrões.

A sugestão da Filipa substitui os valores sem perguntar?

Ela preenche o formulário, mas nada é gravado até você tocar em Salvar. Revise os campos antes.

Existe limite de gasto mensal?

Não há limite de gasto em reais. Os tetos disponíveis são os de tokens por turno e por geração e os de simultaneidade, em Limites de uso da IA. Se a conta do provedor ficar sem créditos, a Filipa avisa. Acompanhe o consumo nas telas de uso de tokens.

A credencial da assinatura expirou. O que acontece?

A Filipa informa que a credencial do Codex (ou do Claude) não é mais válida. Atualize o auth.json (ou gere um novo token com claude setup-token) no provedor e reprocesse o pedido.

Próxima leitura

Usando a Filipa nas telas do Vendelo: abra a janela flutuante, aproveite o contexto da tela aberta e conheça os controles da janela.