Rotear trabalho com modelos e perfis
Um provedor informa ao Lotti onde se conectar. Um modelo registra um ID de modelo do provedor e suas capacidades. Um perfil de inferência então atribui esses modelos aos trabalhos que o Lotti entende. Isso mantém a pergunta “qual modelo lida com áudio?” fora de cada tarefa individual e regra de automação.
Revise os modelos salvos
Abra Configurações → Configurações de IA → Modelos. A lista agrupa os modelos por provedor e expõe filtros de capacidade para texto, visão, áudio e raciocínio.
O controle Agente simultâneo é ativado na parte superior das configurações de IA limita quantos agentes diferentes podem executar inferência ao mesmo tempo. Um valor mais alto pode melhorar a vazão, mas também aumenta as solicitações simultâneas ao provedor e a carga no dispositivo local. Seja conservador quando um provedor tiver limites de taxa rígidos ou quando um servidor de modelo local tiver memória limitada.
Adicione ou edite um modelo
Selecione um cartão de modelo ou use + para adicionar um. Uma definição de modelo inclui:
- a conexão do provedor;
- um nome de exibição amigável e uma descrição opcional;
- o ID exato do modelo no provedor;
- o limite máximo de tokens de conclusão;
- modalidades de entrada e saída; e
- sinalizadores de capacidade, como raciocínio ou chamada de função.
Use o identificador exato esperado pelo provedor. O nome de exibição é apenas para pessoas; alterá-lo não altera o que o provedor executa. Não declare suporte a imagem, áudio, ferramentas ou raciocínio, a menos que esse modelo e endpoint realmente o ofereçam.
Crie um perfil de inferência
Abra Configurações → Configurações de IA → Perfis de inferência. Cada perfil é uma política de roteamento reutilizável. A visão geral mostra qual modelo atende cada slot configurado.
Edite um perfil para atribuir modelos aos recursos que você usa:
- Pensar é o modelo de texto geral necessário.
- Thinking (High-End) pode lidar com trabalhos que solicitam explicitamente o caminho de raciocínio mais capaz.
- Reconhecimento de imagem analisa imagens.
- Transcrição converte áudio em texto.
- Geração de imagens cria a arte das tarefas e outras imagens geradas. O caminho integrado atual de geração de imagens usa um provedor remoto configurado; portanto, escolha esse provedor e as referências que você envia com o mesmo cuidado de qualquer outra rota de inferência na nuvem.
Somente desktop oculta um perfil em plataformas móveis, o que é útil quando ele depende de um modelo acessível apenas a partir de uma estação de trabalho. A fixação de dispositivo serve para o processamento automatizado de áudio sincronizado: fixe somente quando o dispositivo selecionado anunciar os provedores de que o perfil precisa. Sem um dispositivo fixado, o áudio sincronizado não é transcrito automaticamente por esse perfil.
Escolha um modelo sem memorizar IDs
Os seletores de modelos começam pelo provedor e mostram apenas modelos salvos compatíveis. O seletor em um slot de perfil, por exemplo, não oferecerá um modelo somente de áudio para raciocínio de texto.
Defina um padrão de categoria
Uma categoria pode escolher um perfil de inferência padrão em Configurações → Definições → Categorias. Novos trabalhos nessa categoria podem então herdar uma política de roteamento coerente. Selecione o perfil cuja combinação de privacidade e capacidades corresponda à categoria, em vez de escolher apenas pela velocidade.
Rota do perfil legado
A rota autônoma mais antiga Perfis de inferência permanece disponível para compatibilidade e edita os mesmos registros de perfil armazenados. Ela expõe IDs internos de modelo e fornece menos contexto de dependência do que as configurações de IA; prefira, portanto, a página atual Configurações de IA → Perfis de inferência para a manutenção normal.
Continue com Habilidades de IA para ver como o perfil selecionado se torna uma ação em uma tarefa ou entrada.