Pular para o conteúdo principal

Rotear trabalho com modelos e perfis

Um provedor informa ao Lotti onde se conectar. Um modelo registra um ID de modelo do provedor e suas capacidades. Um perfil de inferência então atribui esses modelos aos trabalhos que o Lotti entende. Isso mantém a pergunta “qual modelo lida com áudio?” fora de cada tarefa individual e regra de automação.

Revise os modelos salvos

Abra Configurações → Configurações de IA → Modelos. A lista agrupa os modelos por provedor e expõe filtros de capacidade para texto, visão, áudio e raciocínio.

Todas as capturas de tela
O espaço de trabalho do Project Waddle combina modelos locais e de nuvem, mantendo explícitos os recursos de cada modelo.
Captura de telaVisualização para celular
Lista de modelos de IA do Lotti com modelos de texto, raciocínio, visão, transcrição e geração de imagens do Project Waddle

O controle Agente simultâneo é ativado na parte superior das configurações de IA limita quantos agentes diferentes podem executar inferência ao mesmo tempo. Um valor mais alto pode melhorar a vazão, mas também aumenta as solicitações simultâneas ao provedor e a carga no dispositivo local. Seja conservador quando um provedor tiver limites de taxa rígidos ou quando um servidor de modelo local tiver memória limitada.

Adicione ou edite um modelo

Selecione um cartão de modelo ou use + para adicionar um. Uma definição de modelo inclui:

  • a conexão do provedor;
  • um nome de exibição amigável e uma descrição opcional;
  • o ID exato do modelo no provedor;
  • o limite máximo de tokens de conclusão;
  • modalidades de entrada e saída; e
  • sinalizadores de capacidade, como raciocínio ou chamada de função.
Todas as capturas de tela
Os metadados de capacidade são importantes: o Lotti os utiliza para decidir quais modelos são elegíveis para cada slot de perfil e cada seletor avulso.
Captura de telaVisualização para celular
Editor de modelo Lotti para Waddle Command 70B mostrando provedor, ID do modelo do provedor, limite de conclusão, modalidades e capacidade de raciocínio

Use o identificador exato esperado pelo provedor. O nome de exibição é apenas para pessoas; alterá-lo não altera o que o provedor executa. Não declare suporte a imagem, áudio, ferramentas ou raciocínio, a menos que esse modelo e endpoint realmente o ofereçam.

Crie um perfil de inferência

Abra Configurações → Configurações de IA → Perfis de inferência. Cada perfil é uma política de roteamento reutilizável. A visão geral mostra qual modelo atende cada slot configurado.

Todas as capturas de tela
Os perfis podem ser otimizados para diferentes limites: um perfil amplo de nuvem, um perfil local somente para desktop ou um perfil de raciocínio especializado.
Captura de telaVisualização para celular
Perfis de inferência do Lotti para Project Waddle Command, Habitat Local-First e Fish Diplomacy com seus modelos roteados

Edite um perfil para atribuir modelos aos recursos que você usa:

  • Pensar é o modelo de texto geral necessário.
  • Thinking (High-End) pode lidar com trabalhos que solicitam explicitamente o caminho de raciocínio mais capaz.
  • Reconhecimento de imagem analisa imagens.
  • Transcrição converte áudio em texto.
  • Geração de imagens cria a arte das tarefas e outras imagens geradas. O caminho integrado atual de geração de imagens usa um provedor remoto configurado; portanto, escolha esse provedor e as referências que você envia com o mesmo cuidado de qualquer outra rota de inferência na nuvem.
Todas as capturas de tela
Um perfil roteia cada modalidade do Project Waddle sem repetir escolhas de modelo entre tarefas.
Captura de telaVisualização para celular
Editor de perfil do Project Waddle Command atribuindo modelos de pensamento, raciocínio sofisticado, reconhecimento de imagem, transcrição e geração de imagem

Somente desktop oculta um perfil em plataformas móveis, o que é útil quando ele depende de um modelo acessível apenas a partir de uma estação de trabalho. A fixação de dispositivo serve para o processamento automatizado de áudio sincronizado: fixe somente quando o dispositivo selecionado anunciar os provedores de que o perfil precisa. Sem um dispositivo fixado, o áudio sincronizado não é transcrito automaticamente por esse perfil.

Escolha um modelo sem memorizar IDs

Os seletores de modelos começam pelo provedor e mostram apenas modelos salvos compatíveis. O seletor em um slot de perfil, por exemplo, não oferecerá um modelo somente de áudio para raciocínio de texto.

Todas as capturas de tela
Escolha primeiro o provedor; o Lotti então restringe a próxima página aos modelos elegíveis dessa conexão.
Captura de telaVisualização para celular
Modal Escolha um modelo do Lotti listando os provedores OpenRouter, Ollama e Google Gemini sobre o editor de perfil do Project Waddle

Defina um padrão de categoria

Uma categoria pode escolher um perfil de inferência padrão em Configurações → Definições → Categorias. Novos trabalhos nessa categoria podem então herdar uma política de roteamento coerente. Selecione o perfil cuja combinação de privacidade e capacidades corresponda à categoria, em vez de escolher apenas pela velocidade.

Todas as capturas de tela
O selo somente para desktop torna as restrições de plataforma visíveis antes que o padrão de uma categoria seja selecionado.
Captura de telaVisualização para celular
Editor da categoria Penguin Operations com um modal que oferece os perfis Project Waddle Command, Habitat Local-First e Fish Diplomacy

Rota do perfil legado

A rota autônoma mais antiga Perfis de inferência permanece disponível para compatibilidade e edita os mesmos registros de perfil armazenados. Ela expõe IDs internos de modelo e fornece menos contexto de dependência do que as configurações de IA; prefira, portanto, a página atual Configurações de IA → Perfis de inferência para a manutenção normal.

Todas as capturas de tela
Use esta tela de compatibilidade somente quando um link mais antigo o levar até lá; os cartões de perfil atuais das configurações de IA são mais fáceis de auditar.
Captura de telaVisualização para celular
Página legada de Perfis de inferência do Lotti mostrando slots de perfil do Project Waddle como identificadores internos de modelo

Continue com Habilidades de IA para ver como o perfil selecionado se torna uma ação em uma tarefa ou entrada.