GLM-4.6V é o modelo multimodal de código aberto mais recente da GLM, com uma janela de contexto de 128k. Ele apresenta chamada de função nativa, unindo a percepção visual com ações executáveis para fluxos de trabalho agentivos complexos, como busca na web e programação.
Descricao Detalhada
GLM-4.6V: IA multimodal open-source com janela de contexto de 128k! 🤯 Permite function calling nativo, conectando visão e ação para tarefas complexas como busca na web 🔎 e programação 💻. Ideal para workflows agentic! ✨
Principais Recursos
Modelo multimodal de código aberto
Janela de contexto de 128k tokens
Chamada de função nativa
Integração de percepção visual com ações executáveis
Capacidade para fluxos de trabalho complexos de agentes
Nenhum comentário ainda
Seja o primeiro a compartilhar seus pensamentos e iniciar a conversa!