A Together AI lançou o Together Link, uma CLI gratuita e licenciada pelo MIT, agora em beta. Ela conecta os agentes de codificação que os desenvolvedores já utilizam a modelos abertos hospedados na Together AI. As ferramentas suportadas incluem Claude Code, Claude Desktop, Codex, ChatGPT Desktop, OpenCode e Pi. A ideia é simples: manter a estrutura, trocar o modelo e reduzir o custo. É implementável hoje? Sim. Ele é instalado com um comando no macOS ou Linux e precisa apenas de uma chave de API da Together. Está em beta, então os comandos, o roteamento e a lista de modelos podem mudar. O Problema que Alvo Agentes de codificação geralmente enviam cada tarefa para o mesmo modelo premium, desde uma correção de uma linha até uma reescrita completa. Em sua postagem de lançamento, a equipe da Together afirma que as organizações de engenharia gastam dezenas de milhares a milhões de dólares mensalmente em modelos fechados. Seu argumento é que os modelos abertos fecharam grande parte da lacuna. Kimi K3 e GLM 5.3 são voltados para trabalhos de codificação difíceis. GLM 5.3 Flash e DeepSeek V4.1 Flash cobrem tarefas diárias. Como o Together Link Funciona A instalação é um único comando: Copiar Código Copiado Use um Navegador diferente curl -fsSL https://link.together.ai/install | bash O instalador adiciona Bun, se necessário, e coloca os comandos em ~/.local/bin. Execute togetherlink para abrir um launcher, ou inicie uma ferramenta diretamente com togetherlink claude, togetherlink codex, togetherlink opencode ou togetherlink pi. Atalhos como tclaude também funcionam. De acordo com a documentação oficial, nenhum proxy local ou daemon é executado. Cada ferramenta se comunica diretamente com o gateway hospedado da Together. Os agentes de terminal recebem uma configuração temporária por lançamento que é removida quando a sessão termina. Claude Desktop e ChatGPT Desktop usam perfis separados e reversíveis. Comandos como togetherlink chatgpt off fazem a reversão. O Auto Router As sessões padrão são um modelo virtual automático. De acordo com a postagem de lançamento, o roteador lê a primeira tarefa de cada sessão. Correções rápidas vão para modelos rápidos e de baixo custo, enquanto problemas difíceis recebem capacidades de ponta. Com uma chave de API Anthropic, ele roteia entre Opus 5.5 e GLM 5.3. Sem
Fonte: MarkTechPost
Publicado em 2026-10-05