Anthropic lança Claude 4.6 Sonnet com contexto de 1 milhão de tokens para resolver codificação comp…

A Anthropic está oficialmente entrando em sua era 'Pensamento'. Hoje, a empresa anunciou o Claude 4.6 Sonnet, um modelo projetado para transformar a forma como desenvolvedores e cientistas de dados lidam com lógicas complexas. Juntamente com este lançamento, vem a Pesquisa Web Aprimorada com Filtragem Dinâmica, um recurso que usa execução interna de código para verificar fatos em tempo real. https://www.anthropic.com/news/claude-sonnet-4-6 Pensamento Adaptativo: Um Novo Motor Lógico A principal atualização no Claude 4.6 Sonnet é o motor de Pensamento Adaptativo. Acessado através da API de pensamento estendido, isso permite que o modelo 'pausar' e raciocinar sobre um problema antes de gerar uma resposta final. Em vez de ir direto para o código, o modelo cria monólogos internos para testar caminhos lógicos. Você pode ver isso na nova interface Thought (Pensamento). Para um desenvolvedor depurando uma condição de corrida complexa, isso significa que o modelo identifica a causa raiz em sua fase de 'pensamento' em vez de adivinhar na saída do código. Isso melhora as tarefas de limpeza de dados. Ao processar um conjunto de dados desordenado, o 4.6 Sonnet gasta mais tempo de computação analisando casos de borda e inconsistências de esquema. Esse processo reduz significativamente as 'alucinações' comuns em modelos mais rápidos e não-racionais. Os Benchmarks: Reduzindo a Lacuna com o Opus Os dados de desempenho do 4.6 Sonnet mostram que ele agora está no encalço do modelo carro-chefe Opus. Em muitas categorias, ele é o modelo 'burro de carga' mais eficiente atualmente disponível. Categoria do Benchmark Claude 3.5 Sonnet Claude 4.6 Sonnet Melhoria Chave SWE-bench Verificado 49,0% 79,6% Otimizado para correção de bugs complexos e edição de múltiplos arquivos. OSWorld (Uso de Computador) 14,9% 72,5% Ganho massivo na navegação autônoma da UI e uso de ferramentas. MATH 71,1% 88,0% Raciocínio aprimorado para lógica algorítmica avançada. BrowseComp (Pesquisa) 33,3% 46,6% Precisão aprimorada via filtragem dinâmica nativa baseada em Python. A pontuação de 72,5% no OSWorld é um grande destaque. Isso sugere que o Claude 4.6 Sonnet agora pode navegar em planilhas, navegadores da web e arquivos locais com precisão quase humana. Isso o torna um candidato principal para a construção de agentes autônomos de 'Uso de Computador'. Pesquisa Encontra Python: Filtragem Dinâmica A Pesquisa Web Aprimorada com Filtragem Dinâmica da Anthropic muda a forma como a AI interage com a web ao vivo. A maioria das ferramentas de pesquisa de AI apenas rastreia os primeiros resultados que encontram. O Claude 4.6 Sonnet segue um caminho diferente. Ele usa uma sandbox de execução de código Python para pós-processar os resultados da pesquisa. Se você pesquisar por uma atualização de biblioteca de

Fonte: MarkTechPost

Publicado em 2026-02-17

Notícias relacionadas

Continue explorando