DeepSeek V4.1 Flash liest Bilder und bleibt gratis

DeepSeek V4.1 Flash lê imagens

A DeepSeek lançou o V4.1 Flash, um modelo pequeno que entende imagens e supera nos testes o V4 Pro, maior, com uma diferença tão clara que a DeepSeek está encerrando o modelo Pro. No ChatX, o V4.1 Flash é gratuito, inclusive para visitantes. As perguntas principais em formato curto.

O que há de novo no V4.1 Flash?

O DeepSeek V4.1 Flash é o primeiro modelo de uma nova família de arquitetura. Ele usa apenas uma pequena parte dos parâmetros por solicitação, o que o deixa rápido e barato. Em conversas longas, precisa de uma fração da memória da geração anterior. A DeepSeek repassou essa economia em uma redução de preço no dia 10 de setembro. Também é novidade a compreensão de imagens embutida: um codificador de imagens próprio foi treinado desde o início junto com o modelo de linguagem, algo que na DeepSeek existia apenas como experimento.

Por que o V4 Pro está saindo?

A DeepSeek afirma que testes de várias partes colocam o V4.1 Flash à frente do V4 Pro em qualidade, custo, velocidade e tempo total. Desde 14 de setembro todas as solicitações ao V4 Pro são redirecionadas para o V4.1 Flash e o modelo Pro está sendo encerrado. Por isso, no ChatX restou apenas uma entrada da DeepSeek, o V4.1 Flash. O que diferenciava o V4 Pro, o raciocínio detalhado antes da resposta, agora é uma chave dentro do mesmo modelo. É incomum um fornecedor substituir o modelo mais caro por um mais barato em vez de manter os dois.

O que dá para fazer com imagens?

A documentação cita três casos: descrever imagens, ler texto de imagens e interpretar gráficos. Na prática, no ChatX isso significa:

  • Capturas de tela: fotografar uma mensagem de erro e perguntar o que ela quer dizer, ou enviar um trecho de planilha e pedir os valores em texto.
  • Gráficos: enviar um gráfico de barras ou de linhas e pedir a explicação da tendência ou a estimativa dos números.
  • Fotos: traduzir cardápios, placas ou formulários, ou pedir a descrição de uma foto para gerar um texto alternativo.

Letra manuscrita e tipos muito pequenos são o limite. Nesses casos, o Gemini 3.8 Flash ou o Sol são mais confiáveis.

Qual a diferença para o outro modelo gratuito?

No ChatX há dois modelos gratuitos: GPT-5 nano e DeepSeek V4.1 Flash. A diferença é clara:

  • GPT-5 nano: só texto, muito rápido, bom para perguntas curtas, traduções e reescritas simples. Sem imagens.
  • DeepSeek V4.1 Flash: entende imagens, é bem mais forte em programação e análises e organiza melhor as respostas longas. Em troca, é um pouco mais lento.

Quem começa como visitante se dá melhor com a DeepSeek em quase tudo. Só em perguntas bem curtas o nano termina antes.

A que vale prestar atenção?

  • Proteção de dados: as respostas da DeepSeek passam por servidores na China. Para conteúdo confidencial, isso deve pesar na escolha do modelo.
  • O raciocínio vem desligado: o V4.1 Flash responde direto. Com assinatura ou tokens comprados, você pode colocar «Profundidade do raciocínio» em «Alta». O modelo passa a pensar antes de responder, o que ajuda bastante em cálculos, código e perguntas de vários passos. Para visitantes e contas sem saldo, fica o modo direto e rápido.
  • Limite para visitantes: como visitante, o tamanho da resposta é limitado. Para textos longos ou código, vale criar uma conta. O modelo continua gratuito de qualquer forma.

O V4.1 Flash mostra para onde o mercado caminha. Os modelos pequenos estão alcançando os grandes e a compreensão de imagens vira padrão, inclusive nos gratuitos.


Publicado

em

por

Tags: