
Após um mês de uso intenso do DeepSeek 4.1 Flash em diversos projetos, posso afirmar que ele é extremamente eficiente e muito mais acessível do que os modelos "frontier". Durante as minhas sessões, se não olho o nome do modelo, não consigo distinguir se estou usando o DeepSeek ou o Opus. A velocidade, a qualidade das interações e a eficiência são comparáveis. Não me importo com a ausência de um modelo 4.1 "Pro", pois trato este como um modelo de ponta devido ao seu desempenho.
Os laboratórios de tecnologia devem estar se perguntando por que não estão em pânico. A China está prestes a ultrapassá-los. Embora estejam um ou dois meses atrás de empresas como Anthropic e OpenAI, os modelos chineses destilados são capazes de lidar com as mesmas cargas de trabalho. É verdade que houve questões sobre o uso indevido de dados de treinamento, mas muitos desenvolvedores estão apenas em busca do melhor custo-benefício.
Os modelos atuais são suficientemente bons para tarefas de alta qualidade que podem ser executadas sem supervisão. Perseguir a última novidade se torna um desperdício, considerando que as tarefas que atribuímos a esses modelos muitas vezes são absurdas. Com minha assinatura OpenCode Go de $10/mês, o DeepSeek se torna praticamente ilimitado. Isso transformou completamente minha maneira de desenvolver, permitindo tarefas repetitivas e testes exploratórios sem preocupações financeiras.
Utilizo também o DeepSeek 4.1 Flash para planejamento complexo e pesquisa. Para tarefas críticas, faço uso do Opus 5.5 para uma revisão final de código, que pode detectar algumas nuances. Quando preciso de uma nova perspectiva, acabo utilizando tanto o Opus quanto o GLM, mas a qualidade e a capacidade ficam em segundo plano em relação à adição de uma nova visão ao problema.
Uma das grandes inovações do DeepSeek é a redução do cache KV em aproximadamente 437 vezes em comparação ao modelo V1. Isso é crucial para manter os custos baixos em sessões longas de codificação, tornando minhas sessões diárias viáveis financeiramente. Além disso, essa eficiência pode ter um impacto ambiental positivo, já que o uso do Claude parece mais dispendioso em termos de recursos.
Embora eu tenha assinaturas de modelos de ponta, como Claude e Cursor, meu foco é no planejamento a longo prazo, sustentabilidade e democratização do acesso a inteligência de alta qualidade. Infelizmente, a indústria de tecnologia parece ignorar essas vitórias, acreditando que apenas o que é caro tem valor. Essa mentalidade leva a setups complexos para equilibrar várias assinaturas do Claude, resultando em frustrações quando não conseguem obter mais.
Para aqueles que pensam em auto-hospedagem, a economia oferecida pelo DeepSeek 4.1 Flash torna essa opção inviável. Se o objetivo é economizar, não se recuperará os custos. Porém, se a preocupação é a privacidade, boas notícias estão a caminho: as otimizações de cache estão sendo desenvolvidas para uso local. Embora o 4.1 Flash seja tecnicamente auto-hospedável, essa funcionalidade prática ainda está por vir, mas não deve demorar.
Confira os últimos vídeos publicados no canal