Pular para o conteúdo
Rafael Dourado
Todas as notícias
via Hacker News

Qwen3.8-2.4T

Modelo Qwen 3.8‑2.4T lançado no Hugging Face, recebeu 577 pontos no Hacker News.

Imagem: Hacker News

O modelo Qwen 3.8‑2.4T, anunciado na plataforma Hugging Face, oferece 2,4 trilhões de parâmetros e suporte a inferência em FP8 A95B, permitindo otimizações de desempenho em GPUs NVIDIA.

Na comunidade Hacker News, o post sobre o modelo acumulou 577 pontos e 133 comentários, indicando forte interesse entre desenvolvedores e pesquisadores que buscam alternativas de grande escala para tarefas de NLP.

A versão está disponível no repositório “Qwen/Qwen3.8-2.4T-A95B-FP8”, onde usuários podem baixar o checkpoint, explorar exemplos de uso e contribuir com melhorias. O modelo pode ser integrado em pipelines de inferência com frameworks como PyTorch e TensorFlow, facilitando a adaptação a aplicações empresariais e de pesquisa.

modeloHuggingFaceHackerNews

Fonte original · Hacker News

Qwen3.8-2.4T

Este post é um resumo em português. A matéria completa está no site do publicador.

Receba as notícias por e-mail

Um resumo do que saiu de relevante em tecnologia, em português. Sem spam e sem repasse do seu e-mail para ninguém.

Continue lendo

  1. Alguém está realizando varreduras massivas de vulnerabilidades simulando bots de IA

  2. Astro 7: Rust Compiler, Rust Markdown Pipeline e Vite 8 para compilações até 61% mais rápidas

  3. DeepSeek V4 Pro 0813