Alibaba lança Qwen Image 2.1 com 7 bilhões de parâmetros e execução em RTX 3090
A empresa afirma que o modelo supera o Nano Banana 2.0, do Google, sem detalhar a metodologia da comparação
Capacidades, lançamentos e o que os benchmarks realmente dizem.
A empresa afirma que o modelo supera o Nano Banana 2.0, do Google, sem detalhar a metodologia da comparação
Empresa diz que a taxa de acerto do cache subiu e adiciona diagnóstico e controle manual de breakpoints, o que reduz latência e a conta de tokens de entrada
GPT-6 Luna sai a US$ 0,10 por milhão de tokens de entrada, um quinto do que a Anthropic cobra no Opus 5.5 lançado uma hora antes
Na leitura de Simon Willison, a categoria batizada de System One cobra só pela entrada e deixa a saída de graça, porque a saída é um punhado de floats
Medição da Artificial Analysis coloca o modelo da Xiaomi empatado com o Grok 4.7 (xHigh) e à frente do GLM-5.3 (max), além de proprietários como o Gemini 3.8 Flash
Empresa criou um grupo consultivo independente de matemáticos para decidir como divulgar os resultados e afirma que autoaperfeiçoamento recursivo autônomo não está acontecendo
Modelo aceita até dez imagens de referência e gera fundo transparente de forma nativa; a comparação com modelos fechados é da própria equipe Qwen
O Bonsai 2 27B cabe em um smartphone, segundo a TechCrunch, e ataca o custo de rodar modelo grande sem datacenter
Salto vem de 1% em março, segundo a empresa, que fala em colaboração do modelo em mais de 90% das tarefas sob supervisão humana próxima
Modelo da OpenAI avançou mais que qualquer outro sistema no teste, mas ficou horas em tarefa inútil depois de perder o equipamento para um Creeper
Pelo levantamento, o Kimi K3 fica atrás dos modelos fechados de ponta em alguns benchmarks e custa 30% do preço deles
Startup com US$ 40 mi captados treinou o sistema com o que chama de aprendizado por reforço para decisões calibradas, segundo o The Register
Na semana de 7 de setembro, usuários da plataforma de roteamento desembolsaram mais com modelos da OpenAI, algo que não acontecia desde fevereiro de 2024
Via proxies e serviços como o OpenRouter, o harness da Anthropic vira porta de entrada para modelos mais baratos, incluindo o GPT-5.6 Sol
Simon Willison publicou interface de navegador para os dois novos modelos de voz a voz e aponta formato parecido com os GPT-Live da OpenAI
Anunciado no Dreamforce, o modelo de raciocínio é especializado em vendas, marketing e suporte, e vai mover os agentes do Agentforce
Acesso ao modelo da Anthropic chega pelo Antigravity, e a empresa faz questão de dizer que o Gemini continua sendo a base do desenvolvimento interno
O desenvolvedor pediu rotas de corrida de 5 km e 10 km, recebeu GPX, GeoJSON e mapa embutido, e reclamou de não conseguir ver o código executado
Levantamento de Mohamed Moustafa, comentado por Simon Willison, mostra que o mesmo endpoint pode cair em provedores com capacidades diferentes
Modelo estreia uma arquitetura batizada de Causal Encoder-Decoder e é apresentado pela empresa como o menor do seu catálogo
Modelo permite conversa simultânea nos dois sentidos, vozes personalizadas e integração com linha telefônica, segundo o anúncio da empresa
Empresa descreve raciocínio avançado, operação de computador e melhor julgamento de escrita e design; nada disso passou por medição independente
A empresa afirma que já foram geradas mais de 3 bilhões de imagens entre o ChatGPT e os modelos GPT-Image
A AWS passa a oferecer o modelo de raciocínio da OpenAI no próprio motor de inference, ampliando a distribuição fora do Azure
As três notícias de IA que movem o dia, com a leitura pronta. Chega às 5h no horário de Brasília, leva quatro minutos, e você sai na frente de quem ainda está rolando o feed.