A riqueza do HTML permite transmitir informações complexas de forma mais eficaz do que o Markdown, incluindo layouts, tabelas de dados e elementos interativos. Ele melhora a legibilidade ao organizar especificações em documentos bem estruturados e de fácil navegação, além de oferecer melhores capacidades de compartilhamento e interação. O Claude Code utiliza HTML para assimilar eficientemente o contexto de diversas fontes, auxiliando em especificações, prototipagem de design e na criação de interfaces de edição personalizadas com maior engajamento e clareza.

CEVIU IA
Lançamentos, inovações e pesquisas para profissionais de IA, machine learning e ciência de dados
2317 notícias
A ideia de uma "meia-vida de modelo", que os lançamentos de modelos de IA se tornariam cada vez mais rápidos, com o tempo de lançamento caindo pela metade a cada seis meses, não se sustenta sob análise. Embora o ritmo de lançamentos tenha de fato acelerado, essa taxa de redução não tem sido sustentada. Este artigo examina as datas de lançamento de vários dos modelos mais conhecidos e apresenta previsões para os próximos lançamentos, buscando um entendimento mais realista do ciclo de inovação.
No I/O 2026, o Google apresentou como os modelos Gemini estão sendo integrados em produtos de consumo, ferramentas criativas e plataformas de desenvolvedores. A empresa também revelou que o uso mensal de token em seus sistemas de IA cresceu para mais de 3,2 quatrilhões.
Andrej Karpathy anunciou sua entrada na Anthropic, afirmando que os próximos anos na "frontier" dos LLMs serão especialmente formativos para seu retorno à pesquisa e desenvolvimento. Karpathy destacou que continua apaixonado por educação e planeja retomar esse trabalho futuramente, sinalizando que a mudança é focada em pesquisa e não um afastamento permanente do ensino.
O Google lançou o Gemini 3.5 Flash, um novo modelo focado em workflows agentic, codificação e execução de tarefas de longo prazo. O lançamento também expandiu o acesso ao Gemini em diversas plataformas, incluindo Busca, ferramentas empresariais, Android Studio e as plataformas de desenvolvedores do Google.
O processo de Elon Musk contra Sam Altman e a OpenAI foi indeferido. Um júri decidiu que Musk esperou tempo demais para entrar com a ação judicial. Musk afirma que planeja recorrer.
Modelos de linguagem (LMs) demonstram mudanças imprevisíveis entre repetição de padrões e exibição de inteligência adaptativa durante o pré-treinamento, um fenômeno chamado "mode-hopping". Esse comportamento não pode ser corrigido por técnicas de otimização padrão e se manifesta como uma competição pela capacidade do modelo, influenciada pelos dados de cada janela de treinamento. Pesquisadores propõem aproveitar essas dinâmicas para selecionar melhor os checkpoints de pré-treinamento, organizar dados para stable generalization e avaliar métricas que prevejam o comportamento dos LMs.
O NVIDIA Cosmos Predict 2.5, capaz de gerar vídeos a partir de texto, está sendo adaptado para tarefas específicas como manipulação robótica. Isso é feito usando LoRA/DoRA para injetar adaptadores treináveis, minimizando o uso de memória. Esses métodos permitem um fine-tuning eficiente em uma única GPU, evitando o "esquecimento catastrófico" enquanto geram trajetórias sintéticas rapidamente. O fine-tuning com LoRA e DoRA melhora significativamente a qualidade do vídeo, com LoRA sendo mais adequado para condições de memória restrita e DoRA preferível para lidar com instabilidade de treinamento.
Os primeiros CPUs Nvidia Vera chegaram recentemente à Anthropic, OpenAI, SpaceXAI e Oracle. A entrega foi feita pessoalmente por Ian Buck, vice-presidente de Hyperscale e High-Performance Computing da Nvidia. O Vera apresenta 88 núcleos Olympus personalizados projetados pela Nvidia, largura de banda de memória de 1,2 TB/s e um desempenho por núcleo 50% mais rápido. Ele atua como processador host para o Vera Rubin NVL72, que se conecta a um par de GPUs Rubin via NVLink-C2C de segunda geração da Nvidia.
A censura política implementada no Qwen3.5-9B reside em um pequeno circuito nos pesos do modelo, que pode ser lido e desativado. O conhecimento factual já está presente no pré-treinamento, e o comportamento de censura é sobreposto a esses fatos. O modelo não perde o conhecimento, mas aprende a contorná-lo.
A Cursor lançou o Composer 2.5, uma versão atualizada de seu agente de codificação. Este agente foi treinado utilizando uma combinação de aprendizado por reforço direcionado, dados sintéticos e novas técnicas de treinamento distribuído, visando otimizar sua performance.
A avaliação de LLMs mudou de benchmarks estáticos para sistemas de agentes mais dinâmicos e realistas. Uma avaliação eficaz agora exige 'harnesses' realistas para testar agentes em ambientes complexos e por longos períodos. Isso é crucial, pois os agentes estão assumindo papéis de alta responsabilidade, como programação e medicina, o que requer medição rigorosa de desempenho e avaliação orientada a resultados.
O Qwen3.7 Preview já está disponível na Arena para capacidades de Texto e Visão. O modelo Qwen3.7 Max Preview alcançou a 13ª posição geral na Text Arena, enquanto o Qwen3.7 Plus Preview se classificou como o 16º na Vision Arena.
O Scheduled Tasks 2.0 aprimora a automação ao permitir que as tarefas sejam executadas com contexto, garantindo a continuidade dos fluxos de trabalho em diferentes projetos e aplicativos.
O Lovable agora permite que os usuários criem 'skills', que são instruções baseadas em markdown e totalmente reutilizáveis. Este recurso visa eliminar a necessidade de explicações repetitivas, otimizando o fluxo de trabalho ao encapsular comandos e procedimentos comuns em módulos facilmente acessíveis.
A Anthropic adquiriu a startup de ferramentas para desenvolvedores Stainless, cuja plataforma de automação de SDK era amplamente utilizada por empresas de IA, incluindo OpenAI, Google e Cloudflare.
Este post apresenta um padrão detalhado para a construção de bases de conhecimento pessoais utilizando Large Language Models (LLMs).
A xAI lançou o recurso "Skills" para o seu modelo Grok, que permite aos usuários ensinarem funções específicas uma única vez. Grok então retém e aplica esse aprendizado em interações futuras, abrangendo plataformas web, iOS e Android.
A OpenAI divulgou uma prévia de uma nova experiência de finanças pessoais no ChatGPT, disponível para usuários Pro nos EUA. O recurso permite que os usuários conectem suas contas financeiras de forma segura, visualizem painéis de gastos e façam perguntas com base em seu contexto e objetivos financeiros.
Se você prevê que precisará de um cache antes de 62.5 minutos, atualize-o. Caso contrário, deixe-o expirar. Esse número permanece constante entre os modelos e não muda, independentemente do tamanho do cache. O valor em dólares pode variar, mas o ponto de decisão é sempre o mesmo.





