O modelo de linguagem VibeThinker-3B, com apenas 3 bilhões de parâmetros, obteve desempenho surpreendente em benchmarks de codificação, chegando a superar o Claude Opus 4.5 em algumas métricas. O resultado reacendeu o debate no ecossistema de IA sobre a confiabilidade desses testes como indicadores reais de capacidade, especialmente quando modelos menores batem grandes LLMs em tarefas específicas. Especialistas alertam que otimizações para benchmarks podem mascarar limitações práticas.
CEVIU News
As melhores notícias de tecnologia, curadas diariamente para quem vive tech.
819 notícias encontradas

A plataforma Blackwell da NVIDIA conquistou os melhores resultados no benchmark MLPerf Training 6.0, treinando modelos em escala inédita com até 8.192 GPUs. Inovações como o NVLink aprimorado e o formato de precisão reduzida NVFP4 otimizam o roteamento de modelos MoE e aceleram treinos massivos. Recursos nativos de confiabilidade, incluindo o Reliability, Availability, and Serviceability Engine e a NVIDIA Resiliency Extension, minimizam downtime e garantem recuperação ágil em ambientes de IA críticos.

ATUALIZAÇÃO (18/06/2026): não é mais rumor, foi lançado. 17 de junho de 2026. OpenAI está preparando o lançamento do GPT-Bidi-1, um novo modelo de voz para o ChatGPT que ouve (Rumor original) A OpenAI está preparando uma atualização significativa para o modo de voz do ChatGPT com o GPT-Bidi-1, um modelo de áudio bidirecional capaz de ouvir e falar simultaneamente. A inovação permite processar interrupções em tempo real e ajustar respostas enquanto fala, um avanço crucial para diálogos mais naturais e humanos. O modelo ainda está em fase de testes, mas já demonstra potencial para transformar a interação por voz com assistentes de IA.
Falhas no sistema podem gerar desperdício de tokens quando a conexão com o provedor de IA permanece ativa mesmo após erro no componente, o que continua consumindo recursos. A solução técnica recomendada é isolar essa conexão, interrompendo-a imediatamente ao detectar falha, para evitar cobranças desnecessárias durante o processamento. O foco está na eficiência operacional e no controle de custos em aplicações que usam APIs de IA.
Os small language models Phi Silica, desenvolvidos pela Microsoft para execução local em NPUs de PCs com Windows Copilot+, agora estão sendo testados também em GPUs da Nvidia. A expansão busca ampliar a acessibilidade e desempenho da IA no desktop, permitindo que mais usuários rodem modelos leves e eficientes diretamente no Windows, mesmo sem hardware específico da Microsoft. A iniciativa reforça o compromisso da empresa com inferência local robusta e compatibilidade multiplataforma.

A OpenAI apresentou o Deployment Simulation, técnica que simula cenários reais de uso, como conversas com usuários, para avaliar modelos candidatos antes do deploy. O método ajuda a prever comportamento em produção, detectar falhas de segurança e identificar riscos éticos ou operacionais que não surgiriam em testes tradicionais. A abordagem é parte da estratégia da empresa para aprimorar confiabilidade e safety de modelos de IA em escala.

Depois de anos de postura complacente, o governo dos EUA intensificou esforços regulatórios sobre IA, impulsionado pelos avanços de modelos avançados da Anthropic. A resposta federal foi classificada como excessivamente rígida e avessa a riscos, um contraste nítido com a abordagem histórica do setor. Hoje, a ausência de clareza nas políticas públicas e os embates contínuos entre a administração e a Anthropic seguem sem desfecho, criando incerteza para desenvolvedores e reguladores.

O Codex da OpenAI passou a suportar o Chrome DevTools Protocol (CDP), permitindo acesso direto ao navegador para profiling de desempenho de JavaScript e modificações dinâmicas em sites. O recurso, ainda em fase inicial e ativado via opt-in, não está disponível no Espaço Econômico Europeu, Reino Unido e Suíça. Apresenta limitações de performance e exige precisão nos prompts para uso seguro e eficaz.

O Cursor Origin é uma nova plataforma Git projetada especificamente para operar em escala de agentes de IA, não de humanos. Diferente do GitHub, concebido para desenvolvedores, o Origin suporta simultaneamente clonagem, ramificação, commit, rebase, revisão de código e correção de falhas executadas por múltiplos agentes. A ideia é dominar a 'fábrica de software baseada em IA', oferecendo infraestrutura nativa para workflows autônomos, escaláveis e coordenados entre modelos e agentes.
O Qwen-RobotWorld é um world model de vídeo condicionado por linguagem, desenvolvido pela equipe do Qwen, que usa a língua natural como interface unificada para ações, aplicável em robótica, navegação autônoma, direção veicular e outros domínios físicos. O modelo integra percepção multimodal e raciocínio sequencial, permitindo simular e prever estados do mundo com base em comandos textuais. Publicado no arXiv, o trabalho representa um avanço na convergência entre modelos de linguagem, world modeling e controle físico realista.

O Android 17 traz avanços estruturais para IA local com a introdução de AppFunctions e o Android MCP, novos frameworks que permitem aplicativos exporem ferramentas orquestráveis, descobríveis e executáveis diretamente por agentes de IA rodando no dispositivo. Segundo o Google, essa mudança marca uma virada rumo a um 'sistema de inteligência', com IA integrada de forma nativa em toda a pilha do sistema operacional, não apenas como camada superficial.
A DeepSeek levantou mais de US$ 7,4 bilhões em uma rodada que a avaliou em mais de US$ 50 bilhões, tornando-a a startup de IA mais valiosa da China. Seu fundador, Liang Wenfeng, aportou cerca de US$ 3 bilhões e mantém quase 90% da empresa. Um fundo governamental participou com US$ 150 milhões. Os recursos serão direcionados a P&D avançado e expansão da infraestrutura computacional.

A Qualcomm está desenvolvendo mais de 40 dispositivos vestíveis com foco em IA e anunciou duas iniciativas estratégicas: a plataforma Snapdragon Reality Elite, voltada para óculos de realidade mista, e o Scalable Turnkey AI-Ready toolkit, um pacote integrado de hardware e software para acelerar o desenvolvimento de dispositivos com IA. O objetivo é se tornar a camada de silício fundamental para a próxima geração de tecnologias pós-smartphone, explorando formatos inovadores impulsionados por IA.

Artigo técnico sobre a infraestrutura e o conjunto de ferramentas necessários para o desenvolvimento e implantação de agentes de IA.
A Vercel anunciou o lançamento do eve, um framework de código aberto projetado para facilitar o desenvolvimento de agentes.

O artigo descreve a integração entre o Hugging Face Hub e o hardware robótico utilizando Strands Agents e a biblioteca LeRobot.
O NVIDIA XR AI agora está disponível em beta público, oferecendo aos desenvolvedores um framework para a criação de agentes de IA multimodais para óculos de AR e dispositivos de XR.

O governo do Reino Unido formou uma parceria com o Google DeepMind para criar um protótipo baseado em IA destinado a agilizar as decisões sobre habitação.
As empresas estão movendo a IA agentic da fase de proof of concept para a produção, e a nova geração de fábricas de IA foi construída para a era dos agentes. Durante o evento HPE Discover em Las Vegas, que ocorre até quinta-feira, 18 de junho, a NVIDIA e a HPE expandiram a HPE AI Factory com NVIDIA, incluindo a CPU NVIDIA Vera e o NVIDIA Agent Toolkit.
Lin Qiao, CEO da Fireworks, usou o fechamento da Mythos para redefinir a discussão sobre modelos abertos, migrando o foco de economia para soberania tecnológica. Segundo ela, empresas que operam em cima de IA alugada ficam vulneráveis a decisões externas sobre modelos, atualizações e políticas. O caso prático da Fireworks com Ramp, Cursor e Harvey mostra que fine-tuning em modelos abertos alcança qualidade de frontier a fração do custo, mas a pergunta central persiste: quem realmente controla a inteligência que sustenta seu produto?
