O Spotify lançou o Vedder, assistente de dados baseado em IA usado por mais de 2.100 usuários em 177 clusters, superando soluções RAG puramente esquemáticas em mais de 70.000 datasets. Cada cluster é cuidadosamente curado por especialistas de domínio, que fornecem datasets, pares validados de pergunta-SQL e documentação de negócio. Apenas 12,5% dos pares minerados foram aprovados; o sistema usa uma pontuação de saúde para monitorar drift, validade, cobertura e reprodutibilidade, assegurando confiabilidade contínua do contexto.
CEVIU News
As melhores notícias de tecnologia, curadas diariamente para quem vive tech.
15504 notícias encontradas
Agentes de codificação com IA aliviam tarefas repetitivas, mas não resolvem os desafios centrais do desenvolvimento: julgamento de arquitetura, controle de escopo, testes robustos e manutenibilidade. Ao reduzir a complexidade acidental, podem, paradoxalmente, gerar dívida técnica, desvios arquiteturais e bases de código infladas, e rápido. A vantagem competitiva continua com engenheiros especializados, capazes de orientar modelos, estabelecer guardrails e garantir sistemas prontos para produção.

O LinkedIn desenvolveu o MUSE (Member Understanding Semantic Embeddings), um sistema de busca semântica para seu Hiring Assistant. Baseado em um modelo de embedding Matryoshka dual-tower, ele é treinado com milhões de rótulos de alta qualidade gerados por um LLM Teacher alinhado às políticas do produto. O MUSE combina retrieval via embeddings com um ranker downstream otimizado para engajamento, solução crítica para agentes de IA que operam em larga escala com dados de membros.
O Google Research apresentou os testes de Kernel de f-Divergência Regularizada, um novo framework para auditoria de machine unlearning que detecta vazamentos de privacidade com precisão superior aos tradicionais testes de duas amostras. A abordagem melhora a confiabilidade na verificação de se um modelo realmente esqueceu dados sensíveis após solicitação de exclusão, requisito crítico para conformidade com regulamentações como LGPD e GDPR.
A Linux Foundation anunciou o projeto OpenSharing, que amplia o protocolo Delta Sharing, agora sob sua governança após transferência da Databricks. O novo padrão suporta não só dados estruturados, mas também modelos de IA, habilidades de agentes e dados não estruturados, com APIs abertas para descoberta, autorização e acesso. Ele integra destinatários do Delta Sharing e clientes de catálogos Apache Iceberg/REST, visando substituir marketplaces proprietários por uma única camada interoperável para distribuição de ativos de IA empresarial.
Aprenda a utilizar os comandos de barra para controlar seu agente de IA no terminal. O artigo explora as funcionalidades básicas do GitHub Copilot CLI para iniciantes.

O AWS WAF lançou a monetização de tráfego de IA, um novo recurso do Bot Control que permite a provedores de conteúdo e publicadores precificar, medir e cobrar pagamentos de bots e agentes de IA que acessam seus conteúdos e APIs. O AWS WAF agora permite definir preços para esse acesso, aceitar pagamentos por meio de provedores terceiros e conceder acesso escopado diretamente na borda.
O Google anunciou um investimento de 1,5 bilhão de dólares para 2026 e 2027 com o objetivo de expandir seu campus de data centers em Jackson County, no Alabama. A unidade opera desde 2019 em uma estrutura reaproveitada.
A Vercel anunciou que as Vercel Functions agora suportam um tempo máximo de execução de até 30 minutos.

A Cloudflare está aprofundando seus investimentos em IA com a contratação de membros da equipe da Ensemble AI, focando em infraestrutura e eficiência de machine learning.

ATUALIZAÇÃO (15/06/2026): não é mais rumor, foi lançado. 16/03/2026, NVIDIA Vera Rubin foi anunciada como a próxima plataforma de IA, incluindo a CPU NVIDIA Vera e a GPU NVIDIA Rubin, e já está em plena produção para as maiores fábricas de IA do mundo. A plataforma Vera Rubin unifica sete novos chips, incluindo a CPU Vera, GPU Rubin, NVLink 6, ConnectX-9 SuperNIC, BlueField-4 DPU e Spectrum-6 Ethernet, além da recém-integrada LPU NVIDIA Groq 3. Produtos baseados na plataforma Vera Rubin estarão disponíveis a partir do segundo semestre de 2026 através de parceiros como Amazon Web Services, Google Cloud, Microsoft Azure e Oracle Cloud Infrastructure. LANCADO: 01/06/2026, A NVIDIA lançou o chip RTX Spark para PCs pessoais com IA, prometendo levar funções avançadas de IA diretamente para notebooks e computadores de mesa. O CEO da NVIDIA, Jensen Huang, anunciou a novidade na Computex, afirmando que a Microsoft e a NVIDIA irão "reinventar o PC" para a era da IA. Novos modelos de PCs com o RTX Spark de marcas como Microsoft e Dell estão previstos para chegar ao mercado ainda este ano. LANCADO: 18/03/2024, A plataforma NVIDIA Blackwell, incluindo o B200 e o superchip GB200 Grace Blackwell, foi lançada para impulsionar a era da computação de IA. Os sistemas GB200 NVL72 começaram a ser enviados para os principais provedores de nuvem em dezembro de 2024, com a produção em massa aumentando no segundo e terceiro trimestres de 2025. O Blackwell Ultra, uma iteração aprimorada, foi apresentado em março de 2025 na GTC e começou a ser enviado em setembro de 2025. (Rumor original) A NVIDIA mantém dois eixos de atuação para seus chips de IA, combinando lançamentos recentes e expectativas para o segundo semestre de 2026. Entre as novidades concretas, o chip B200 com arquitetura Blackwell já foi introduzido, enquanto o RTX Spark, voltado para laptops e PCs Windows com foco em agentes de IA, foi anunciado em junho de 2026. No campo das expectativas, a plataforma Vera Rubin, sucessora da Blackwell, está prevista para o final de 2026, prometendo ganhos em eficiência e custos. Esta nova geração incluirá componentes como a CPU Vera e a GPU Rubin, com o objetivo de reduzir a necessidade de hardware em treinos de modelos complexos, contando já com o interesse de empresas como OpenAI, Anthropic e SpaceX.

ATUALIZAÇÃO (15/06/2026): não é mais rumor, foi lançado. **Família Mistral 3 e Mistral Large 3**: Lançados em 2 de dezembro de 2025, estes modelos representam a próxima geração de modelos abertos, multimodais e multilíngues da Mistral AI. Mistral Large 3 é um modelo de mixture-of-experts (MoE) com 41 bilhões de parâmetros ativos e 675 bilhões de parâmetros totais, lançado sob a licença Apache 2 (Rumor original) A Mistral AI atualizou recentemente seu ecossistema com o Mistral Medium 3.5, Mistral Small 4 e a plataforma Forge. Enquanto esses lançamentos consolidam capacidades multimodais, de raciocínio e de codificação, a expectativa agora gira em torno de variantes futuras. A comunidade aguarda uma versão de raciocínio do Mistral Large 3, considerada iminente, e especula sobre uma nova geração denominada Mistral 4, com potencial para competir com modelos de ponta. Adicionalmente, a empresa planeja introduzir a classe de modelos Physics AI para prever sistemas físicos e o Vibe, um agente unificado para produtividade e codificação, que incluirá modos dedicados e uma extensão para VS Code.
ATUALIZAÇÃO (15/06/2026): não é mais rumor, foi lançado. 18 de setembro de 2025 (roadmap inicial), março de 2026 (Ascend 950PR), agosto de 2026 (Ascend 950DT) A Huawei anunciou oficialmente em 18 de setembro de 2025 um roteiro de chips Ascend de longo prazo na conferência Huawei Connect, detalhando quatro novos produtos para os próximos três anos: Ascend 950PR e 950DT para o início de 2026, seguidos pelo Ascend 960 e 970 em 2027 e 2028, respectivamente. O chip Ascend 950PR iniciou sua produção em massa em março de 2026 e já garantiu a maioria dos pedidos para o ano, focando em cargas de trabalho de inferência. O próximo chip, Ascend 950DT, será lançado oficialmente na Huawei Cloud em agosto de 2026 e em uso no quarto trimestre, apresentando poder de computação vetorial aprimorado, maior largura de banda de memória e suporte nativo para formatos de baixa precisão como FP8. (Rumor original) A Huawei continua expandindo sua linha de chips de inteligência artificial Ascend e capacidades de IA nos processadores móveis Kirin. Atualmente, a empresa já distribui o Ascend 910B e o 910C, com desempenho comparável aos modelos A100 e H100 da NVIDIA, respectivamente, além do Ascend 950PR, otimizado para inferência e recomendação. Para o futuro, o roadmap inclui o lançamento do Ascend 950DT na Huawei Cloud em 2026, com foco em cargas de trabalho de decodificação e treinamento. As próximas gerações, Ascend 960 e 970, prometem dobrar as especificações de computação e memória entre 2027 e 2028. No setor móvel, o chip Kirin 2026, previsto para o final de 2026 com a série Mate 90, utilizará a nova arquitetura LogicFolding para melhorar a densidade de transistores e suportar modelos de até 30 bilhões de parâmetros em dispositivos.

A AWS mantém um modelo de precificação flexível para serviços de IA, oferecendo planos de compromisso e descontos por volume. Desde 2025, a empresa expandiu opções de preços fixos e introduziu recursos como o Amazon Quick e a reestruturação do Amazon Connect em produtos voltados para sistemas agentic. O Amazon Bedrock, por sua vez, conta com diversas camadas de precificação e inferência em lote com custo reduzido. Em 2026, a AWS intensificou o foco em eficiência com o lançamento do AWS FinOps Agent e o uso de silício personalizado, como os processadores Graviton5, visando otimizar a infraestrutura computacional para cargas de trabalho de IA.

ATUALIZAÇÃO (15/06/2026): não é mais rumor, foi lançado. 2023 A SMIC tem avançado significativamente na produção de chips de IA, com marcos importantes já alcançados e anunciados. Em 2023, a SMIC lançou a produção em massa de seu processo de 7 nanômetros (N+2), que foi validado com o lançamento do chip de smartphone Kirin 9000 S da Huawei e, posteriormente, do chip de IA Ascend 910 B. Em dezembro de 2025, a SMIC alcançou a produção em volume de seu nó N+3, que é equivalente à classe de 5 nanômetros, sem a necessidade de ferramentas de litografia de ultravioleta extremo (EUV). Esta tecnologia foi confirmada no processador Kirin 9030 da Huawei, lançado em novembro de 2025 no smartphone Mate 80 Pro Max. A SMIC também está em execuções piloto para seu processo de 5 nanômetros, visando a produção em massa em 2026 para os processadores de IA de próxima geração da Huawei e Alibaba. Em dezembro de 2025, a SMIC expandiu suas parcerias de chips de IA de ponta ao colaborar com o Alibaba Group para desenvolver e fabricar um novo chip de 5 nanômetros personalizado para cargas de trabalho de inferência de IA. (Rumor original) A SMIC já produz chips de IA em 7nm (processo N+2), presentes nos processadores Kirin 9000S, 9020 e Ascend 910C da Huawei, com certificação para uso governamental desde maio de 2026. Para o futuro, a empresa foca no desenvolvimento do nó de 5nm, visando a produção em massa em 2026 para atender chips da Huawei e da Alibaba, incluindo o Ascend 910C. Além disso, a SMIC está expandindo sua capacidade em 7nm e implementando o processo N+3, que busca desempenho equivalente a 5nm sem litografia EUV, conforme observado no Kirin 9030.
ATUALIZAÇÃO (15/06/2026): não é mais rumor, foi lançado. 27 de maio de 2026. A China incluiu oficialmente chips de inteligência artificial em sua lista de avaliações de tecnologia "segura e confiável", certificando nove modelos domésticos para aquisição por órgãos governamentais. As certificações foram emitidas conjuntamente pelo Centro de Avaliação de Segurança de Tecnologia da Informação da China e pelo Centro Nacional de Avaliação de Ciência e Tecnologia de Sigilo, com validade de três anos. Entre os produtos aprovados estão os processadores Ascend 310 e Ascend 910 da Huawei, e os T-Head Zhenwu M530 e M890 da Alibaba, destacando o impulso da China para reduzir a dependência de tecnologia estrangeira. (Rumor original) O mercado chinês de chips de IA avança em direção à autossuficiência tecnológica com o lançamento e a certificação de diversos processadores voltados para aquisições governamentais. Entre os destaques estão empresas como Huawei, com suas linhas Ascend, além de Alibaba, Cambricon, DeepSeek e Iluvatar CoreX, que buscam competir com tecnologias globais de alto desempenho. A infraestrutura é consolidada por fundições como a SMIC, que utiliza processos de 7nm para viabilizar a produção local desses aceleradores de IA. A Huawei, em particular, detalhou um cronograma de lançamentos futuros, incluindo o Ascend 950DT, que promete melhorias em computação vetorial e suporte nativo a formatos de precisão reduzida, com expansão prevista para o ecossistema de cloud até o final de 2026.

Esta semana, a cidade de Nova York sedia o AWS Summit, reunindo desenvolvedores, clientes e equipes da AWS para um dia completo de anúncios, demonstrações e sessões técnicas no Javits Center. O autor escreveu posts sobre alguns lançamentos do Summit que estão entrando em operação nesta semana.
O Auth0 agora está disponível no Vercel Marketplace, facilitando a integração da plataforma de autenticação com projetos na Vercel.

ATUALIZAÇÃO (16/06/2026): não é mais rumor, foi lançado. 11/06/2026 (data provável com base em relatórios) A OpenAI lançou o GPT-5.6 este mês, com (Rumor original) O modelo mais recente da OpenAI, o GPT-5.5 (codinome Spud), foi lançado em abril de 2026. Agora, surgem especulações sobre o desenvolvimento do GPT-5.6, com previsão de lançamento para junho de 2026. Segundo Jakub Pachocki, cientista-chefe da OpenAI, o modelo trará melhorias significativas. Internamente, ele é testado sob codinomes como Kindle, Kepler e, mais recentemente, Levi. O foco desta versão deve ser escalabilidade, acessibilidade, geração de interface de usuário, compreensão de imagens e fluxos de trabalho de codificação aprimorados. Além disso, Sam Altman indicou que o intervalo entre o GPT-5 e o GPT-6 será menor do que a lacuna observada entre as versões anteriores, sugerindo o lançamento do GPT-6 até o final de 2027.

ATUALIZAÇÃO (14/06/2026): não é mais rumor, foi lançado. 20 de fevereiro de 2026. A Alibaba lançou o Qwen-3.5, com uma versão open-weight e outra hospedada na nuvem (Qwen-3.5-Plus). Este modelo foca em agentes de IA, multimodalidade e custos reduzidos, buscando maior adoção internacional. O Qwen-3.5-Open-Source, com 397 bilhões de parâmetros, demonstrou melhorias significativas em relação ao modelo anterior, Qwen-3-Max-Thinking, e o Qwen-3.5-Plus alcançou desempenho comparável a modelos líderes. Outros lançamentos recentes incluem: * **Qwen3.6-35B-A3B e Qwen3.6-27B**: Lançados em abril de 2026. * **Qwen3.7 Max e Qwen3.7 Plus**: Lançados em 18 de maio de 2026. * **Qwen 3-Max**: Um modelo proprietário com mais de 1 trilhão de parâmetros, treinado com aproximadamente 36 trilhões de tokens, disponível via API, e sua variante de raciocínio, Qwen3-Max-Thinking, capaz de gerar texto, imagens ou vídeo. * **Qwen-VL 3 (Vision-Language)**: Integrado diretamente aos pesos principais do Qwen 3, oferece "Multimodalidade Nativa", permitindo que o modelo raciocine sobre imagens e texto no mesmo espaço de alta dimensão. (Rumor original) A linha de modelos Qwen da Alibaba Cloud tem apresentado lançamentos frequentes, incluindo o Qwen3.7-Plus, focado em agentes multimodais, e o Qwen3.7-Max, voltado para raciocínio complexo. O ecossistema recente também conta com modelos como Qwen3.5-Omni e Qwen3-Coder-Next. Sobre os próximos passos, existem rumores de que o futuro Qwen4 focará em pesos de autoevolução, permitindo que o modelo atualize sua base de conhecimento em tempo real. A visão da empresa é atingir uma Inteligência Universal até 2027, integrando IA nos mundos digital e físico.
