Ambientes de container e Kubernetes cloud-native exigem segurança focada em runtime, em vez de varredura baseada em postura, devido a workloads efêmeros e ataques rápidos.
CEVIU News
As melhores notícias de tecnologia, curadas diariamente para quem vive tech.
16691 notícias encontradas
Amazon CloudFront agora suporta invalidação por cache tag, permitindo que desenvolvedores removam objetos em cache relacionados com uma única requisição. Isso melhora os fluxos de trabalho e a precisão, mantendo a eficiência do cache. As invalidações se propagam em menos de cinco segundos, com tagging flexível e ampla disponibilidade regional.
Agentes de codificação de IA podem aumentar a velocidade de codificação bruta, especialmente para engenheiros sêniores e produtos em estágio inicial. No entanto, isso não se traduz necessariamente em produtos melhores, pois o verdadeiro gargalo reside no discernimento de produto, no julgamento de sistema e na capacidade de decidir o que não construir. Embora esses agentes possam ajudar mais pessoas a desenvolver software "bom o suficiente" mais rapidamente, há o risco de criar bases de código maiores, mais complexas e de difícil manutenção quando a velocidade é confundida com a qualidade do produto.
A Amazon EKS lançou o Hybrid Nodes gateway, um recurso gratuito que gerencia automaticamente a rede entre as VPCs do cluster EKS e os pods Kubernetes executados on-premises, eliminando a necessidade de alterações manuais na configuração de rotas. O gateway de código aberto é implantado via Helm em instâncias EC2 e mantém automaticamente as tabelas de rotas da VPC à medida que as workloads escalam, com os clientes pagando apenas pelos custos subjacentes de EC2 e transferência de dados.
A DigitalOcean lançou sua Cloud nativa para IA no evento Deploy 2026, introduzindo 15 produtos distribuídos em cinco camadas integradas: compute, inference, dados, agentes e infraestrutura core. Esses produtos são desenvolvidos especificamente para cargas de trabalho de IA baseadas em agentes, capazes de processar centenas de milhares de tokens por requisição. A plataforma demonstrou os benchmarks de inference mais rápidos para Qwen 3.5 e DeepSeek V3.2. Clientes como a Celiums.AI já estão reduzindo os custos por token em 61% através do novo Inference Router, que seleciona automaticamente os modelos ideais com base em requisitos de custo, latency e qualidade.
Editores estilo vi permanecem populares porque, apesar de sua idade e curva de aprendizado íngreme, eles permitem edição altamente eficiente e estão disponíveis em quase todos os lugares via ferramentas nativas ou keybindings.
O MacBook Neo é o Mac mais acessível da Apple, custando $599. Ele utiliza o chip A18 Pro, derivado do iPhone, para entregar um forte desempenho single-core em picos, boa duração de bateria e uma construção com sensação premium a um preço baixo. Suas maiores desvantagens são o limite de 8GB de RAM, a configuração de portas limitada e o thermal throttling severo sob cargas de trabalho contínuas, tornando-o mais adequado para uso diário de estudantes/geral do que para desenvolvimento, trabalho criativo, jogos ou multitarefas pesadas.
A OpenAI redesenhou sua infraestrutura WebRTC para escalar IA de voz em tempo real, separando o roteamento de pacotes da terminação de protocolo. Isso foi feito através de uma camada de relay leve que encaminha o tráfego para serviços de transceiver com estado, usando metadados de roteamento embutidos em fragmentos de username ICE. O novo design dividido de relay-mais-transceiver resultou na redução da superfície UDP pública para um número fixo de portas (em vez de uma por sessão). Além disso, permitiu a implantação em Kubernetes e a criação de pontos de ingress de relay globais, que diminuíram a latência de primeiro salto ao permitir que os pacotes entrem na rede da OpenAI mais próximos dos usuários.
Um novo artigo ressignificou as alucinações em modelos de IA, abordando-as como falhas em expressar incerteza, e não meramente como lacunas de conhecimento. A proposta é introduzir a “incerteza fiel” como um mecanismo fundamental para alinhar a confiança demonstrada pelo modelo com sua real confiabilidade na resposta.
MolmoAct 2 é um action reasoning model aprimorado que otimiza o desempenho de robôs em tarefas do mundo real, e é complementado por um grande dataset aberto de manipulação bimanual.
Suporte multimodal, filtragem personalizada de metadados e citações em nível de página agora estão disponíveis na ferramenta Gemini API File Search. Essas funcionalidades podem auxiliar desenvolvedores a estruturar dados não estruturados para um RAG eficiente e verificável. Os sistemas de RAG dos usuários podem agora processar nativamente e organizar melhor dados textuais e visuais. A ferramenta File Search gerencia a infraestrutura pesada para que os usuários possam focar na construção de produtos.
Agentes de visão são a abordagem padrão para operar aplicações web que não expõem APIs. A maioria das equipes opta por agentes de visão porque a alternativa, desenvolver uma interface MCP ou REST, é demasiadamente cara para construir. O custo da abordagem baseada em visão é tratado como um preço fixo. Agentes de visão atuais exigem prompts detalhados para executar tarefas com sucesso e ainda estão sujeitos a erros. Embora modelos de visão aprimorados reduzam as taxas de erro, eles não diminuem o número de capturas de tela necessárias para acessar os dados relevantes, cada uma delas valendo milhares de tokens de entrada.
Os modelos Gemma 4 reduzem gargalos de latência e melhoram a responsividade para desenvolvedores com o uso de drafters de Predição Multi-Token. Esses drafters proporcionam uma aceleração de até 3x sem degradação na qualidade da saída ou na lógica de raciocínio, graças a uma arquitetura especializada de speculative decoding. O speculative decoding desvincula a geração de tokens da verificação, utilizando compute ocioso para 'prever' vários tokens futuros simultaneamente com o drafter, em menos tempo do que o modelo-alvo leva para processar apenas um token. O modelo-alvo então verifica todos esses tokens sugeridos em paralelo.
A Subquadratic lançou um novo modelo de IA que ostenta uma janela de contexto impressionante de 12 milhões de tokens. Este novo modelo demonstrou desempenho superior ao do GPT-5.5 em benchmarks de retrieval, destacando sua capacidade avançada de processar e recuperar informações em grandes volumes de dados. Tradicionalmente, o custo de attention em modelos de linguagem cresce quadraticamente com o comprimento do contexto, ou seja, dobrar a entrada de dados quadruplica o trabalho computacional. A Subquadratic declara ter superado esse desafio técnico, e já planeja disponibilizar em breve um modelo com uma janela de contexto ainda maior, de 50 milhões de tokens.
A Meta está desenvolvendo um assistente de IA altamente personalizado capaz de realizar tarefas cotidianas. Este assistente digital será impulsionado pelo novo modelo de IA Muse Spark da empresa. Ele poderá conectar diversas ferramentas de hardware e software e aprender com dados, exigindo menos intervenção humana do que um chatbot. A Meta visa lançar o assistente antes do quarto trimestre deste ano.
A OpenAI lançou o GPT5.5 Instant, atualizando seu modelo padrão do ChatGPT com maior precisão factual, alucinações reduzidas e personalização aprimorada com base no contexto do usuário.
Grande parte da inference em LLMs envolve a transferência de dados de um local para outro e, em seguida, o processamento desses dados quando chegam lá. O bottleneck mais frustrante no sistema ocorre quando as unidades de compute ficam ociosas porque o barramento de dados que as alimenta não é rápido o suficiente. A solução passa por transformar memória em compute. A quantization é um truque útil, mas não troca memória por compute de fato, ela transfere metade dos dados para um local para realizar o dobro da computação.
O Google fez uma parceria com a XPRIZE e a Range Media para lançar uma competição global que incentiva a produção de curtas-metragens sobre futuros otimistas e impulsionados pela tecnologia, com ferramentas de IA sendo apoiadas na produção.
A Anthropic lançou 10 templates prontos para uso focados nas tarefas mais demoradas do setor de serviços financeiros, abrangendo desde a criação de pitchbooks até a triagem de arquivos KYC e o fechamento contábil mensal.
A OpenAI lançou um novo aplicativo iOS criado especificamente para organizações escolares e corporativas.
