Sam Altman e Jakub Pachocki descrevem a terceira fase da OpenAI com três metas centrais: desenvolver um pesquisador de IA automatizado, acelerar a economia garantindo distribuição ampla dos ganhos e entregar uma AGI pessoal para cada pessoa no planeta. Para eles, o caminho mais seguro é tornar a IA avançada abundante, acessível e simples o suficiente para qualquer indivíduo ou organização, e a distribuição ampla de poder é vista como a estratégia mais responsável.
CEVIU News
As melhores notícias de tecnologia, curadas diariamente para quem vive tech.
15666 notícias encontradas
Jack Garabedian, engenheiro da SpaceX desde 2021 com passagem pela Starlink na Ucrânia, assume a liderança da equipe de treinamento do chatbot Grok, substituindo Diego Pasini. O movimento reforça a crescente integração de executivos da SpaceX na gestão técnica e operacional da xAI, movimento que se intensifica às vésperas do IPO da companhia aeroespacial de Musk.
Por muito tempo, a limitação estava no próprio modelo de IA. Hoje, com modelos cada vez mais capazes, o verdadeiro gargalo se deslocou para o fluxo de trabalho ao redor deles, orquestração, integração e execução. Ter um modelo poderoso não basta se o pipeline que o envolve for frágil.
Agentes de IA como o Computer, da Perplexity, estão redefinindo o trabalho intelectual ao executar tarefas de forma autônoma, com redução de 87% no tempo e 94% nos custos em relação à pesquisa tradicional. Com a execução delegada à IA, profissionais passam a focar em definição de metas e supervisão, viabilizando projetos complexos e interdisciplinares que cruzam múltiplas áreas de especialização.
A Xiaomi, em parceria com a TileRT, lançou o MiMo-V2.5-Pro-UltraSpeed, modelo de 1 trilhão de parâmetros que atinge 1.000 tokens por segundo em um nó padrão de 8 GPUs, até 15 vezes mais rápido que concorrentes como ChatGPT e Claude. O ganho vem de quantização FP4 nas camadas de especialistas e do DFlash speculative decoding, técnica que propõe blocos inteiros de tokens em vez de processá-los um a um. O modelo está disponível em teste limitado de API até 23 de junho, com custo três vezes maior que a versão padrão, mas entregando cerca de dez vezes mais saída.
A OpenAI confirmou ter submetido uma minuta de formulário S-1 de forma confidencial à Securities and Exchange Commission (SEC), mantendo em aberto a possibilidade de um IPO futuro, sem, contudo, definir prazo ou cronograma. O documento reforça que a decisão preserva flexibilidade estratégica, enquanto a empresa avalia os trade-offs entre seguir como empresa privada ou buscar capital aberto, sem alterar sua atual governança ou modelo operacional.
A Apple anunciou a reformulação da Siri, que passa a se chamar Siri IA e chega com capacidade conversacional ampliada. O lançamento está previsto para o outono, junto às novas versões dos sistemas operacionais da empresa. A atualização inclui melhorias nos Foundation Models on-device impulsionadas pelo Google e integração mais profunda de IA em todas as plataformas Apple.
A Perplexity confirmou planos de IPO para 2028, independentemente do que OpenAI e Anthropic decidirem sobre suas próprias aberturas de capital. As listagens das três empresas de IA, junto à SpaceX, devem figurar entre os maiores IPOs da história recente, sinalizando uma nova fase de maturidade, e apetite dos mercados, para o setor de inteligência artificial.
O SchemaFlow apresenta um fluxo de trabalho assistido por IA para gerenciar solicitações de alteração em bancos de dados, desde o parsing de requisições estruturadas até a análise de impacto, geração de SQL, aplicação de guardrails, criação de artefatos e avaliação final. Embora o guia prático use um caso do varejo (programa de fidelidade), a arquitetura é genérica e escalável para qualquer domínio corporativo com dados estruturados.
Estudos preliminares mostram que o uso de IA elevou o throughput de pull requests em 10% a 15% em várias organizações, com ganho mediano de 8%. No entanto, como a escrita de código corresponde a apenas uma fração das atividades de um engenheiro, obstáculos persistentes em revisões, planejamento, testes e coordenação continuam freando a velocidade global do desenvolvimento, revelando que a IA, por si só, não resolve todos os desafios operacionais.
O FrontierCode é o primeiro benchmark voltado para medir a capacidade de modelos de IA em gerar código apto para ambientes de produção, incluindo, inédita e criticamente, a habilidade de realizar *merges* seguros. Desenvolvido por mantenedores de projetos de código aberto, ele emprega um pipeline rigoroso de controle de qualidade, com testes adversariais, calibração precisa e revisão em múltiplos estágios. O resultado é um indicador robusto da maturidade real de um modelo em produzir código funcional, confiável e facilmente mantido.
O TakoVM é uma solução open-source projetada para executar código Python não confiável de forma segura, utilizando containers Docker isolados. Voltado para demandas corporativas, o projeto endereça um dos principais desafios de governança em ambientes que adotam IA e automação: garantir isolamento e controle na execução de scripts externos sem comprometer a infraestrutura.
O Microsandbox é uma solução voltada à execução local que inicializa micro VMs leves em milissegundos. A proposta elimina a necessidade de configurar servidores ou manter daemons persistentes, permitindo integração direta em aplicações. A abordagem simplifica ambientes de desenvolvimento e execução isolada, reduzindo fricção operacional para times que precisam de sandboxing ágil e leve.
A NAVER, em parceria com a NVIDIA, está expandindo sua infraestrutura soberana de IA na Coreia do Sul, começando pelo data center GAK Sejong, com o objetivo de escalar de 55MW para níveis na faixa de gigawatts. A iniciativa usa a plataforma DSX da NVIDIA e atende à demanda global por capacidade computacional especializada em IA, reforçando governança local de dados, autonomia tecnológica e resiliência em ambientes críticos.
A Shadow IA está crescendo nas corporações brasileiras, com funcionários usando gratuitamente ferramentas de IA generativa não aprovadas, muitas vezes expondo dados sensíveis. Em vez de proibições rígidas, a estratégia recomendada é bidirecional: mapear intenções e fluxos reais de trabalho, disponibilizar soluções aprovadas alinhadas às necessidades operacionais e gerenciar licenças e consumo de tokens para reduzir riscos, custos e desperdícios.
No Build 2026, a Microsoft apresentou o Scout, agente de execução contínua baseado no runtime open source OpenClaw, agora disponível gratuitamente. A estratégia da empresa é clara: abrir mão da receita sobre o software de execução e monetizar o control plane, com foco em identidade, governança, políticas, auditabilidade e gestão corporativa. Um movimento que reforça o modelo de negócios em camadas superiores da stack.
A Microsoft tornou open source o pg_durable, extensão do PostgreSQL que permite executar fluxos de trabalho duráveis e tolerantes a falhas via SQL, com checkpoints entre etapas. A proposta é processar workflows em background junto aos dados no Postgres, eliminando a necessidade de workers externos, filas ou infraestrutura adicional, mantendo visibilidade de status e primitivas de orquestração nativas do SQL.
O Amazon Bedrock AgentCore Runtime passou a suportar shells interativos para acesso via terminal em sessões de agentes em execução, por meio da nova API InvokeAgentRuntimeCommandShell. O recurso entrega um terminal persistente baseado em PTY via WebSocket, com suporte a cores, autocompletar por tabulação, comandos Ctrl+C, redimensionamento e reconexão automática, complementando a API one-shot InvokeAgentRuntimeCommand já existente.
Um grupo de extorsão recém-identificado, batizado de Pink (CL-CRI-1147), está atacando usuários corporativos via vishing e engenharia social para capturar credenciais de armazenamento em nuvem. Após comprometer os acessos, o grupo usa automações da Microsoft para exfiltrar arquivos do OneDrive e SharePoint, pressionando as vítimas por Teams ou e-mail com prazo de pagamento de até 72 horas.
O Google firmou contrato para pagar à SpaceX US$ 920 milhões por mês entre outubro de 2026 e junho de 2029 pelo aluguel de capacidade de data center. O acordo inclui a entrega de 110 mil chips Nvidia pela SpaceX, caso isso não ocorra, o Google pode cancelar o contrato em outubro. Ambas as partes têm direito de rescisão a partir do próximo ano, com aviso prévio de 90 dias. É o segundo grande contrato da SpaceX para fornecer poder computacional a um concorrente.
