O GitHub está defendendo emendas específicas para resolver conflitos entre o projeto de lei de transparência de IA da Califórnia e o licenciamento open source, buscando alinhar a proposta com frameworks internacionais de transparência sem descaracterizar a intenção regulatória.
Demonstrando a importância da inovação open source na IA americana, o novo mecanismo inteligente da Palantir, apresentado hoje, utiliza modelos abertos NVIDIA Nemotron para atender às necessidades das agências governamentais dos EUA. O software de código aberto é, há muito tempo, um pilar da liderança tecnológica do país. Em 1969, a DARPA conectou quatro computadores universitários — da UCLA, Stanford, UCSB...
Nos últimos dois anos, o programa piloto do National Artificial Intelligence Research Resource (NAIRR), da National Science Foundation dos EUA, impulsionou pesquisas inovadoras em todo o país em mais de 700 projetos, que vão desde a predição de proteínas até o gerenciamento de surtos de doenças infecciosas. A NVIDIA contribuiu para o piloto do NAIRR por meio de um recurso baseado em nuvem que oferece aos pesquisadores acesso dedicado à infraestrutura.
As operadoras de telecomunicações têm obtido retornos notáveis com o uso de IA generativa para automatizar a gestão de redes, o atendimento ao cliente e as operações de back-office. Até o momento, a maior parte desse impacto tem sido baseada em tarefas: uma automação que acelera etapas predeterminadas enquanto profissionais analisam insights e direcionam os próximos passos manualmente. No entanto, a automação deixou de ser a linha de chegada para se tornar o ponto de partida rumo à autonomia.
Descubra como a Omio utiliza soluções da OpenAI para viabilizar experiências de viagem conversacionais, acelerar o desenvolvimento de produtos e se transformar em uma empresa nativa de IA.
O GPT-5 Pro ajudou a desvendar um mistério de três anos na área de imunologia, trazendo novas perspectivas sobre o comportamento das células T. A descoberta pode apoiar pesquisas sobre o câncer e doenças autoimunes.
Um novo relatório da OpenAI mapeia como a IA pode remodelar os empregos em toda a União Europeia, destacando quais ocupações podem enfrentar automação, crescimento ou mudanças nos fluxos de trabalho.
A OpenAI e a Broadcom apresentaram o Jalapeño, um chip personalizado de IA voltado para inferência de LLM, desenvolvido para melhorar o desempenho, a eficiência e a escala em sistemas de IA.
O Hugging Face anunciou o lançamento do FFASR Leaderboard, uma nova tabela de classificação voltada para avaliar o desempenho de modelos de reconhecimento automático de fala (ASR) em cenários e dados do mundo real.
O Hugging Face compartilhou um guia prático demonstrando como utilizar modelos locais para realizar a triagem de pull requests e issues no repositório OpenClaw sem custos com APIs externas.
Uma análise detalhada sobre o desempenho de predição de tokens em arquiteturas de modelos híbridos, identificando quais tipos de tokens apresentam maior precisão durante o processo de inferência.
O novo PP-OCRv6 já está disponível no Hugging Face, trazendo suporte a OCR para 50 idiomas em modelos com variação de 1,5 milhão a 34,5 milhões de parâmetros.
A Stanford publicou um relatório interativo sobre os preços históricos e atuais de memórias e armazenamento. O conjunto de dados segue a linha do clássico trabalho de John C. McCallum sobre preços de memória, contando com dados brutos para download e ferramentas de exportação de gráficos.
A OpenAI introduziu o GPT-5.6 Preview, uma família de modelos composta por Sol, Terra e Luna, sendo o Sol posicionado como o modelo principal. O system card detalha testes de cyber e bio safety mais rigorosos, novas salvaguardas e um preview limitado antes de uma disponibilização mais ampla.
Com o tempo, as bases de código e as linguagens de programação se tornarão mais fáceis de serem compreendidas, corrigidas e escritas por modelos de IA. Embora a linguagem de programação Lean apresente uma constante de linha de base e uma perda total piores em bases de código existentes quando comparada a outras linguagens, ela possui componentes de scaling laws superiores. Isso sugere que implementações em Lean podem, eventualmente, sobressair e trazer grandes benefícios para a corretude de programas em escala global. Esse cenário pode justificar investimentos robustos na reescrita de bases de código existentes em Lean ou no financiamento para o desenvolvimento de novos códigos nessa linguagem.
Elon Musk anunciou que o Grok 4.5 entrou em fase de beta privado na SpaceX e na Tesla. O modelo é baseado em um modelo de fundação V9 de 1,5T, com a adição de dados do Cursor durante o treinamento suplementar. As avaliações iniciais indicam um desempenho próximo ou superior ao do Opus, enquanto o aprendizado por reforço continua a aprimorar o modelo.
ATUALIZAÇÃO (29/06/2026): não é mais rumor, foi lançado. 28 de junho de 2026. O Google restringiu o acesso da Meta aos seus modelos de IA Gemini devido à incapacidade de fornecer a capacidade computacional que a empresa de redes sociais desejava. Essa limitação, notificada à Meta por volta de março de 2026, impactou e atrasou alguns projetos internos de IA da Meta. Em resposta, a Meta instruiu seus funcionários a usar os "tokens" de IA de forma mais eficiente e está transferindo cargas de trabalho para seu próprio modelo interno, o Muse Spark, para reduzir a dependência de provedores externos. (Rumor original) De acordo com relatos, o Google limitou o acesso da Meta à capacidade do Gemini após a empresa solicitar mais poder computacional do que o Google poderia fornecer. A escassez teria atrasado alguns projetos internos de IA da Meta e forçado a equipe a utilizar os tokens de IA de maneira mais eficiente.
Os pipelines de engenharia de dados devem descontinuar o uso de horas operacionais cumulativas como métrica primária. Em vez disso, a eficiência da engenharia e o dimensionamento de modelos devem ser avaliados por meio de parâmetros quantificáveis. Uma estratégia otimizada de alocação de capital equilibra os diferentes tipos de dados em relação às suas métricas de utilidade específicas, escalando a eficiência de capital ao precificar com precisão a novidade dos dados.
Modelos como o Gemini Nano e o Gemma possibilitam levar grandes modelos de linguagem poderosos diretamente no bolso, mas entregar essa tecnologia em dispositivos móveis representava um desafio significativo. Para superar esse gargalo, o Google desenvolveu uma nova arquitetura que integra o sistema de Multi-Token Prediction a modelos Gemini Nano v3 já existentes e congelados. Os novos componentes arquitetônicos foram projetados especificamente para maximizar os ganhos de eficiência em ambientes móveis. O trabalho detalha como a equipe de pesquisa do Google enfrentou as restrições extremas e únicas do ecossistema de edge computing.
A Meta investigou como os modelos de recompensa podem reagir de forma exagerada a respostas igualmente boas, direcionando o aprendizado por reforço para o chamado reward hacking. O estudo propõe mensurar tanto a capacidade discriminativa quanto a especificidade, utilizando posteriormente o método Monte Carlo dropout para agrupar as recompensas em sinais discretos mais seguros.