A OpenAI está instando a Califórnia e Delaware a investigarem o suposto comportamento anticompetitivo de Elon Musk, ação que precede um julgamento agendado para abril. A empresa busca esclarecer as acusações antes do processo judicial.

CEVIU IA
Lançamentos, inovações e pesquisas para profissionais de IA, machine learning e ciência de dados
2332 notícias
A OpenAI anunciou um novo programa de fellowship, com duração de setembro de 2026 a fevereiro de 2027. O programa oferecerá suporte a pesquisadores externos focados em segurança, alinhamento de IA e desafios técnicos relacionados, por meio de mentoria, acesso a compute e bolsas para os participantes.
O Google está desenvolvendo o Jules V2 ("Jitro"), um agente de codificação projetado para gerenciar autonomamente metas de desenvolvimento de alto nível, em vez de tarefas específicas. Lançado via lista de espera, ele busca redefinir o desenvolvimento de software com IA, mudando o foco de comandos baseados em tarefas para resultados orientados por KPIs. Essa abordagem pode beneficiar equipes que lidam com grandes codebases, mas enfrenta desafios relacionados a mudanças imprevisíveis e questões de confiança.
A Anthropic assinou um acordo com Google e Broadcom para múltiplas gigawatts de capacidade de TPUs de próxima geração, com previsão de entrada em operação a partir de 2027. Essa capacidade é essencial para atender ao crescimento exponencial da base de clientes da Anthropic e permitirá que Claude defina a fronteira do desenvolvimento de IA. A maior parte do novo compute será localizada nos EUA.
A OpenAI está testando seu modelo de próxima geração, o Image V2, no ChatGPT e no LM Arena em três variantes. Testes iniciais indicam melhorias na renderização de design de UI, na aderência ao prompt e na compreensão composicional. O resultado desses testes pode fortalecer a posição competitiva da OpenAI frente às ofertas do Google.
A Meta está próxima de lançar seus novos modelos de IA. A empresa planeja que alguns deles sejam disponibilizados sob uma licença open-source, com foco nos consumidores em vez do mercado corporativo. Este movimento reforça a postura anterior da Meta de abraçar a IA open-source com seus modelos Llama. O CEO Mark Zuckerberg já havia declarado, em um manifesto, a IA open-source como o caminho a seguir. Consequentemente, a empresa adotará uma estratégia híbrida, combinando modelos proprietários e open-source daqui para frente.
Marc Andreessen reflete sobre A Morte do Navegador, Pi + OpenClaw e Por Que 'Desta Vez É Diferente'
A IA, resultado de um 'sucesso repentino de 80 anos', não é mais um ciclo de hype, mas a culminação de décadas de pesquisa que levaram a avanços significativos em raciocínio, codificação e agentes com capacidade de autoaperfeiçoamento.
A Meta suspendeu seu trabalho com a Mercor após uma violação de segurança que pode ter exposto dados proprietários de treinamento de IA. O incidente levanta preocupações sobre a segurança de informações estratégicas no setor de inteligência artificial.
A Anthropic anunciou que os assinantes do Claude Code não poderão mais utilizar os limites de sua assinatura para ferramentas como o OpenClaw, mudando para um modelo de precificação pay-as-you-go separado para integrações de terceiros.
A Anthropic adquiriu a startup de IA de biotecnologia Coefficient Bio por US$ 400 milhões em ações, visando fortalecer suas iniciativas em saúde e ciências da vida. A Coefficient Bio, fundada por ex-pesquisadores da Genentech, utilizava IA para acelerar a descoberta de medicamentos e a pesquisa biológica. A equipe de 10 pessoas será integrada à divisão de saúde e ciências da vida da Anthropic.
A auto-destilação simples (SSD) é um processo em que modelos são submetidos a fine-tuning utilizando amostras de sua própria saída por meio de fine-tuning supervisionado padrão. Este método oferece uma abordagem complementar pós-treinamento para aprimorar a geração de código por LLMs. A SSD pode melhorar a geração de código em modelos usando apenas as saídas brutas. Este estudo investiga os motivos pelos quais um método tão simples pode ser eficaz.
Um sistema simples de três pastas (raw, wiki e outputs) transforma notas dispersas em uma base de conhecimento estruturada e mantida por IA, utilizando arquivos de texto simples e um schema leve. Essa abordagem permite a conversão de informações fragmentadas em um repositório organizado e acessível. Ferramentas como o agent-browser automatizam a ingestão de conteúdo, enquanto a IA se encarrega de compilar, conectar e atualizar uma wiki pessoal a partir de inputs brutos, eliminando a necessidade de organização manual. O sistema aprimora-se ao longo do tempo, salvando os outputs de volta no processo e executando verificações periódicas de "saúde" para identificar erros e lacunas antes que se acumulem.
O desempenho de sistemas com Large Language Models (LLMs) depende não apenas dos pesos do modelo, mas também dos seus harnesses. Meta-Harness é um sistema de outer-loop que busca por código de harness para aplicações de LLM. Seus harnesses superam os melhores desenvolvidos manualmente em benchmarks de codificação agentic, demonstrando como um acesso mais rico a experiências prévias pode viabilizar a engenharia automatizada de harnesses.
LLMs frequentemente decidem ações antes de gerar tokens de raciocínio, influenciando sua cadeia de pensamento. Uma linear probe pode decodificar essas decisões a partir de ativações pré-geração com alta precisão.
ActionParty introduz tokens de estado por sujeito com polarização espacial para garantir a atribuição correta de ações a múltiplas entidades em vídeos gerados, resolvendo falhas comuns na vinculação sujeito-ação.
Este 'arquivo de ideia', projetado para ser copiado e colado em um agente LLM, apresenta um padrão para a construção de bases de conhecimento usando LLMs. Ele permite que os LLMs construam e mantenham incrementalmente uma wiki persistente, expansível conforme o modelo continua aprendendo. Neste framework, o humano curadoria as fontes, direciona a análise, faz perguntas e processa o significado, enquanto o modelo realiza as outras tarefas. O agente edita com base em conversas, e usuários podem navegar pelas alterações em tempo real.
A dependência da Apple do Gemini IA do Google para uma Siri reformulada marca uma mudança estratégica, enquanto a empresa busca compensar seu atraso em IA generativa em comparação com seus pares. Essa parceria levanta preocupações sobre a gestão de dados do usuário, ao mesmo tempo em que destaca a aposta da Apple em capacidades de IA integradas diretamente nos dispositivos. À medida que a tecnologia de IA migra para o dispositivo, a Apple pretende usar seus pontos fortes em design e privacidade para recuperar sua competitividade no cenário da IA.
Ambientes de RL (Reinforcement Learning) funcionam como campos de treinamento para agentes LLM. A distribuição de tarefas é crucial, pois define as habilidades que os agentes desenvolvem, enquanto os harnesses controlam a forma como eles interagem. Verificadores são responsáveis por estabelecer o que é considerado um desempenho 'bom', e tanto o estado quanto a configuração do ambiente são determinantes para o realismo e a eficácia do treinamento.
O aprendizado em agentes de IA pode ocorrer em três níveis distintos: nas camadas do modelo, do harness ou do contexto. Entender essa diferença é fundamental para a construção de sistemas que aprimoram seu desempenho ao longo do tempo. A camada do modelo diz respeito aos pesos do próprio modelo, enquanto o harness abrange o código, as instruções e as ferramentas que impulsionam o agente. Por fim, o contexto é composto por informações adicionais que residem fora do harness para permitir configurações mais detalhadas. Embora a discussão sobre aprendizado contínuo frequentemente se concentre exclusivamente na camada do modelo, na realidade, um sistema de IA tem a capacidade de aprender e evoluir em todas as três camadas mencionadas.
Trinity-Large-Thinking é um reasoning model de fronteira aberto para agentes complexos de longo prazo e chamadas de ferramentas em várias etapas. É possivelmente o modelo aberto mais forte fora da China. Durante o treinamento, a equipe da Arcee focou em aspectos para tornar agentes mais realistas na prática: manter coerência, usar ferramentas sem descuido, seguir instruções com restrições e preservar alta qualidade sem custos absurdos. O Trinity-Large-Thinking está disponível através da API da Arcee, e os pesos estão no Hugging Face sob Apache 2.0.





