A CrewAI desenvolveu Iris, uma funcionária de IA interna, nativa do Slack, capaz de escrever código, enviar pull requests (PRs), revisar o trabalho de colegas de equipe e até mesmo modificar sua própria base de código, atuando em toda a organização de engenharia da CrewAI.
CEVIU News
As melhores notícias de tecnologia, curadas diariamente para quem vive tech.
16691 notícias encontradas
DataPRM é um modelo de recompensa de processo ciente do ambiente que detecta erros silenciosos e supervisiona melhor os agentes de análise de dados, aprimorando o desempenho subsequente e a generalização em diferentes benchmarks.
Elon Musk afirma ter sido um tolo ao apoiar a OpenAI quando ela era uma organização sem fins lucrativos. Musk concedeu à startup um financiamento essencialmente gratuito de US$ 38 milhões. Atualmente, a OpenAI está avaliada em US$ 800 bilhões. Musk solicitou a um tribunal que anule a recente conversão da OpenAI para uma entidade com fins lucrativos e busca indenização de mais de US$ 180 bilhões.
O mercado de inference está se fragmentando devido à diversidade das cargas de trabalho. O ecossistema de modelos se dividiu em camadas de latência, modelos multimodais e modelos de edge. Cada tipo de modelo possui requisitos distintos de disponibilização, o que leva à fragmentação da infraestrutura. Essa fragmentação, por sua vez, cria espaço para que múltiplos vencedores surjam.
O GitHub divulgou uma vulnerabilidade de alta severidade, CVE-2026-3854, que afeta o GitHub Enterprise Server e outros produtos, permitindo a execução remota de código através de opções git push manipuladas.
A OpenAI parece estar lidando com um novo problema em seu modelo mais recente, onde o sistema se concentra em goblins em conversas completamente alheias ao tópico.
O objetivo inicial do projeto Stargate era construir 20 data centers. No entanto, os parceiros supostamente não conseguiram chegar a um acordo sobre quem teria o controle final dos data centers planejados. Em vez disso, a OpenAI começou a alugar compute. A startup não obteve lucro desde a sua fundação e, embora muitas instituições acreditem em seu potencial, alguns analistas estimam que ela poderá ficar sem caixa até meados de 2027.
O World-R1 é um framework de reinforcement learning que aprimora a consistência 3D na geração de vídeo, utilizando feedback de modelos 3D e de visão-linguagem sem modificar a arquitetura base.
A Parallel Web Systems, startup fundada por Parag Agrawal, ex-CEO do Twitter, desenvolveu uma plataforma para agentes de IA realizarem buscas na web.
O Google concordou em fornecer ao Departamento de Defesa dos EUA acesso à sua IA em redes classificadas para usos legais amplos.
As ações de diversas empresas ligadas à OpenAI registraram queda na terça-feira, após a divulgação de que a OpenAI não alcançou suas metas internas de receita e usuários. Investidores expressam preocupação de que o vultoso investimento da OpenAI em IA possa não resultar nos lucros expressivos que muitos antecipam. Críticos da OpenAI apontaram que alguns dos arranjos financeiros da empresa possuem uma natureza circular, onde os parceiros da companhia fornecem financiamento e a própria empresa utiliza esses fundos para despesas com compute junto a esse mesmo parceiro. Em resposta, a OpenAI defendeu sua solidez financeira e assegura que seus líderes estão focados em garantir recursos computacionais.
O novo modelo de IA da Meta, Muse Spark, sinaliza uma mudança em sua estratégia de IA, migrando do open-source para acesso pago, com o objetivo de impulsionar seu negócio de publicidade e competir no crescente mercado de IA. Analistas demonstram otimismo cauteloso, destacando os testes internos e investimentos da Meta, apesar de a empresa ainda estar atrás de players de ponta como o Claude da Anthropic. A redução de força de trabalho da Meta e as contratações estratégicas refletem seu foco intensificado em avanços e infraestrutura de IA.
O Recurrent Transformer é uma arquitetura inovadora projetada para superar a profundidade temporal limitada dos Transformers padrão. Ao introduzir recorrência entre as camadas, o modelo utiliza uma combinação de pares chave-valor temporários e persistentes para permitir que cada camada mantenha uma memória interna continuamente atualizada. Este mecanismo capacita o modelo a realizar raciocínio complexo e iterativo em uma sequência sem a necessidade de grandes pilhas de camadas.
A plataforma ElevenAgents da ElevenLabs introduziu os Agent Templates, uma funcionalidade que possibilita a implantação ágil de agentes de IA. Esses templates utilizam frameworks pré-construídos, permitindo uma configuração e um desenvolvimento mais rápidos para soluções baseadas em agentes.
A Anthropic lançou conectores que integram o Claude com softwares criativos importantes como Adobe, Blender e Autodesk, viabilizando fluxos de trabalho baseados em linguagem natural, automação e pipelines de trabalho entre diferentes ferramentas para design, modelagem 3D e produção de áudio.
Laguna XS.2 e Laguna M.1 são modelos de codificação baseados em agentes, projetados para tarefas de longo prazo. O Laguna M.1 serve como a base para a família de modelos Laguna, enquanto o Laguna XS.2 é um modelo significativamente menor, mas ainda assim notavelmente capaz para seu tamanho. Ambos os modelos estão disponíveis gratuitamente por tempo limitado via API da Poolside e na plataforma OpenRouter. Os pesos do Laguna XS.2 foram liberados sob uma licença Apache 2.0.
A Anthropic aprimorou a compreensão de inputs do Claude Opus 4.7 com um novo tokenizer. Embora o preço do modelo não tenha sido alterado, os mesmos inputs agora custam mais do que nos modelos anteriores. Os custos aumentaram entre 12% a 27%, exceto para prompts curtos, que, na verdade, se tornaram mais eficientes em termos de custo.
Em uma entrevista recente, Sam Altman, CEO da OpenAI, e Matt Garman, CEO da AWS, discutiram os Bedrock Managed Agents, impulsionados pela OpenAI, e como isso se encaixaria no acordo da OpenAI com a Microsoft, que concedia à Azure acesso exclusivo aos modelos da OpenAI. Desde então, a Microsoft e a OpenAI alteraram seu acordo para permitir que a OpenAI ofereça seus produtos em outros cloud providers. A exclusividade da Azure estava ativamente prejudicando o investimento da Microsoft na OpenAI, o que levou a Microsoft a tomar medidas, mesmo que isso significasse diminuir a diferenciação da Azure. Além disso, a OpenAI liberou a Microsoft da cláusula de AGI, o que implica que o acordo entre as duas empresas será válido até 2032, mesmo que a OpenAI alcance a AGI antes.
Fornecer ferramentas de busca básicas a agentes resulta em respostas de melhor qualidade. Incentivar o agente a explorar mais gera melhorias adicionais. Modelos de busca agentic conseguem identificar como apresentar resultados relevantes, contudo, os dados de treinamento continuam a ditar os pontos fortes desses modelos. Modelos de linguagem grandes (LLMs) não conseguem avaliar o que desconhecem, e ainda não há uma maneira efetiva de compensar essa lacuna de conhecimento.
O Nemotron 3 Nano Omni da NVIDIA é um novo modelo multimodal projetado para análise de documentos, áudio e vídeo, alcançando precisão de ponta em benchmarks como MMlongbench-Doc e VoiceBench. Sua arquitetura híbrida Mamba-Transformer é integrada com codificadores especializados para visão e áudio, permitindo o processamento eficiente em contextos multimodais extensos. Este modelo aprimora significativamente o throughput e a velocidade de raciocínio para diversas aplicações práticas, incluindo análise de documentos, reconhecimento automático de fala e compreensão de vídeo.
