A OpenAI nomeou Arvind KC para o cargo de Chief People Officer.

CEVIU IA
Lançamentos, inovações e pesquisas para profissionais de IA, machine learning e ciência de dados
2347 notícias
A METR está ajustando o design de seu experimento sobre produtividade de desenvolvedores . Essa mudança ocorre porque um número considerável de participantes tem optado por não fazer parte do estudo, uma vez que não desejam trabalhar sem o suporte de ferramentas de IA .
A transação poderia totalizar entre US$ 5 bilhões e US$ 6 bilhões.
A Meta firmou uma parceria plurianual com a AMD para otimizar a infraestrutura de IA, envolvendo até 6GW de GPUs AMD Instinct. Esta colaboração foca na integração vertical de silício, sistemas e software, alinhando roteiros para implementações escaláveis de IA. Os primeiros envios de GPUs estão previstos para o final de 2026, utilizando a arquitetura rack-scale Helios da AMD para um poder computacional aprimorado.
Um ensaio viral recente propõe que o otimismo em torno da IA pode, paradoxalmente, levar a um cenário pessimista. Contudo, essa análise é vista como uma obra de ficção especulativa, com falhas significativas. Ela argumenta que o sucesso da IA seria prejudicial à economia, em vez de benéfico. A realidade, por outro lado, sugere que a tecnologia criará mais oportunidades no mercado, e não as destruirá. ️ Embora possa haver desafios e dores de transição, é improvável que surjam problemas insolúveis.
Enquanto muitos se concentram na dificuldade das tarefas que os modelos de IA conseguem resolver, os dados de benchmark também revelam o volume de trabalho e o compute que eles demandam. O Opus 4.6 demonstra uma evolução notável, resolvendo tarefas mais desafiadoras com maior confiabilidade e exigindo consideravelmente menos poder computacional. A publicação aprofunda essa comparação com gráficos detalhados, avaliando modelos de Anthropic, OpenAI e Google.
Muito misticismo se acumulou em torno da IA. A tecnologia subjacente é não-determinística. Este artigo apresenta um framework que visa criar o máximo de determinismo possível apesar disso, argumentando que modelos de IA estão buscando um sinal de recompensa e que os ambientes em que operam delimitam essa busca. Em vez de tentar dar instruções perfeitas aos modelos, o foco deve ser em delimitar seus ambientes de forma suficientemente restrita para que a busca convirja, otimizando a performance do agente.
O Claude Cowork da Anthropic está recebendo um lançamento mais amplo . A Anthropic lançou uma série de conectores e plugins para esta ferramenta destinada a profissionais do conhecimento no início desta semana, com o objetivo de potencializar as capacidades de cada funcionário . Esta atualização marca a transição da ferramenta para um produto verdadeiramente de nível empresarial. As organizações agora podem conectar o Claude Cowork a ferramentas como Google Drive, Gmail, DocuSign e FactSet, além de implantar plugins personalizáveis que codificam o conhecimento institucional e os workflows específicos .
O Google integrou capacidades de inteligência agentic aos workflows da plataforma Opal, aprimorando significativamente a flexibilidade e a interatividade dos sistemas.
O SWE-bench Verified não mede mais de forma confiável o progresso em codificação de frontier. Isso se deve a falhas nos testes de muitas tarefas, que rejeitavam correções corretas, e à contaminação do benchmark, que transformou a exposição durante o treinamento em um fator significativo para as pontuações.
DeepSeek V4, um modelo open source altamente aguardado com contexto de mais de 1M baseado na arquitetura Engram , deverá ser lançado antes do final do mês ️.
Um recente desenvolvimento da ASML em fontes de luz EUV (Extreme Ultraviolet) promete revolucionar a fabricação de semicondutores. Este avanço tecnológico pode capacitar os fabricantes de chips a aumentar a produção em até 50% até o fim da década, impactando significativamente a capacidade de oferta global de componentes.
A Perplexity está testando um conector para o Messages em seu navegador Comet, o que aprimora a integração local com o aplicativo Messages da Apple. Essa funcionalidade visa atrair usuários avançados de macOS ao unificar o histórico de comunicação com dados da web. Paralelamente, uma nova funcionalidade "Uso e Créditos" permitirá que os usuários comprem créditos adicionais, respondendo à reação negativa pela redução dos limites do plano Pro.
A Anthropic acusou DeepSeek, Moonshot AI e MiniMax de criar mais de 24.000 contas falsas para gerar aproximadamente 16 milhões de interações com Claude, visando replicar suas capacidades de raciocínio agentic, uso de ferramentas e codificação.
A OpenAI planeja introduzir uma nova categoria de assinatura, o ChatGPT Pro Lite. Com valor de US$ 100 por mês, este novo plano visa atender usuários que atingem frequentemente os limites de requisições (rate limits) da versão Plus, mas que não necessitam do acesso ilimitado oferecido pela modalidade Pro. Além disso, pode ser uma forma de acomodar o uso do Codex. Ainda não há confirmação da data de lançamento, e o conjunto exato de funcionalidades permanece indefinido.
A OpenAI descreveu um teste de estresse de longa duração onde o GPT-5.3-Codex, recebendo um repositório vazio e acesso total, desenvolveu uma ferramenta de design ao longo de cerca de 25 horas, utilizando aproximadamente 13 milhões de tokens e produzindo cerca de 30 mil linhas de código. ️️
Daniel Litt argumenta que as limitações atuais são reais, mas provavelmente temporárias, não bloqueios fundamentais. Litt agora espera que a IA resolva autonomamente conjecturas abertas de interesse moderado já no final de 2026 e sugere que o impacto de longo prazo da IA na matemática pode exceder o do computador . Mesmo em um futuro onde as máquinas possam gerar vastos corpos de matemática correta, ele sustenta que os matemáticos humanos ainda serão relevantes, pois a motivação central permanece sendo a compreensão , e não apenas a produção de resultados.
O AWS Strands Labs é uma nova organização GitHub criada para auxiliar desenvolvedores a explorar e experimentar técnicas avançadas de IA . Atualmente, a iniciativa está disponível para três projetos específicos: robôs , robots sim e AI functions. A AWS considera essas áreas as que mais claramente revelam as mudanças quando o software se torna agentic, oferecendo à empresa e à comunidade um espaço dedicado para experimentação ousada .
A OpenAI está firmando parcerias plurianuais com as empresas de consultoria Accenture, Boston Consulting Group, Capgemini e McKinsey & Co. O objetivo é auxiliar na implantação de sua plataforma corporativa, Frontier , uma camada de inteligência projetada para integrar sistemas e dados díspares dentro de uma organização, visando facilitar a gestão, implantação e construção de agentes de IA pelas empresas. A decisão da OpenAI de colaborar com essas firmas de consultoria se baseia nos relacionamentos que elas já possuem com grandes corporações e em seu profundo conhecimento sobre a operação desses negócios . As consultorias serão fundamentais para ajudar a OpenAI a escalar a implementação de sua tecnologia em escala global .
O FDM-1, um modelo de base para uso computacional, treina eficientemente em 11 milhões de horas de vídeo para lidar autonomamente com tarefas como CAD, direção e fuzzing. Ao contrário dos modelos tradicionais que dependem de anotação cara e limitada, o FDM-1 utiliza um codificador de vídeo que comprime 2 horas de vídeo em 1M de tokens e prevê ações com dinâmica inversa para um treinamento escalável. Com processamento de contexto aprimorado, o FDM-1 demonstra avanços significativos na execução de tarefas de longo prazo e na exploração de árvores de estado complexas em ambientes GUI.





