CEVIU News

As melhores notícias de tecnologia, curadas diariamente para quem vive tech.

16837 notícias encontradas

A DeepSeek apresentou suas novas séries V4 Flash e V4 Pro, modelos que a startup afirma alcançar desempenho de ponta em coding benchmarks e trazer avanços significativos em raciocínio e tarefas baseadas em agentes. A empresa destaca que a técnica Hybrid Attention Architecture foi fundamental para aprimorar a capacidade das plataformas de IA de lembrar consultas ao longo de conversas extensas. A capacidade de serviço para a série V4 Pro, contudo, encontra-se bastante restrita devido a uma crise de compute. A expectativa é que o preço do modelo reduza drasticamente após o lançamento dos clusters de compute equipados com Ascend 950 da Huawei, programado para o segundo semestre deste ano, o que promete aliviar essa limitação.

A Medra é uma empresa que opera com cientistas de IA físicos, controlados por software que lhes permite manipular instrumentos de laboratório de maneira análoga a um ser humano treinado. A companhia abriu um armazém de 3.530 metros quadrados em São Francisco, dedicado à automação de tarefas de biotecnologia para seus clientes. Atualmente, a Medra tem cinco clientes com experimentos programados para serem executados por seu exército de robôs. Os clientes retêm a propriedade de seus dados experimentais, enquanto a Medra mantém o conhecimento sobre os processos.

Elon Musk está exigindo mais de US$ 150 bilhões em indenização da OpenAI e da Microsoft. Ele também busca a remoção de Sam Altman do conselho da OpenAI e a reversão da recente transição da empresa para operar como uma entidade com fins lucrativos, alegando que essa mudança desvirtua os princípios originais.

A UI (User Interface) não está com os dias contados, pois os humanos continuarão utilizando software. Contudo, em breve, 80% da interação com essas ferramentas será mediada por agentes. Essa mudança revolucionária redefine não apenas o que precisa ser desenvolvido, mas também como a construção do software será feita, prometendo um futuro distinto para o design e a engenharia.

A Microsoft está oferecendo buyouts voluntários a funcionários com tempo de casa, em um programa que faz parte de uma reestruturação maior da empresa para alterar seu sistema de avaliação de desempenho e a forma como concede bônus e stock options. O programa é destinado apenas a uma pequena porcentagem de funcionários de longa data nos EUA. Para ser elegível, o funcionário deve estar em nível de diretor sênior ou abaixo, e a soma de seus anos de serviço e idade deve ser de, no mínimo, 70.

A string 'auto', quando colocada no início de um atributo 'sizes', instruirá qualquer navegador com suporte a essa funcionalidade a determinar automaticamente o tamanho da imagem.

A Meta planeja demitir cerca de 8.000 funcionários a partir de 20 de maio. A empresa afirma que as reduções de postos de trabalho são necessárias para melhorar a eficiência, enquanto direciona seus esforços para a IA generativa. O relatório anual da Meta em janeiro indicou que a companhia contava com uma força de trabalho global de 78.865 empregados em 31 de dezembro. Os cortes de empregos estão se intensificando no setor de tecnologia devido ao avanço da IA.

O ggsql é uma ferramenta, atualmente em fase alpha, que permite aos usuários criar gráficos diretamente em consultas SQL, eliminando a necessidade de alternar para Python ou R. Seu objetivo é tornar a visualização de dados mais rápida, clara e escalável, executando os cálculos dos gráficos no próprio banco de dados, além de facilitar sua geração por ferramentas de IA.

O Airbnb desenvolveu um sistema interno de armazenamento de métricas capaz de ingerir aproximadamente 50 milhões de amostras por segundo em cerca de 1,3 bilhão de séries temporais. Isso foi alcançado através da introdução de isolamento rigoroso multi-tenant, incluindo tenancy por serviço e shuffle sharding, além de guardrails em operações de leitura e escrita, visando prevenir que qualquer carga de trabalho individual sobrecarregue o sistema.

Dados prontos para analytics são projetados para humanos: eles são agregados, estáveis e explicáveis para que dashboards possam responder de forma confiável 'o que aconteceu'. Já os dados prontos para IA são construídos para modelos, visando preservar detalhes brutos, contexto, semântica e atualidade, permitindo que os sistemas inferam 'o que deve acontecer em seguida', enquanto a agregação frequentemente destrói o próprio sinal que a IA necessita.

À medida que a analytics transita da análise centrada em BI e conduzida por humanos para workflows baseados em agentes, a maior disrupção ocorre na camada de 'uso de dados', onde agentes de IA já estão em operação e consultas iniciadas por agentes podem superar as iniciadas por humanos em 12 meses.

A combinação de Cloudflare R2 e R2 Data Catalog torna viável a criação de um Iceberg lake de baixo custo e escalável para uso em notebooks, devido à ausência de taxas de egress, armazenamento compatível com S3 e metadados de catálogo gerenciados para Trino/DuckDB. O desafio da ingestão é abordado no artigo com um proxy HTTP em Rust de aproximadamente 500 linhas de código, que converte dados NDJSON enviados via POST em um único commit atômico no Iceberg.

Anthropic, OpenAI e NVIDIA estão enfrentando limites significativos na economia e infraestrutura de IA: problemas de uptime, escassez de capacidade e desenvolvimentos de compute que ficam muito aquém da demanda anunciada. Os serviços Claude da Anthropic registraram um uptime entre 98,79% e 99,25% em 90 dias, enquanto o mercado em geral possui apenas 15,2GW dos 114GW de capacidade prometida para data centers de IA em construção. O aumento dos custos de inference está levando grandes fornecedores como Microsoft e Anthropic a adotar faturamento baseado em token, limites de taxa mais rigorosos e subsídios reduzidos.

O sistema MIQPS do Pinterest realiza a normalização de URLs, removendo ruídos como parâmetros de rastreamento e diferenças de formatação. O objetivo é mapear diversas variantes de URLs para uma única forma canônica, permitindo que elas sejam agrupadas em categorias de equivalência. O processo inclui salvaguardas para garantir precisão, evitando a fusão inadequada de conteúdos distintos, e opera com ciclos de avaliação contínua para aferir a acurácia e ajustar as regras conforme necessário ao longo do tempo.

Um novo método de compressão de KV-cache para LLMs substitui o simples token pruning por uma abordagem mais inteligente: ele identifica contextos de baixo valor, os resume matematicamente e armazena uma versão compacta em vez de simplesmente deletá-los. Em testes, essa técnica resultou em maior precisão e menor uso de memória do que os métodos comuns Top-K ou sliding-window, sugerindo que janelas de contexto mais longas podem ser gerenciadas com maior eficiência.

A Meta re-arquitetou a busca restrita dos Grupos do Facebook com um stack de retrieval híbrido. Essa nova arquitetura combina a busca lexical de índice invertido Unicorn com um retriever semântico de 12 camadas e 200 milhões de parâmetros, utilizando Faiss ANN sobre embeddings pré-calculados. O sistema inclui pré-processamento de query, rankeamento em nível de features com BM25/TF-IDF mais similaridade de cosseno, e um supermodelo MTML que otimiza conjuntamente cliques, compartilhamentos e comentários. Para escalar a validação, a Meta adicionou um juiz automatizado baseado em Llama 3 no BVT, incluindo uma classe de "parcialmente relevante" para um julgamento mais refinado.

Ontologias empresariais globais frequentemente falham ao forçar diferentes contextos de negócio a compartilhar um único modelo denotacional para termos como cliente, produto e localidade. A abordagem proposta, baseada em interface, visa resolver isso, mantendo ontologias ricas e específicas de domínio dentro de cada limite contextual. Ela expõe apenas projeções sensíveis ao contexto através de mecanismos como reificação RDF 1.2, conotações SHACL 1.2, named graphs e SPARQL transforms. Isso possibilita mudanças de significado auditáveis, uma interoperabilidade mais segura entre domínios e uma mistura prática de descoberta de mundo aberto com raciocínio de mundo fechado na camada de interface.

A Adobe CX Enterprise, uma plataforma corporativa apresentada no Adobe Summit, foi desenvolvida para coordenar agentes de IA em fluxos de trabalho de marketing, conteúdo e engajamento do cliente. Construído sobre sua Experience Platform, o sistema integra camadas de Brand and Engagement Intelligence, um coordenador multi-agente, e parcerias estratégicas com AWS, Anthropic, Google, IBM, Microsoft, Nvidia e OpenAI. A empresa também reportou um crescimento de 269% ano a ano no tráfego movido por IA para sites de varejo nos EUA, enquanto continua a expandir sua atuação em visibilidade de pesquisa baseada em IA e aprimorar sua plataforma de conteúdo GenStudio.