O North Mini Code é um modelo de codificação com 30B de parâmetros e arquitetura MoE, utilizando 3B de parâmetros ativos. Este lançamento sob licença Apache 2.0 visa permitir um desenvolvimento de software eficiente e baseado em agentes em ambientes de IA soberana.
CEVIU News
As melhores notícias de tecnologia, curadas diariamente para quem vive tech.
801 notícias encontradas
A Anthropic anunciou o Claude Fable 5 para uso geral e o Claude Mythos 5, disponível para defensores cibernéticos e provedores de infraestrutura selecionados. Os modelos são descritos como altamente capazes em engenharia de software, pesquisa, visão computacional e cibersegurança, com o Fable 5 incorporando salvaguardas conservadoras.
A participação da DeepSeek em volume de tokens no AI Gateway saltou de menos de 1% para 17% em um único mês, enquanto sua fatia no total de gastos permaneceu próxima de 1%.
Modelos mais baratos frequentemente podem substituir frontier models em diversas tarefas sem perda de qualidade, desde que os sistemas sejam configurados de maneira eficiente.
Veja como a LSEG utiliza a OpenAI para escalar IA confiável em seus negócios globais, acelerando insights, reduzindo ciclos de release e capacitando 4.000 funcionários.
Conheça nossas ideias ambiciosas de política industrial centradas nas pessoas para a era da IA, focadas em ampliar oportunidades, compartilhar prosperidade e construir instituições resilientes à medida que a inteligência avançada evolui.
Como o Notion utiliza o Codex para criar especificações em one-shot, desenvolver entrada de voz por IA para a web e multiplicar a capacidade de engenharia em equipes pequenas.
Como os engenheiros da Nextdoor utilizam o Codex com o GPT-5.5 para investigar problemas difíceis de reproduzir, desenvolver entre plataformas e focar em resultados de produto.
A Cohere introduziu o North Mini Code, seu novo modelo focado em tarefas de programação e desenvolvimento de software.
O artigo explora a eficácia de modelos de ASR de fronteira no processamento de fala que alterna entre idiomas, uma prática comum entre clientes bilíngues, avaliando como essas tecnologias lidam com o fenômeno de code-switching.
O modelo Claude Fable 5 foi adicionado ao catálogo do AI Gateway da Vercel.
Saiba como os funcionários do Google utilizaram IA para produzir o evento Google I/O 2026.
O Gemini 3.5 Live Translate traz tradução de fala natural e em tempo real para o Google AI Studio, Google Tradutor e Google Meet.
O SchemaFlow apresenta um fluxo de trabalho assistido por IA para gerenciar solicitações de alteração em bancos de dados, desde o parsing de requisições estruturadas até a análise de impacto, geração de SQL, aplicação de guardrails, criação de artefatos e avaliação final. Embora o guia prático use um caso do varejo (programa de fidelidade), a arquitetura é genérica e escalável para qualquer domínio corporativo com dados estruturados.
A Apple anunciou a reformulação da Siri, que passa a se chamar Siri IA e chega com capacidade conversacional ampliada. O lançamento está previsto para o outono, junto às novas versões dos sistemas operacionais da empresa. A atualização inclui melhorias nos Foundation Models on-device impulsionadas pelo Google e integração mais profunda de IA em todas as plataformas Apple.
A xAI está se consolidando menos como laboratório de IA e mais como operadora de infraestrutura: suas novas parcerias com Anthropic e Google envolvem fornecimento massivo de capacidade computacional, com receita direcionada à SpaceX, que prepara abertura de capital. Apesar de cláusulas de rescisão com aviso de 90 dias após carência inicial, os contratos são altamente lucrativos: em 18 meses, a xAI recupera todo o investimento e ainda mantém centenas de MW de GPUs para uso próprio.
A maioria das soluções de observability para agentes de IA para no rastreamento (traces), deixando todo o ciclo de depuração nas mãos humanas. Cada atualização de modelo exige inspeção manual de traces, formulação de hipóteses, escrita de patches e testes empíricos, um processo lento, frágil e escalável apenas com muito esforço. A saída é construir harnesses capazes de detectar falhas, diagnosticar causas e aplicar correções automaticamente: não como luxo, mas como exigência operacional.
Sam Altman e Jakub Pachocki descrevem a terceira fase da OpenAI com três metas centrais: desenvolver um pesquisador de IA automatizado, acelerar a economia garantindo distribuição ampla dos ganhos e entregar uma AGI pessoal para cada pessoa no planeta. Para eles, o caminho mais seguro é tornar a IA avançada abundante, acessível e simples o suficiente para qualquer indivíduo ou organização, e a distribuição ampla de poder é vista como a estratégia mais responsável.
A Xiaomi, em parceria com a TileRT, lançou o MiMo-V2.5-Pro-UltraSpeed, modelo de 1 trilhão de parâmetros que atinge 1.000 tokens por segundo em um nó padrão de 8 GPUs, até 15 vezes mais rápido que concorrentes como ChatGPT e Claude. O ganho vem de quantização FP4 nas camadas de especialistas e do DFlash speculative decoding, técnica que propõe blocos inteiros de tokens em vez de processá-los um a um. O modelo está disponível em teste limitado de API até 23 de junho, com custo três vezes maior que a versão padrão, mas entregando cerca de dez vezes mais saída.
A OpenAI confirmou ter submetido uma minuta de formulário S-1 de forma confidencial à Securities and Exchange Commission (SEC), mantendo em aberto a possibilidade de um IPO futuro, sem, contudo, definir prazo ou cronograma. O documento reforça que a decisão preserva flexibilidade estratégica, enquanto a empresa avalia os trade-offs entre seguir como empresa privada ou buscar capital aberto, sem alterar sua atual governança ou modelo operacional.
