A destilação não autorizada de saídas de modelos é uma crescente preocupação de segurança para laboratórios de IA; esta é a própria conta da OpenAI de detectar e interromper uma campanha.
Cloudflare's post on open-weight decision models and an RL fine-tuning platform was the most-upvoted AI story on Hacker News in this edition's 36-hour window.
Hacker News
Nota do editor: Os resumos foram redigidos com ajuda de IA a partir do texto de cada editor original e aguardam revisão humana.
De empresas e laboratórios de IA
Posts de blogs oficiais de empresas e laboratórios publicados nos últimos 7 dias.
O OpenAI publicou orientações para startups na escolha entre os modelos da família GPT-6, definição do esforço de raciocínio e preparação de prompts, ferramentas e fluxos de trabalho para produção.
Um ensaio OpenAI argumenta que IA avançada pode importar mais acelerando o trabalho de execução de rotina por trás de avanços, o que poderia definir o ritmo do progresso econômico.
Original: How Albertsons Companies is reimagining retail from the inside out
História do cliente: o varejista Albertsons Companys descreve o uso do ChatGPT Enterprise e da API OpenAI para acelerar o trabalho interno e facilitar as compras para os clientes.
Original: The Den frees up 10-15 hours a week to grow with ChatGPT Work
História do cliente: clube social O Den diz que o ChatGPT Work encurta tarefas como pedidos de concessão de dias a horas, economizando sua equipe de 10 a 15 horas por semana.
Original: Disrupting a coordinated model-distillation campaign
A OpenAI diz que interrompeu uma tentativa coordenada de extrair o raciocínio do modelo protegido através da destilação e está fortalecendo suas defesas contra tais ataques.
A OpenAI está fazendo parceria com a SBDC da América para expandir o treinamento prático de IA e o suporte local para pequenas empresas, além de um relatório sobre como as equipes pequenas usam IA.
Original: AutoSynthData: Generating Training Data for Enterprise Agents
ServiceNow IA descreve AutoSynthData, um método para transformar as fraquezas observadas por um agente empresarial em muitas tarefas de treinamento novas e verificáveis que se encaixam no ambiente alvo.
Original: Open TTS Leaderboard: Scalable Evaluation for Multilingual Text-to-Speech and Voice Cloning
O Hugging Face apresenta o Open TTS Leaderboard para fazer a avaliação de modelos multilingues de texto para fala e clonagem de voz mais padronizados do que as comparações fragmentadas e baseadas em arenas de hoje.
Original: NVIDIA Kumo Tabular Sets a New Accuracy-Efficiency Frontier for Tabular Prediction
NVIDIA apresenta Kumo Tabular, um modelo de fundação tabular que prediz novas linhas através da aprendizagem em contexto em vez de treinar um modelo de gradiente separado para cada tarefa.
Original: Getting the Source Right, Not Just the Fact: Source-Aware Verification for MCP Agents
Multiverse Computing explica seu documento ProvenanceGuard, que verifica não só se a reivindicação de um agente MCP é verdadeira, mas se é atribuída à fonte certa.
H Company lançou Holo4, modelos de uso de computador agente em 27B denso e 35B-A3B mistura-de-especialistas tamanhos em sua API H Modelos, além de um atualizado Holotron4 Nano.
Original: NVIDIA DGX Spark 64GB Gives Developers More Ways to Build and Scale Local AI
NVIDIA apresenta um 64GB DGX Spark como uma forma para os desenvolvedores construirem e executarem modelos abertos cada vez mais capazes e agentes de IA localmente.
Original: How NVIDIA GPUs Help Accelerate OpenAI’s GPT-6 Astra Ultrafast
NVIDIA diz que o GPT-6 Astra Ultrafast do OpenAI é executado em GPUs NVIDIA Blackwell; o modelo está disponível na API OpenAI e para usuários elegíveis do ChatGPT Work e Codex.
Original: Productive, Durable, Fungible: How NVIDIA AI Factories Maximize Return on Investment
NVIDIA faz seu caso para retornos de AI-factory, citando um custo de cerca de US $ 60 milhões por megawatt e argumentando que os operadores precisam de um ROI claro antes de cometer capital.
Original: Open-sourcing AstaBrief, the fast report-generation model in Asta
O Ai2 lançou o AstaBrief, um modelo de pesos abertos 8B que escreve relatórios científicos citados; ele ativa o modo rápido da Asta e pode ser baixado para ser executado em sua própria infraestrutura.
Original: Introducing Olmo-core 3: Open, scalable training infrastructure for large MoEs
O Ai2 introduziu o Olmo-core 3, uma pilha de treinamento totalmente aberta e redesenhada para escalar modelos de mistura de especialistas em direção à faixa de trilhões de parâmetros.
Original: New tool lets users repair AI-generated 3D models, then fabricate them just the way they want
Os pesquisadores do MIT apresentam a InstructMesh, uma ferramenta que produz projetos fáceis de editar de objetos do dia-a-dia para que especialistas e iniciantes possam reparar modelos 3D gerados por IA e fabricá-los.
MIT's Transit Lab will build an open-source Public Transit Intelligence Hub, funded with $2.1 million from Google.org, to unify transit monitoring, operations and rider communication.
O MIT News relata um sistema de IA que vence jogadores humanos de topo e é mais eficiente do que outros modelos; os pesquisadores veem usos na tomada de decisões estratégicas.
Original: The effects of an “algorithmic monoculture” depend on the details
Um estudo do MIT sobre a contratação de decisões descobre que muitas empresas que dependem do mesmo algoritmo podem, em algumas situações, beneficiar os candidatos a emprego.
O novo livro do professor do MIT Sherry Turkle, "Intimidade Artificial", critica os chatbots e as dinâmicas anti-sociais que ela argumenta encorajarem.
MIT News – Artificial intelligence · · Resumo
Destaques de IA no Hacker News
Histórias com títulos relacionados a IA, ordenadas por pontos nas últimas 36 horas.
Original: Comedic Fool's Gold: Reward Exploits and Countermeasures in Conversational Humor
Investigamos recompensas automatizadas para o treinamento de modelos de linguagem em humor conversacional, com foco em façanhas de recompensa e contramedidas.
arXiv · · Sam Larson · cs.AI cs.CL cs.LG · Do resumo (arXiv, CC0)
Original: Robust Is Salient: An Informed Adversary Moves the Optimal Signal onto the Salience Pole
Quando um adversário informado compartilha o público de um canal de sinalização restrito, o sinal que melhor protege a verdade é o sinal que melhor o descreve.
Original: ActiveSaddler: Automated Curriculum Learning for Agent Harness Optimization
A otimização automatizada do arnês pode melhorar substancialmente os agentes LLM atualizando iterativamente seus prompts, interfaces de ferramentas e lógica de controle a partir do feedback de execução.
arXiv · · Sungho Park, Wonjoong Kim, Jue Zhang +8 · cs.AI cs.CL cs.LG cs.MA · Do resumo (arXiv, CC0)
Original: Generation Provenance Before Behavior Attribution: Auditing Synthetic Speech Research Objects
A atribuição do comportamento do modelo aos dados de treinamento sintético requer saber o que produziu cada item de treinamento antes de estimar o que esse item causou.
Original: How Divergence Becomes Decision Flips in Compressed Language Models
Relatórios de compressão resumem o quão longe um modelo de linguagem comprimido se moveu do denso, geralmente por uma divergência KL; uma implantação que depende das saídas do modelo denso precisa saber quantas de suas decisões mudaram.
Original: ReHoPER: Receding-Horizon Planning for Enhanced Reasoning
Propomos ReHoPER, um método apenas de inferência, de tiro zero que melhora o raciocínio dos modelos de linguagem de grande porte, gerando e respondendo perguntas intermediárias ao longo de múltiplos caminhos antes da resposta final.
Original: Temporally-Resolved Token Attribution Reveals the Generation Dynamics of Diffusion Language Models
Este trabalho apresenta Gradientes Integrados de Camada de Difusão (DLIG), um método de atribuição de token para modelos de linguagem de difusão (DLMs) que estende Gradientes Integrados (IG~\cite{sundararajan2017axiomatic}) a camadas arbitrárias e etapas de denoização.
Original: FAER: Auditable Utility-Aligned Trajectory Replay for Language Model Post-Training
Seletores de repetição muitas vezes classificam trajetórias em cache por feedback de formato, confiança, frescura ou comprimento de resposta, embora a correção de nível de cache e o utilitário de aprendizagem a jusante sejam objetivos distintos.
Original: Pre-training interventions, ex post facto: Grafting model beliefs across checkpoints
Pre-training interventions are critical to alignment research, since beliefs formed during pre-training shape how a model generalizes from later training.
arXiv · · Peter Nutter, Dani Roytburg, Cl\'ement Dumas +2 · cs.LG cs.AI cs.CL · Do resumo (arXiv, CC0)
Original: CARM: Cancellation-Aware Response Masking for LLM Reinforcement Learning
Recent years have witnessed the rapid adoption of reinforcement learning (RL) in large language model (LLM) post-training, with substantial gains in mathematical reasoning and code generation.
Original: Finetuning with Sampling: SFT Learns Better Than You Think
A introdução de novas capacidades aos modelos de fronteira tem sido o objetivo da pós-treinamento, que emprega predominantemente a fintuning supervisionado (SFT) e a aprendizagem de reforço (RL) para este fim.
arXiv · · Aayush Karan, Sitan Chen, Yilun Du · cs.LG cs.AI cs.CL · Do resumo (arXiv, CC0)
Original: FourierQK: Filter Shape, Admissibility and the Leakage-Coverage Law
Frequency-collapse attention [Zeris, 2026e] achieves large gains over standard dot-product attention by replacing the Q/K dot product with a bandpass-filtered inner product at a learned frequency.