Unauthorized distillation of model outputs is a growing security concern for AI labs; this is OpenAI's own account of detecting and disrupting one campaign.
Cloudflare's post on open-weight decision models and an RL fine-tuning platform was the most-upvoted AI story on Hacker News in this edition's 36-hour window.
Hacker News
Noot van de redactie: De samenvattingen zijn met hulp van AI opgesteld op basis van de tekst van elke uitgever en wachten nog op menselijke controle.
Van AI-bedrijven en -labs
Berichten van officiële blogs van bedrijven en labs uit de afgelopen 7 dagen.
OpenAI published guidance for startups on choosing among GPT-6 family models, setting reasoning effort, and preparing prompts, tools and workflows for production.
An OpenAI essay argues that advanced AI may matter most by speeding up the routine execution work behind breakthroughs, which could set the pace of economic progress.
Origineel: How Albertsons Companies is reimagining retail from the inside out
Klantenverhaal: supermarktdealer Albertsons Bedrijven beschrijven het gebruik van ChatGPT Enterprise en de OpenAI API om het interne werk te versnellen en winkelen voor klanten te vergemakkelijken.
Origineel: The Den frees up 10-15 hours a week to grow with ChatGPT Work
Klantenverhaal: social club The Den zegt ChatGPT Work verkorte taken zoals subsidieaanvragen van dagen tot uren, waardoor het team 10-15 uur per week bespaart.
Origineel: Disrupting a coordinated model-distillation campaign
OpenAI zegt dat het verstoorde een gecoördineerde poging om beschermd model redeneren extraheren door middel van destillatie en is het versterken van zijn verdediging tegen dergelijke aanvallen.
Origineel: Helping small businesses put AI to work
OpenAI werkt samen met de Amerikaanse SBDC om de hands-on AI training en lokale ondersteuning voor kleine bedrijven uit te breiden, naast een rapport over hoe kleine teams AI gebruiken.
Origineel: AutoSynthData: Generating Training Data for Enterprise Agents
ServiceNow AI beschrijft AutoSynthData, een methode voor het omzetten van de waargenomen zwakheden van een onderneming agent in vele nieuwe, controleerbare trainingstaken die passen bij de doelomgeving.
Origineel: Open TTS Leaderboard: Scalable Evaluation for Multilingual Text-to-Speech and Voice Cloning
Hugging Face introduceert het Open TTS Leaderboard om de evaluatie van meertalige tekst-tot-spraak- en spraakkloonmodellen gestandaardiseerder te maken dan de huidige gefragmenteerde, op arena gebaseerde vergelijkingen.
Origineel: NVIDIA Kumo Tabular Sets a New Accuracy-Efficiency Frontier for Tabular Prediction
NVIDIA presenteert Kumo Tabular, een tabler foundation model dat nieuwe rijen door in-context leren voorspelt in plaats van een apart gradiënt-verstevigd model voor elke taak te trainen.
Origineel: Getting the Source Right, Not Just the Fact: Source-Aware Verification for MCP Agents
Multiverse Computing legt haar ProvenanceGuard-papier uit, dat niet alleen controleert of de claim van een MCP-agent waar is, maar ook of deze aan de juiste bron wordt toegeschreven.
H Company vrijgegeven Holo4, agentic computer-gebruik modellen in 27B dichte en 35B-A3B mix-of-experts maten op haar H Modellen API, plus een bijgewerkte Holotron4 Nano.
Origineel: NVIDIA DGX Spark 64GB Gives Developers More Ways to Build and Scale Local AI
NVIDIA presenteert een 64GB DGX Spark als een manier voor ontwikkelaars om in toenemende mate open modellen en AI-agenten lokaal te bouwen en te draaien.
Origineel: How NVIDIA GPUs Help Accelerate OpenAI’s GPT-6 Astra Ultrafast
NVIDIA zegt OpenAI's GPT-6 Astra Ultrafast draait op NVIDIA Blackwell GPU's; het model is beschikbaar in de OpenAI API en aan in aanmerking komende ChatGPT Work en Codex gebruikers.
Origineel: Productive, Durable, Fungible: How NVIDIA AI Factories Maximize Return on Investment
NVIDIA maakt zijn zaak voor AI-factory rendement, citaat van een kosten van ongeveer $ 60 miljoen per megawatt en argumenteren operators hebben een duidelijke ROI alvorens kapitaal te plegen.
Origineel: Open-sourcing AstaBrief, the fast report-generation model in Asta
Ai2 heeft AstaBrief uitgebracht, een 8B open-weights model dat geciteerde wetenschappelijke rapporten schrijft; het voedt Asta's Fast mode en kan worden gedownload om te draaien op uw eigen infrastructuur.
Ai2 introduceerde Olmo-core 3, een herontworpen en volledig open training stack voor het schalen van mix-of-deskundige modellen naar de triljoen-parameter bereik.
Origineel: New tool lets users repair AI-generated 3D models, then fabricate them just the way they want
MIT-onderzoekers presenteren InstructMesh, een tool die eenvoudig te bewerken ontwerpen van alledaagse objecten produceert, zodat zowel experts als beginners AI-gegenereerde 3D-modellen kunnen repareren en fabriceren.
MIT News – Artificial intelligence · · Samenvatting
Origineel: MIT Transit Lab to develop an AI platform for public transit agencies
MIT's Transit Lab zal bouwen een open-source Public Transit Intelligence Hub, gefinancierd met $2,1 miljoen van Google.org, om de transit monitoring, operaties en ruiter communicatie te verenigen.
MIT News – Artificial intelligence · · Samenvatting
Origineel: This game-playing AI is the new champ at Stratego
MIT News meldt over een AI-systeem dat top-ranked human Stratego spelers verslaat en efficiënter is dan andere modellen; de onderzoekers zien toepassingen in strategische besluitvorming.
MIT News – Artificial intelligence · · Samenvatting
Origineel: The effects of an “algorithmic monoculture” depend on the details
Een MIT studie van het huren van beslissingen blijkt dat veel bedrijven vertrouwen op hetzelfde algoritme kan, in sommige situaties, voordeel werkzoekenden.
MIT News – Artificial intelligence · · Samenvatting
Origineel: Robust Is Salient: An Informed Adversary Moves the Optimal Signal onto the Salience Pole
When an informed adversary shares the audience of a constrained signalling channel, the signal that best protects the truth is the signal that best describes it.
arXiv · · Cris Huynh · cs.AI cs.CL cs.GT cs.LG · Uit de samenvatting (arXiv, CC0)
Origineel: ActiveSaddler: Automated Curriculum Learning for Agent Harness Optimization
Geautomatiseerde harnasoptimalisatie kan LLM-agenten aanzienlijk verbeteren door hun prompts, gereedschapsinterfaces en controlelogica iteratief te updaten vanaf de feedback bij uitvoering.
arXiv · · Sungho Park, Wonjoong Kim, Jue Zhang +8 · cs.AI cs.CL cs.LG cs.MA · Uit de samenvatting (arXiv, CC0)
Origineel: Generation Provenance Before Behavior Attribution: Auditing Synthetic Speech Research Objects
Het toekennen van modelgedrag aan synthetische trainingsgegevens vereist weten wat geproduceerd elk trainingsitem voordat het schatten wat dat item veroorzaakt.
arXiv · · Sidi Chang, Peiying Zhu · cs.AI cs.CL cs.LG · Uit de samenvatting (arXiv, CC0)
Origineel: How Divergence Becomes Decision Flips in Compressed Language Models
Compression reports summarize how far a compressed language model moved from the dense one, usually by a KL divergence; a deployment that relies on the dense model's outputs needs to know how many of its decisions changed.
arXiv · · Beatriz Almeida Felicio · cs.CL cs.AI cs.LG stat.ML · Uit de samenvatting (arXiv, CC0)
Origineel: ReHoPER: Receding-Horizon Planning for Enhanced Reasoning
We stellen ReHoper voor, een methode die alleen tot gevolg heeft dat de redenering van grote taalmodellen wordt verbeterd door het genereren en beantwoorden van tussentijdse vragen langs meerdere paden voor het uiteindelijke antwoord.
arXiv · · Saeed Ahmadnia, Cornelia Caragea · cs.CL cs.AI cs.LG · Uit de samenvatting (arXiv, CC0)
Origineel: Temporally-Resolved Token Attribution Reveals the Generation Dynamics of Diffusion Language Models
Dit werk presenteert Diffusion Layer Integrated Gradients (DLIG), een token attributie methode voor diffusie taalmodellen (DLM's) die Integrated Gradients (IG~\cite{sundararajan2017axiomatic}) breidt uit tot willekeurige lagen en denigrerende stappen.
arXiv · · Darpan Aswal, C\'eline Hudelot · cs.CL cs.AI cs.LG · Uit de samenvatting (arXiv, CC0)
Origineel: FAER: Auditable Utility-Aligned Trajectory Replay for Language Model Post-Training
Replay selectoren vaak rang gecachede trajecten door het format feedback, vertrouwen, frisheid, of responslengte, hoewel cache-niveau correctheid en downstream leerling nut zijn verschillende doelstellingen.
Origineel: Pre-training interventions, ex post facto: Grafting model beliefs across checkpoints
Pre-training interventies zijn van cruciaal belang voor het afstemmen van onderzoek, aangezien overtuigingen gevormd tijdens de vooropleiding vorm hoe een model generaliseren uit latere opleiding.
arXiv · · Peter Nutter, Dani Roytburg, Cl\'ement Dumas +2 · cs.LG cs.AI cs.CL · Uit de samenvatting (arXiv, CC0)
Origineel: CARM: Cancellation-Aware Response Masking for LLM Reinforcement Learning
De afgelopen jaren is de snelle invoering van versterking leren (RL) in groot taalmodel (LLM) post-training, met aanzienlijke winsten in wiskundige redenering en code generatie.
arXiv · · Yafei Zhang, Songshuo Lu, Sicong Liao +2 · cs.LG cs.AI cs.CL · Uit de samenvatting (arXiv, CC0)
Origineel: Finetuning with Sampling: SFT Learns Better Than You Think
Het invoeren van nieuwe mogelijkheden voor frontiermodellen is al lang het doel van posttraining, die voornamelijk werkt onder toezicht finetuning (SFT) en versterking leren (RL) om dit doel.
arXiv · · Aayush Karan, Sitan Chen, Yilun Du · cs.LG cs.AI cs.CL · Uit de samenvatting (arXiv, CC0)
Origineel: FourierQK: Filter Shape, Admissibility and the Leakage-Coverage Law
Frequency-collapse attentie [Zeris, 2026e] bereikt grote winsten ten opzichte van standaard dot-product aandacht door het Q/K dot product te vervangen door een bandpass-gefilterd binnenproduct met een geleerde frequentie.
arXiv · · Athanasios Zeris · cs.LG cs.CL eess.SP · Uit de samenvatting (arXiv, CC0)