Ein Modellführer für die GPT-6-Familie
Original: A model guide for the GPT-6 family
OpenAI published guidance for startups on choosing among GPT-6 family models, setting reasoning effort, and preparing prompts, tools and workflows for production.
Tägliche KI-Nachrichten aus offiziellen Quellen, Hacker News und arXiv
Titel und Zusammenfassungen auf dieser Seite sind offline maschinell aus dem Englischen übersetzt und können Fehler enthalten. Maßgeblich ist das verlinkte Original.
Die nicht autorisierte Destillation von Modelloutputs ist ein wachsendes Sicherheitsproblem für KI-Labors; dies ist OpenAIs eigener Bericht über die Erkennung und Störung einer Kampagne.
OpenAI
Ein 8B-Open-Gewichtsmodell, das speziell für zitierte wissenschaftliche Berichte gebaut wurde, die Teams auf ihrer eigenen Infrastruktur betreiben können.
Ai2 (Allen Institute for AI)
Cloudflare's post on open-weight decision models and an RL fine-tuning platform was the most-upvoted AI story on Hacker News in this edition's 36-hour window.
Hacker News
Hinweis der Redaktion: Die Zusammenfassungen wurden mit KI-Unterstützung aus dem Text der jeweiligen Herausgeber entworfen und warten noch auf eine menschliche Prüfung.
Beiträge aus offiziellen Blogs von Unternehmen und Laboren der letzten 7 Tage.
Original: A model guide for the GPT-6 family
OpenAI published guidance for startups on choosing among GPT-6 family models, setting reasoning effort, and preparing prompts, tools and workflows for production.
Original: The eternal complement
Ein OpenAI-Essay argumentiert, dass fortgeschrittene KI am wichtigsten sein könnte, wenn sie die routinemäßige Ausführungsarbeit hinter Durchbrüchen beschleunigt, was das Tempo des wirtschaftlichen Fortschritts bestimmen könnte.
Original: How Albertsons Companies is reimagining retail from the inside out
Kundengeschichte: Der Lebensmitteleinzelhändler Albertsons Companies beschreibt die Verwendung von ChatGPT Enterprise und der OpenAI API, um die interne Arbeit zu beschleunigen und den Kunden das Einkaufen zu erleichtern.
Original: The Den frees up 10-15 hours a week to grow with ChatGPT Work
Kundengeschichte: Social Club The Den sagt, ChatGPT Work verkürzte Aufgaben wie Zuschussanträge von Tagen auf Stunden und sparte seinem Team 10-15 Stunden pro Woche.
Original: Disrupting a coordinated model-distillation campaign
OpenAI sagt, dass es einen koordinierten Versuch unterbrochen hat, geschützte Modellargumente durch Destillation zu extrahieren, und seine Verteidigung gegen solche Angriffe stärkt.
Original: Helping small businesses put AI to work
OpenAI arbeitet mit dem amerikanischen SBDC zusammen, um praktische KI-Schulungen und lokale Unterstützung für kleine Unternehmen auszubauen, zusammen mit einem Bericht darüber, wie kleine Teams KI nutzen.
Original: AutoSynthData: Generating Training Data for Enterprise Agents
ServiceNow AI beschreibt AutoSynthData, eine Methode, mit der die beobachteten Schwächen eines Unternehmensagenten in viele neue, überprüfbare Schulungsaufgaben umgewandelt werden können, die zur Zielumgebung passen.
Original: Open TTS Leaderboard: Scalable Evaluation for Multilingual Text-to-Speech and Voice Cloning
Hugging Face stellt das Open TTS Leaderboard vor, um die Auswertung von mehrsprachigen Text-zu-Sprache- und Stimmklonmodellen standardisierter zu machen als die heutigen fragmentierten, arenabasierten Vergleiche.
Original: NVIDIA Kumo Tabular Sets a New Accuracy-Efficiency Frontier for Tabular Prediction
NVIDIA präsentiert Kumo Tabular, ein tabellarisches Grundlagenmodell, das neue Zeilen durch In-Kontext-Lernen vorhersagt, anstatt für jede Aufgabe ein separates Gradienten-verstärktes Modell zu trainieren.
Original: Getting the Source Right, Not Just the Fact: Source-Aware Verification for MCP Agents
Multiverse Computing erklärt sein ProvenanceGuard-Papier, in dem nicht nur überprüft wird, ob der Anspruch eines MCP-Agenten wahr ist, sondern auch, ob er der richtigen Quelle zugeschrieben wird.
Original: Holo4: powering generalist computer-use agents
H Company hat Holo4, agentische Computer-Nutzungsmodelle in 27B dichten und 35B-A3B Mix-of-Experten-Größen auf seiner H Models API sowie ein aktualisiertes Holotron4 Nano veröffentlicht.
Mistral AI eröffnet einen Münchner Hub für Physik-KI und industrielle KI-Forschung und arbeitet mit Partnern aus der deutschen Industrie zusammen.
NVIDIA presents a 64GB DGX Spark as a way for developers to build and run increasingly capable open models and AI agents locally.
Original: How NVIDIA GPUs Help Accelerate OpenAI’s GPT-6 Astra Ultrafast
NVIDIA sagt, dass GPT-6 Astra Ultrafast von OpenAI auf NVIDIA Blackwell-GPUs läuft; das Modell ist in der OpenAI-API und für berechtigte ChatGPT-Arbeits- und Codex-Benutzer verfügbar.
Original: Productive, Durable, Fungible: How NVIDIA AI Factories Maximize Return on Investment
NVIDIA plädiert für Renditen aus der KI-Fabrik und zitiert Kosten von rund 60 Millionen US-Dollar pro Megawatt und argumentiert, dass Betreiber einen klaren ROI benötigen, bevor sie Kapital bereitstellen.
Original: NVIDIA Opens Applications for 2027–2028 Graduate Fellowships With Awards Up to $60,000
NVIDIA eröffnete Bewerbungen für sein Graduate Fellowship-Programm 2027-2028 mit Auszeichnungen von bis zu 60.000 US-Dollar.
Original: From Training to Production, NVIDIA and CoreWeave Close the Loop on Agentic AI
NVIDIA und CoreWeave beschreiben ihre langjährige Co-Engineering-Partnerschaft und eine KI-fokussierte Cloud, die Agentic AI von der Ausbildung bis zur Produktion abdeckt.
Original: Open-sourcing AstaBrief, the fast report-generation model in Asta
Ai2 veröffentlichte AstaBrief, ein 8B-Open-Gewichtsmodell, das zitierte wissenschaftliche Berichte schreibt; es unterstützt den Schnellmodus von Asta und kann heruntergeladen werden, um auf Ihrer eigenen Infrastruktur zu laufen.
Original: Introducing Olmo-core 3: Open, scalable training infrastructure for large MoEs
Ai2 führte Olmo-Core 3 ein, einen neu gestalteten und vollständig offenen Trainingsstapel, um Mixed-of-Experten-Modelle in Richtung des Billionen-Parameter-Bereichs zu skalieren.
Original: New tool lets users repair AI-generated 3D models, then fabricate them just the way they want
MIT-Forscher präsentieren InstructMesh, ein Tool, das leicht zu bearbeitende Designs von Alltagsgegenständen produziert, so dass sowohl Experten als auch Anfänger KI-generierte 3D-Modelle reparieren und herstellen können.
Das Transit Lab des MIT wird einen Open-Source Public Transit Intelligence Hub aufbauen, der mit 2,1 Millionen US-Dollar von Google.org finanziert wird, um Transitüberwachung, -betrieb und Fahrerkommunikation zu vereinheitlichen.
Original: This game-playing AI is the new champ at Stratego
MIT News reports on an AI system that beats top-ranked human Stratego players and is more efficient than other models; the researchers see uses in strategic decision-making.
Original: The effects of an “algorithmic monoculture” depend on the details
Eine MIT-Studie über Einstellungsentscheidungen stellt fest, dass viele Unternehmen, die sich auf den gleichen Algorithmus verlassen, in einigen Situationen Arbeitssuchenden zugute kommen können.
Original: Who we become when we talk to machines
MIT professor Sherry Turkle's new book, "Artificial Intimacy," critiques chatbots and the antisocial dynamics she argues they encourage.
Beiträge mit KI-bezogenen Titeln, sortiert nach Punkten der letzten 36 Stunden.
Original: Clef: Open-weight decision models, and new RL fine-tuning platform
Original: DeepSeek Harness Desktop for macOS and Windows
Original: Meta Uses A.I. Data Centers to Avoid Billions in Federal Taxes
Original: FTC is investigating OpenAI, Anthropic and other AI companies over product risks
Original: Vote on which of Hacker News' challenges for AI have been met
Original: GPT-Synopsys: Frontier Intelligence to Revolutionize Chip Design
Original: AI Makes Me Sad
Original: An AI sovereign wealth fund isn't progressive – it's techno-imperialism
Original: Identity Management for Agentic AI [pdf] (2025)
Original: Don't be fooled–LLMs don't reason
Automatische Auswahl neuer Einreichungen, bevorzugt Paper, die zugleich in cs.AI, cs.CL und cs.LG gelistet sind. Kein Qualitätsranking.
Original: Comedic Fool's Gold: Reward Exploits and Countermeasures in Conversational Humor
Wir untersuchen automatisierte Belohnungen für das Training von Sprachmodellen im Gesprächs-Humor, wobei wir uns auf Belohnungs-Exploits und Gegenmaßnahmen konzentrieren.
Original: Robust Is Salient: An Informed Adversary Moves the Optimal Signal onto the Salience Pole
When an informed adversary shares the audience of a constrained signalling channel, the signal that best protects the truth is the signal that best describes it.
Original: ContractRL: Shielded Group-Relative Policy Optimization for Auditable Tool-Call Repair
Strukturierte Toolaufrufe scheitern oft, nachdem nur eine kleine Anzahl von Feldern gegen ein Schema oder einen Ausführungsvertrag verstößt.
Original: ActiveSaddler: Automated Curriculum Learning for Agent Harness Optimization
Die automatisierte Kabelbaumoptimierung kann LLM-Agenten erheblich verbessern, indem sie ihre Eingabeaufforderungen, Werkzeugschnittstellen und Steuerungslogik durch Ausführungsfeedback iterativ aktualisiert.
Original: Generation Provenance Before Behavior Attribution: Auditing Synthetic Speech Research Objects
Um das Modellverhalten synthetischen Trainingsdaten zuzuordnen, muss man wissen, was jedes Trainingselement produziert hat, bevor man schätzt, was dieses Element verursacht hat.
Original: How Divergence Becomes Decision Flips in Compressed Language Models
Komprimierungsberichte fassen zusammen, wie weit sich ein komprimiertes Sprachmodell vom dichten bewegt hat, normalerweise durch eine KL-Divergenz; eine Bereitstellung, die auf den Outputs des dichten Modells beruht, muss wissen, wie viele seiner Entscheidungen sich geändert haben.
Original: ReHoPER: Receding-Horizon Planning for Enhanced Reasoning
Wir schlagen ReHoPER vor, eine reine Inferenz-Null-Schuss-Methode, die die Argumentation großer Sprachmodelle verbessert, indem Zwischenfragen entlang mehrerer Pfade vor der endgültigen Antwort generiert und beantwortet werden.
Original: Distilling Directional Verification
Die Wissensdestillation zielt darauf ab, das sachliche Wissen großer Sprachmodelle auf kleinere Modelle für einen effizienten Einsatz zu übertragen.
Original: Capturing In-Context Learning Dynamics with Task Operators
In-Kontext-Lernen (ICL) ermöglicht Sprachmodellen, neue Aufgaben aus Demonstrationen ohne Gewichtsaktualisierungen auszuführen.
Original: Temporally-Resolved Token Attribution Reveals the Generation Dynamics of Diffusion Language Models
Diese Arbeit stellt Diffusion Layer Integrated Gradients (DLIG) vor, eine Token-Attributionsmethode für Diffusionssprachenmodelle (DLMs), die Integrated Gradients (IG~\cite{sundararajan2017axiomatic}) auf beliebige Schichten und Entrauschungsschritte erweitert.
Original: FAER: Auditable Utility-Aligned Trajectory Replay for Language Model Post-Training
Replay-Selektoren ordnen zwischengespeicherte Trajektorien oft nach Format-Feedback, Vertrauen, Frische oder Reaktionslänge ein, obwohl die Cache-Level-Korrektheit und das nachgelagerte Lernprogramm unterschiedliche Ziele sind.
Original: Pre-training interventions, ex post facto: Grafting model beliefs across checkpoints
Pre-training interventions are critical to alignment research, since beliefs formed during pre-training shape how a model generalizes from later training.
Original: CARM: Cancellation-Aware Response Masking for LLM Reinforcement Learning
In den letzten Jahren wurde die rasche Einführung von Reinforcement Learning (RL) in die Nachschulung von Großsprachenmodellen (LLM) mit erheblichen Zuwächsen bei mathematischem Denken und Codegenerierung beobachtet.
Original: Finetuning with Sampling: SFT Learns Better Than You Think
Die Einführung neuer Fähigkeiten in Grenzmodelle ist seit langem das Ziel des Posttrainings, das zu diesem Zweck hauptsächlich überwachtes Finetuning (SFT) und Verstärkungslernen (RL) einsetzt.
Original: FourierQK: Filter Shape, Admissibility and the Leakage-Coverage Law
Frequency-collapse attention [Zeris, 2026e] achieves large gains over standard dot-product attention by replacing the Q/K dot product with a bandpass-filtered inner product at a learned frequency.
Nicht berücksichtigt:
Aktualisiert: 2026-10-02 16:45 UTC