Un guide modèle pour la famille GPT-6
Original: A model guide for the GPT-6 family
OpenAI published guidance for startups on choosing among GPT-6 family models, setting reasoning effort, and preparing prompts, tools and workflows for production.
L'actualité IA du jour : sources officielles, Hacker News et arXiv
Les titres et résumés de cette page sont traduits automatiquement de l'anglais (hors ligne) et peuvent contenir des erreurs. L'original en lien fait foi.
La distillation non autorisée des sorties de modèles est une préoccupation croissante en matière de sécurité pour les laboratoires d'IA; c'est le compte propre d'OpenAI de détecter et de perturber une campagne.
OpenAI
Un modèle à poids ouvert 8B construit spécifiquement pour les rapports scientifiques cités que les équipes peuvent utiliser sur leur propre infrastructure.
Ai2 (Allen Institute for AI)
Cloudflare's post on open-weight decision models and an RL fine-tuning platform was the most-upvoted AI story on Hacker News in this edition's 36-hour window.
Hacker News
Note de la rédaction: Les résumés ont été rédigés avec l'aide de l'IA à partir du texte de chaque éditeur et attendent une relecture humaine.
Billets des blogs officiels d'entreprises et de laboratoires publiés au cours des 7 derniers jours.
Original: A model guide for the GPT-6 family
OpenAI published guidance for startups on choosing among GPT-6 family models, setting reasoning effort, and preparing prompts, tools and workflows for production.
Original: The eternal complement
Un essai OpenAI fait valoir que l'IA avancée peut être plus importante en accélérant le travail d'exécution de routine derrière les percées, qui pourraient fixer le rythme du progrès économique.
Original: How Albertsons Companies is reimagining retail from the inside out
L'histoire du client : le détaillant d'épicerie Albertsons Entreprises décrit l'utilisation de ChatGPT Enterprise et de l'API OpenAI pour accélérer le travail interne et faciliter les achats pour les clients.
Original: The Den frees up 10-15 hours a week to grow with ChatGPT Work
L'histoire du client: club social Le Den dit ChatGPT Travail a raccourci les tâches telles que les demandes de subvention de jours en heures, en économisant son équipe 10-15 heures par semaine.
Original: Disrupting a coordinated model-distillation campaign
OpenAI dit qu'il a perturbé une tentative coordonnée d'extraire le raisonnement de modèle protégé par distillation et renforce ses défenses contre de telles attaques.
Original: Helping small businesses put AI to work
OpenAI s'associe avec le SBDC américain pour développer la formation pratique et le soutien local aux petites entreprises, en plus d'un rapport sur la façon dont les petites équipes utilisent l'IA.
Original: AutoSynthData: Generating Training Data for Enterprise Agents
ServiceNow AI décrit AutoSynthData, une méthode pour transformer les faiblesses observées d'un agent d'entreprise en de nombreuses nouvelles tâches de formation vérifiables qui correspondent à l'environnement cible.
Original: Open TTS Leaderboard: Scalable Evaluation for Multilingual Text-to-Speech and Voice Cloning
Hugging Face présente l'Open TTS Leaderboard pour rendre l'évaluation des modèles multilingues de texte à parole et de fermeture vocale plus standardisés que les comparaisons aréna fragmentées d'aujourd'hui.
Original: NVIDIA Kumo Tabular Sets a New Accuracy-Efficiency Frontier for Tabular Prediction
NVIDIA présente Kumo Tabular, un modèle de base tabulaire qui prédit de nouvelles lignes à travers l'apprentissage en contexte au lieu de former un modèle de dégradé séparé pour chaque tâche.
Original: Getting the Source Right, Not Just the Fact: Source-Aware Verification for MCP Agents
Multiverse Computing explique son document ProvenanceGuard, qui vérifie non seulement si la demande d'un agent MCP est vraie, mais s'il est attribué à la bonne source.
Original: Holo4: powering generalist computer-use agents
H Company a publié Holo4, des modèles d'utilisation d'ordinateur d'agents en 27B denses et 35B-A3B de tailles de mélange d'experts sur son API H Models, ainsi qu'une mise à jour Holotron4 Nano.
Original: Hallo, Deutschland!
Mistral AI ouvre un pôle de Munich pour la recherche physique sur l'IA et l'IA industrielle, en collaboration avec des partenaires de l'industrie allemande.
NVIDIA presents a 64GB DGX Spark as a way for developers to build and run increasingly capable open models and AI agents locally.
Original: How NVIDIA GPUs Help Accelerate OpenAI’s GPT-6 Astra Ultrafast
NVIDIA dit que le GPT-6 Astra Ultrafast d'OpenAI fonctionne sur les GPU NVIDIA Blackwell; le modèle est disponible dans l'API OpenAI et pour les utilisateurs de ChatGPT Work et Codex éligibles.
Original: Productive, Durable, Fungible: How NVIDIA AI Factories Maximize Return on Investment
NVIDIA plaide en faveur des rendements des usines d'IA, citant un coût d'environ 60 millions de dollars par mégawatt et faisant valoir que les exploitants ont besoin d'un ROI clair avant de s'engager dans le capital.
Original: NVIDIA Opens Applications for 2027–2028 Graduate Fellowships With Awards Up to $60,000
NVIDIA a ouvert des demandes pour son programme de bourses d'études supérieures de 2027-2028, avec des bourses allant jusqu'à 60 000 $.
NVIDIA and CoreWeave describe their long co-engineering partnership and an AI-focused cloud covering agentic AI from training to production.
Original: Open-sourcing AstaBrief, the fast report-generation model in Asta
Ai2 a publié AstaBrief, un modèle d'open-weights 8B qui écrit des rapports scientifiques cités ; il alimente le mode Fast d'Asta et peut être téléchargé pour fonctionner sur votre propre infrastructure.
Ai2 a introduit Olmo-core 3, une pile d'entraînement entièrement ouverte et repensée pour mettre à l'échelle des modèles de mélange d'experts vers la gamme de trillions de paramètres.
Original: New tool lets users repair AI-generated 3D models, then fabricate them just the way they want
MIT researchers present InstructMesh, a tool that produces easy-to-edit designs of everyday objects so both experts and beginners can repair AI-generated 3D models and fabricate them.
Original: MIT Transit Lab to develop an AI platform for public transit agencies
Le Transit Lab du MIT va construire un centre de renseignements en transit public ouvert, financé avec 2,1 millions de dollars de Google.org, pour unifier la surveillance du transit, les opérations et la communication des cavaliers.
Original: This game-playing AI is the new champ at Stratego
MIT News reports on an AI system that beats top-ranked human Stratego players and is more efficient than other models; the researchers see uses in strategic decision-making.
Original: The effects of an “algorithmic monoculture” depend on the details
Une étude du MIT sur les décisions d'embauche révèle que de nombreuses entreprises s'appuyant sur le même algorithme peuvent, dans certaines situations, bénéficier aux demandeurs d'emploi.
Original: Who we become when we talk to machines
Le nouveau livre du professeur MIT Sherry Turkle, « Intimité artificielle », critique les chatbots et les dynamiques antisociales qu'ils encouragent.
Sujets dont le titre concerne l'IA, classés par points sur les 36 dernières heures.
Original: Clef: Open-weight decision models, and new RL fine-tuning platform
Original: DeepSeek Harness Desktop for macOS and Windows
Original: Meta Uses A.I. Data Centers to Avoid Billions in Federal Taxes
Original: FTC is investigating OpenAI, Anthropic and other AI companies over product risks
Original: GPT-Synopsys: Frontier Intelligence to Revolutionize Chip Design
Original: AI Makes Me Sad
Original: An AI sovereign wealth fund isn't progressive – it's techno-imperialism
Original: Don't be fooled–LLMs don't reason
Sélection automatique des nouvelles soumissions, en privilégiant les articles listés à la fois en cs.AI, cs.CL et cs.LG. Ce n'est pas un classement de qualité.
Original: Comedic Fool's Gold: Reward Exploits and Countermeasures in Conversational Humor
We investigate automated rewards for training language models in conversational humor, focusing on reward exploits and countermeasures.
Original: Robust Is Salient: An Informed Adversary Moves the Optimal Signal onto the Salience Pole
Lorsqu'un adversaire averti partage l'audience d'un canal de signalisation limité, le signal qui protège le mieux la vérité est le signal qui le décrit le mieux.
Les appels d'outils structurés échouent souvent après que seulement un petit nombre de champs violent un schéma ou un contrat d'exécution.
Original: ActiveSaddler: Automated Curriculum Learning for Agent Harness Optimization
L'optimisation automatique des harnais peut améliorer considérablement les agents LLM en mettant à jour de façon itérative leurs invites, interfaces d'outils et logique de contrôle à partir de la rétroaction d'exécution.
Original: Generation Provenance Before Behavior Attribution: Auditing Synthetic Speech Research Objects
Attribuer le comportement du modèle aux données d'entraînement synthétique nécessite de savoir ce qui a produit chaque élément d'entraînement avant d'estimer ce que cet élément a causé.
Original: How Divergence Becomes Decision Flips in Compressed Language Models
Les rapports de compression résument la distance parcourue par un modèle de langage comprimé à partir du modèle dense, habituellement par une divergence KL; un déploiement qui repose sur les sorties du modèle dense doit savoir combien de ses décisions ont changé.
Original: ReHoPER: Receding-Horizon Planning for Enhanced Reasoning
Nous proposons ReHoPER, une méthode à inférence seulement, zéro-shot qui améliore le raisonnement des grands modèles de langage en générant et en répondant à des questions intermédiaires le long de plusieurs chemins avant la réponse finale.
Original: Distilling Directional Verification
Knowledge distillation aims to transfer the factual knowledge of large language models to smaller models for efficient deployment.
Original: Capturing In-Context Learning Dynamics with Task Operators
L'apprentissage en contexte (ICL) permet aux modèles linguistiques d'effectuer de nouvelles tâches à partir de démonstrations sans mise à jour de poids.
Original: Temporally-Resolved Token Attribution Reveals the Generation Dynamics of Diffusion Language Models
This work presents Diffusion Layer Integrated Gradients (DLIG), a token attribution method for diffusion language models (DLMs) that extends Integrated Gradients (IG~\cite{sundararajan2017axiomatic}) to arbitrary layers and denoising steps.
Original: FAER: Auditable Utility-Aligned Trajectory Replay for Language Model Post-Training
Rejouer les sélecteurs classent souvent les trajectoires en cache en fonction de la rétroaction, de la confiance, de la fraîcheur ou de la longueur de la réponse, bien que l'exactitude au niveau du cache et l'utilité de l'apprenant en aval soient des objectifs distincts.
Original: Pre-training interventions, ex post facto: Grafting model beliefs across checkpoints
Pre-training interventions are critical to alignment research, since beliefs formed during pre-training shape how a model generalizes from later training.
Original: CARM: Cancellation-Aware Response Masking for LLM Reinforcement Learning
Ces dernières années, on a assisté à l'adoption rapide du renforcement de l'apprentissage (RL) dans le cadre de la formation post-formation de grands modèles linguistiques (LLM), avec des gains substantiels dans le raisonnement mathématique et la génération de codes.
Original: Finetuning with Sampling: SFT Learns Better Than You Think
L'introduction de nouvelles capacités aux modèles frontières a longtemps été l'objectif de la formation post-formation, qui emploie principalement le réglage fin supervisé (SFT) et le renforcement de l'apprentissage (RL) à cette fin.
Original: FourierQK: Filter Shape, Admissibility and the Leakage-Coverage Law
Frequency-collapse attention [Zeris, 2026e] achieves large gains over standard dot-product attention by replacing the Q/K dot product with a bandpass-filtered inner product at a learned frequency.
Non incluses:
Mis à jour: 2026-10-02 16:45 UTC