Việc chưng cất bất hợp pháp sản lượng mô hình là mối quan tâm ngày càng lớn đối với các phòng thí nghiệm AI; đây là tài khoản của OpenAI về phát hiện và phá hoại một chiến dịch.
Cloudflare's post on open-weight decision models and an RL fine-tuning platform was the most-upvoted AI story on Hacker News in this edition's 36-hour window.
Hacker News
Ghi chú biên tập: Các bản tóm tắt được soạn nháp với sự hỗ trợ của AI dựa trên văn bản của từng nhà xuất bản và đang chờ con người duyệt lại.
Từ các công ty và phòng nghiên cứu AI
Bài đăng từ blog chính thức của các công ty và phòng nghiên cứu trong 7 ngày qua.
OpenAI xuất bản hướng dẫn cho những người khởi nghiệp về việc lựa chọn trong số các mô hình gia đình GPT-6, thiết lập nỗ lực lý luận, và chuẩn bị dấu nhắc, công cụ và dòng công việc để sản xuất.
An OpenAI essay argues that advanced AI may matter most by speeding up the routine execution work behind breakthroughs, which could set the pace of economic progress.
Bản gốc: How Albertsons Companies is reimagining retail from the inside out
Câu chuyện của khách hàng: nhà bán lẻ Albertsons mô tả bằng cách sử dụng ChatGPT Enterprise và OpenAI API để tăng tốc công việc nội bộ và làm cho việc mua sắm dễ dàng hơn cho khách hàng.
Bản gốc: The Den frees up 10-15 hours a week to grow with ChatGPT Work
Câu chuyện khách hàng: câu lạc bộ xã hội The Den nói Công việc ChatGPT làm giảm các công việc như cung cấp các ứng dụng từ ngày này sang giờ khác, tiết kiệm cho đội của họ 10–15 giờ mỗi tuần.
Bản gốc: Disrupting a coordinated model-distillation campaign
OpenAI nói rằng nó đã phá vỡ một nỗ lực phối hợp để khai thác các mô hình bảo vệ lý luận thông qua việc chưng cất và củng cố sức phòng thủ của nó chống lại những cuộc tấn công như thế.
OpenAI is partnering with America's SBDC to expand hands-on AI training and local support for small businesses, alongside a report on how small teams use AI.
Bản gốc: AutoSynthData: Generating Training Data for Enterprise Agents
ServiceNow AI describes AutoSynthData, a method for turning an enterprise agent's observed weaknesses into many new, verifiable training tasks that fit the target environment.
Tập đoàn Face giới thiệu Ban lãnh đạo mở TTS để đánh giá các mô hình văn bản sang tiếng nói được chuẩn hóa nhiều hơn so với các mảnh vỡ, dựa trên đấu trường ngày nay.
Bản gốc: NVIDIA Kumo Tabular Sets a New Accuracy-Efficiency Frontier for Tabular Prediction
NVIDIA presents Kumo Tabular, a tabular foundation model that predicts new rows through in-context learning instead of training a separate gradient-boosted model for each task.
Bản gốc: Getting the Source Right, Not Just the Fact: Source-Aware Verification for MCP Agents
Multiverse Computing explains its ProvenanceGuard paper, which checks not only whether an MCP agent's claim is true but whether it is attributed to the right source.
Bản gốc: Holo4: powering generalist computer-use agents
Công ty H đã phát hành Holo4, mô hình sử dụng máy tính đặc biệt với 27B dày đặc và 35B-A3B kích thước hỗn hợp-of-eperts trên H Models API, cộng với một bản cập nhật Holotron4 Nano.
NVIDIA giới thiệu một khối núi lửa 64GB DGX như một cách để các nhà phát triển xây dựng và điều hành các mô hình mở mở và các đặc vụ AI tại địa phương.
NVIDIA nói GPT-6 Astra superfast chạy trên NVIDIA BlackPUs; mô hình này có trong OpenAI API và để đủ điều kiện cho công việc ChatGPT và các người dùng Codex.
NVIDIA makes its case for AI-factory returns, citing a cost of roughly $60 million per megawatt and arguing operators need a clear ROI before committing capital.
Bản gốc: Open-sourcing AstaBrief, the fast report-generation model in Asta
Ai2 đã phát hành AstaBrief, một mô hình mở 8B, viết các báo cáo khoa học; nó cung cấp sức mạnh cho chế độ nhanh của Asta và có thể được tải về để chạy trên cơ sở hạ tầng của riêng bạn.
Bản gốc: Introducing Olmo-core 3: Open, scalable training infrastructure for large MoEs
Ai2 giới thiệu Olmo-core 3, một chồng huấn luyện được thiết kế lại và mở rộng hoàn toàn cho việc tăng tỷ lệ các mô hình tổng hợp của các nhà sản xuất lên tới phạm vi nghìn tỷ dặm.
Bản gốc: New tool lets users repair AI-generated 3D models, then fabricate them just the way they want
MIT researchers present InstructMesh, a tool that produces easy-to-edit designs of everyday objects so both experts and beginners can repair AI-generated 3D models and fabricate them.
Bản gốc: MIT Transit Lab to develop an AI platform for public transit agencies
Phòng thí nghiệm Transit của MIT sẽ xây dựng một trung tâm thông tin liên lạc công cộng mở, tài trợ với 2.1 triệu USD từ Google.org, để hợp nhất việc giám sát giao thông, hoạt động và giao tiếp người điều khiển.
Bản gốc: This game-playing AI is the new champ at Stratego
Tạp chí MIT News tường thuật về một hệ thống AI đánh bại người chơi Stratego hàng đầu và hiệu quả hơn các mô hình khác; các nhà nghiên cứu thấy sử dụng trong việc đưa ra quyết định chiến lược.
Cuốn sách mới của giáo sư MIT Sherry Turkle, "Sự đặc biệt về nghệ thuật," phê bình các robot chat và động lực chống xã hội mà bà cho rằng họ khuyến khích.
MIT News – Artificial intelligence · · Tóm tắt
Tin AI nổi bật trên Hacker News
Các bài có tiêu đề liên quan đến AI, xếp theo điểm trong 36 giờ qua.
Chúng tôi nghiên cứu phần thưởng tự động cho việc đào tạo mô hình ngôn ngữ trong hài hước đối thoại, tập trung vào việc khai thác phần thưởng và biện pháp đối phó.
arXiv · · Sam Larson · cs.AI cs.CL cs.LG · Trích từ tóm tắt (arXiv, CC0)
Automated harness optimization can substantially improve LLM agents by iteratively updating their prompts, tool interfaces, and control logic from execution feedback.
arXiv · · Sungho Park, Wonjoong Kim, Jue Zhang +8 · cs.AI cs.CL cs.LG cs.MA · Trích từ tóm tắt (arXiv, CC0)
Bản gốc: Generation Provenance Before Behavior Attribution: Auditing Synthetic Speech Research Objects
Việc phân phối hành vi mô hình cho dữ liệu đào tạo tổng hợp đòi hỏi phải biết điều gì tạo ra mỗi món đồ huấn luyện trước khi đánh giá nguyên nhân gây ra món đồ đó.
Bản gốc: How Divergence Becomes Decision Flips in Compressed Language Models
Các báo cáo về sự nén lại tóm tắt một mô hình ngôn ngữ nén được di chuyển từ lớp dày đặc, thường là bởi sự khác biệt KL; một sự triển khai dựa trên kết quả của mô hình dày đặc cần phải biết bao nhiêu quyết định của nó thay đổi.
We propose ReHoPER, an inference-only, zero-shot method that improves large language models' reasoning by generating and answering intermediate questions along multiple paths before the final answer.
Bản gốc: Temporally-Resolved Token Attribution Reveals the Generation Dynamics of Diffusion Language Models
This work presents Diffusion Layer Integrated Gradients (DLIG), a token attribution method for diffusion language models (DLMs) that extends Integrated Gradients (IG~\cite{sundararajan2017axiomatic}) to arbitrary layers and denoising steps.
Chơi lại những người chọn lọc thường xếp hạng quỹ đạo đã lưu tạm bằng cách phản hồi định dạng, sự tự tin, độ tươi, hay độ dài phản ứng, mặc dù độ chính xác của bộ nhớ tạm và tiện ích của người học xuống dưới là những mục tiêu riêng biệt.
Bản gốc: Pre-training interventions, ex post facto: Grafting model beliefs across checkpoints
Sự can thiệp sơ bộ là rất quan trọng để nghiên cứu thẳng hàng, bởi vì niềm tin được hình thành trong thời gian luyện tập trước như thế nào một mô hình tổng quát từ sau này đào tạo.
Recent years have witnessed the rapid adoption of reinforcement learning (RL) in large language model (LLM) post-training, with substantial gains in mathematical reasoning and code generation.
Bản gốc: Finetuning with Sampling: SFT Learns Better Than You Think
Giới thiệu các khả năng mới để mô hình biên giới đã từ lâu là mục tiêu của sau khi đào tạo, mà chủ yếu sử dụng tinh chỉnh (SFT) và tăng cường việc học (RL) cho đến cuối này.
arXiv · · Aayush Karan, Sitan Chen, Yilun Du · cs.LG cs.AI cs.CL · Trích từ tóm tắt (arXiv, CC0)
Tần số thu hút sự chú ý [Zeris, 2026e] đạt được lợi ích lớn hơn sự chú ý tiêu chuẩn của công việc làm bằng cách thay thế sản phẩm Q/K với một sản phẩm bên trong có băng thông bên trong tại một tần số học tập.