AI Daily Roundup
Ngôn ngữ: Tiếng Việt ▾

Tin AI — 2026-10-03

Tin AI hằng ngày từ nguồn chính thức, Hacker News và arXiv

Tiêu đề và tóm tắt trên trang này được dịch máy từ tiếng Anh (ngoại tuyến) và có thể có lỗi. Bản gốc được liên kết là chuẩn.

Biên tập viên chọn

Phá vỡ một chiến dịch phối hợp mô hình phân giải

Việc chưng cất bất hợp pháp sản lượng mô hình là mối quan tâm ngày càng lớn đối với các phòng thí nghiệm AI; đây là tài khoản của OpenAI về phát hiện và phá hoại một chiến dịch.

OpenAI

AstaBrief, mô hình báo cáo nhanh ở Asta

Một mô hình 8B mở hạng đặc biệt cho các báo cáo khoa học được viện dẫn rằng các đội có thể chạy trên cơ sở hạ tầng riêng của họ.

Ai2 (Allen Institute for AI)

Clef: Open-weight decision models, and new RL fine-tuning platform

Cloudflare's post on open-weight decision models and an RL fine-tuning platform was the most-upvoted AI story on Hacker News in this edition's 36-hour window.

Hacker News

Ghi chú biên tập: Các bản tóm tắt được soạn nháp với sự hỗ trợ của AI dựa trên văn bản của từng nhà xuất bản và đang chờ con người duyệt lại.

Từ các công ty và phòng nghiên cứu AI

Bài đăng từ blog chính thức của các công ty và phòng nghiên cứu trong 7 ngày qua.

OpenAI

Một hướng dẫn viên mẫu cho gia đình GPT-6

Bản gốc: A model guide for the GPT-6 family

OpenAI xuất bản hướng dẫn cho những người khởi nghiệp về việc lựa chọn trong số các mô hình gia đình GPT-6, thiết lập nỗ lực lý luận, và chuẩn bị dấu nhắc, công cụ và dòng công việc để sản xuất.

OpenAI · · Tóm tắt

Phần bổ sung đời đời

Bản gốc: The eternal complement

An OpenAI essay argues that advanced AI may matter most by speeding up the routine execution work behind breakthroughs, which could set the pace of economic progress.

OpenAI · · Tóm tắt

Phá vỡ một chiến dịch phối hợp mô hình phân giải

Bản gốc: Disrupting a coordinated model-distillation campaign

OpenAI nói rằng nó đã phá vỡ một nỗ lực phối hợp để khai thác các mô hình bảo vệ lý luận thông qua việc chưng cất và củng cố sức phòng thủ của nó chống lại những cuộc tấn công như thế.

OpenAI · · Tóm tắt

Giúp đỡ các doanh nghiệp nhỏ giúp AI làm việc

Bản gốc: Helping small businesses put AI to work

OpenAI is partnering with America's SBDC to expand hands-on AI training and local support for small businesses, alongside a report on how small teams use AI.

OpenAI · · Tóm tắt

Hugging Face

Mistral AI

Hallo, Deutschland!

Mistral Al đang mở một trung tâm nghiên cứu vật lý của Munich và công nghệ AI, làm việc với các đối tác từ ngành công nghiệp Đức.

Mistral AI · · Tóm tắt

NVIDIA Blog

Ai2 (Allen Institute for AI)

AstaBrief, mô hình báo cáo nhanh ở Asta

Bản gốc: Open-sourcing AstaBrief, the fast report-generation model in Asta

Ai2 đã phát hành AstaBrief, một mô hình mở 8B, viết các báo cáo khoa học; nó cung cấp sức mạnh cho chế độ nhanh của Asta và có thể được tải về để chạy trên cơ sở hạ tầng của riêng bạn.

Ai2 (Allen Institute for AI) · · Cũng có trên Hugging Face · Tóm tắt

MIT News – Artificial intelligence

Phòng thí nghiệm giao thông MIT để phát triển một nền tảng AI cho các cơ quan giao thông công cộng

Bản gốc: MIT Transit Lab to develop an AI platform for public transit agencies

Phòng thí nghiệm Transit của MIT sẽ xây dựng một trung tâm thông tin liên lạc công cộng mở, tài trợ với 2.1 triệu USD từ Google.org, để hợp nhất việc giám sát giao thông, hoạt động và giao tiếp người điều khiển.

MIT News – Artificial intelligence · · Tóm tắt

AI chơi game là nhà vô địch mới ở Stratego

Bản gốc: This game-playing AI is the new champ at Stratego

Tạp chí MIT News tường thuật về một hệ thống AI đánh bại người chơi Stratego hàng đầu và hiệu quả hơn các mô hình khác; các nhà nghiên cứu thấy sử dụng trong việc đưa ra quyết định chiến lược.

MIT News – Artificial intelligence · · Tóm tắt

Chúng ta trở thành ai khi nói chuyện với máy móc

Bản gốc: Who we become when we talk to machines

Cuốn sách mới của giáo sư MIT Sherry Turkle, "Sự đặc biệt về nghệ thuật," phê bình các robot chat và động lực chống xã hội mà bà cho rằng họ khuyến khích.

MIT News – Artificial intelligence · · Tóm tắt

Tin AI nổi bật trên Hacker News

Các bài có tiêu đề liên quan đến AI, xếp theo điểm trong 36 giờ qua.

Bài báo mới trên arXiv

Tự động chọn bài mới gửi, ưu tiên bài được đăng chéo ở cs.AI, cs.CL và cs.LG. Không phải xếp hạng chất lượng.

arXiv cs.AI

Robust là Salient: Một kẻ thù được thông báo dịch chuyển tín hiệu tối tân lên Cực Salience

Bản gốc: Robust Is Salient: An Informed Adversary Moves the Optimal Signal onto the Salience Pole

Khi một kẻ thù có hiểu biết chia sẻ với khán giả của một kênh tín hiệu bị ràng buộc, tín hiệu tốt nhất để bảo vệ sự thật là tín hiệu miêu tả tốt nhất.

arXiv · · Cris Huynh · cs.AI cs.CL cs.GT cs.LG · Trích từ tóm tắt (arXiv, CC0)

Thế hệ chứng minh trước sự phân phối hành vi: Phát âm các đối tượng nghiên cứu tiếng nói tổng hợp

Bản gốc: Generation Provenance Before Behavior Attribution: Auditing Synthetic Speech Research Objects

Việc phân phối hành vi mô hình cho dữ liệu đào tạo tổng hợp đòi hỏi phải biết điều gì tạo ra mỗi món đồ huấn luyện trước khi đánh giá nguyên nhân gây ra món đồ đó.

arXiv · · Sidi Chang, Peiying Zhu · cs.AI cs.CL cs.LG · Trích từ tóm tắt (arXiv, CC0)

arXiv cs.CL

Làm thế nào sự khác biệt trở thành quyết định lật ngược trong mô hình ngôn ngữ nén

Bản gốc: How Divergence Becomes Decision Flips in Compressed Language Models

Các báo cáo về sự nén lại tóm tắt một mô hình ngôn ngữ nén được di chuyển từ lớp dày đặc, thường là bởi sự khác biệt KL; một sự triển khai dựa trên kết quả của mô hình dày đặc cần phải biết bao nhiêu quyết định của nó thay đổi.

arXiv · · Beatriz Almeida Felicio · cs.CL cs.AI cs.LG stat.ML · Trích từ tóm tắt (arXiv, CC0)

ReHoPER: Receding-Horizon Planning for Enhanced Reasoning

We propose ReHoPER, an inference-only, zero-shot method that improves large language models' reasoning by generating and answering intermediate questions along multiple paths before the final answer.

arXiv · · Saeed Ahmadnia, Cornelia Caragea · cs.CL cs.AI cs.LG · Trích từ tóm tắt (arXiv, CC0)

Distilling Directional Verification

Kiến thức được chưng cất nhằm chuyển sự hiểu biết thực tế của các mô hình ngôn ngữ lớn thành các mô hình nhỏ hơn để triển khai hiệu quả.

arXiv · · Jungseob Lee, Sugyeong Eo, Seongtae Hong +4 · cs.CL cs.AI cs.LG · Trích từ tóm tắt (arXiv, CC0)

Cấu hình khả năng học động động với bộ điều khiển tác vụ

Bản gốc: Capturing In-Context Learning Dynamics with Task Operators

Học ngữ cảnh (ICL) cho phép mô hình ngôn ngữ thực hiện các công việc mới từ các cuộc biểu tình mà không cần cập nhật trọng lượng.

arXiv · · Guangzhi Xiong, Zhenghao He, Bohan Liu +3 · cs.CL cs.AI cs.LG · Trích từ tóm tắt (arXiv, CC0)

Sự phân phối tạm thời tiết lộ thế hệ của các mô hình ngôn ngữ khác nhau

Bản gốc: Temporally-Resolved Token Attribution Reveals the Generation Dynamics of Diffusion Language Models

This work presents Diffusion Layer Integrated Gradients (DLIG), a token attribution method for diffusion language models (DLMs) that extends Integrated Gradients (IG~\cite{sundararajan2017axiomatic}) to arbitrary layers and denoising steps.

arXiv · · Darpan Aswal, C\'eline Hudelot · cs.CL cs.AI cs.LG · Trích từ tóm tắt (arXiv, CC0)

arXiv cs.LG

FAER: Auditable Utility-Aligned Trajectory Replay for Language Model Post-Training

Chơi lại những người chọn lọc thường xếp hạng quỹ đạo đã lưu tạm bằng cách phản hồi định dạng, sự tự tin, độ tươi, hay độ dài phản ứng, mặc dù độ chính xác của bộ nhớ tạm và tiện ích của người học xuống dưới là những mục tiêu riêng biệt.

arXiv · · Miaobo Hu, Shuhao Hu, Xiaobo Guo +5 · cs.LG cs.AI cs.CL stat.ML · Trích từ tóm tắt (arXiv, CC0)

Sự can thiệp trước khi huấn luyện, thực tế trước: niềm tin mô hình dựa trên các điểm kiểm soát

Bản gốc: Pre-training interventions, ex post facto: Grafting model beliefs across checkpoints

Sự can thiệp sơ bộ là rất quan trọng để nghiên cứu thẳng hàng, bởi vì niềm tin được hình thành trong thời gian luyện tập trước như thế nào một mô hình tổng quát từ sau này đào tạo.

arXiv · · Peter Nutter, Dani Roytburg, Cl\'ement Dumas +2 · cs.LG cs.AI cs.CL · Trích từ tóm tắt (arXiv, CC0)

CARM: Cancellation-Aware Response Masking for LLM Reinforcement Learning

Recent years have witnessed the rapid adoption of reinforcement learning (RL) in large language model (LLM) post-training, with substantial gains in mathematical reasoning and code generation.

arXiv · · Yafei Zhang, Songshuo Lu, Sicong Liao +2 · cs.LG cs.AI cs.CL · Trích từ tóm tắt (arXiv, CC0)

Làm vừa lòng với Sampling: SFT học tốt hơn bạn nghĩ

Bản gốc: Finetuning with Sampling: SFT Learns Better Than You Think

Giới thiệu các khả năng mới để mô hình biên giới đã từ lâu là mục tiêu của sau khi đào tạo, mà chủ yếu sử dụng tinh chỉnh (SFT) và tăng cường việc học (RL) cho đến cuối này.

arXiv · · Aayush Karan, Sitan Chen, Yilun Du · cs.LG cs.AI cs.CL · Trích từ tóm tắt (arXiv, CC0)

FourierQK: Filter Shape, Admissibility and the Leakage-Coverage Law

Tần số thu hút sự chú ý [Zeris, 2026e] đạt được lợi ích lớn hơn sự chú ý tiêu chuẩn của công việc làm bằng cách thay thế sản phẩm Q/K với một sản phẩm bên trong có băng thông bên trong tại một tần số học tập.

arXiv · · Athanasios Zeris · cs.LG cs.CL eess.SP · Trích từ tóm tắt (arXiv, CC0)

Các nguồn đã kiểm tra cho số này

Không đưa vào:

Cập nhật: 2026-10-02 16:45 UTC