{"slug": "top-ai-papers-on-hugging-face-2026-07-25", "title": "Top AI Papers on Hugging Face - 2026-07-25", "summary": "A developer compiled the top 10 most upvoted papers on Hugging Face, covering deep research agents, post-training large models on Ascend SuperPOD, embodied visual tracking, K-12 knowledge graphs, self-distillation for vision, diffusion language models, spatial cognition evaluation, long video generation, retrieval beyond relevance, and a benchmark for active observation agents. Notable papers include AREX, which introduces recursively self-improving agents, and a study on full-parameter post-training of DeepSeek-V4 on Ascend hardware.", "body_md": "Hôm nay mình tổng hợp 10 paper đang được upvote cao nhất trên Hugging Face. Danh sách này khá thú vị vì trải rộng nhiều hướng rất “nóng”: deep research agent, hậu huấn luyện mô hình lớn, embodied visual tracking, knowledge graph cho giáo dục, self-distillation cho vision, diffusion language model, đánh giá spatial cognition, sinh video dài, retrieval vượt khỏi “relevance”, và benchmark cho tác tử quan sát chủ động.\n\nBài viết này không đi quá sâu vào chi tiết toán học, mà tập trung trả lời 4 câu hỏi cho mỗi paper:\n\n`2607.21461`\n\nCác “deep research agent” hiện nay có thể tìm kiếm, đọc tài liệu, tóm tắt và lập báo cáo, nhưng vẫn có một giới hạn lớn: **chúng chưa thực sự tự cải tiến theo vòng lặp**. Phần lớn agent chỉ chạy theo pipeline cố định hoặc được tối ưu thủ công.\n\nAREX hướng đến một agent có khả năng **đệ quy tự cải tiến**. Nghĩa là agent không chỉ làm nghiên cứu, mà còn biết **đánh giá kết quả của chính mình, tìm điểm yếu, sửa chiến lược, rồi chạy vòng tiếp theo**.\n\nTa có thể hình dung AREX như một “nhà nghiên cứu AI” gồm nhiều vòng:\n\nĐiểm mới quan trọng nằm ở từ khóa **recursively self-improving**. Nhiều hệ agent hiện tại có “reflection”, nhưng reflection thường chỉ là một bước phụ. AREX có vẻ đẩy ý tưởng này thành **trung tâm kiến trúc**, biến cải tiến lặp thành cơ chế vận hành chính.\n\nNếu làm tốt, đây là bước tiến từ “agent biết dùng công cụ” sang “agent biết cải thiện cách dùng công cụ”.\n\nĐây là một hướng cực kỳ thực dụng, đặc biệt khi nhu cầu “AI analyst” ngày càng lớn.\n\n`2607.20145`\n\nHuấn luyện và hậu huấn luyện các mô hình cực lớn thường phụ thuộc mạnh vào hệ sinh thái GPU phổ biến. Câu hỏi là: **liệu có thể thực hiện full-parameter post-training quy mô lớn trên hạ tầng khác, cụ thể là Ascend SuperPOD, một cách ổn định và hiệu quả không?**\n\nPaper này tập trung vào **hạ tầng và quy trình hậu huấn luyện toàn bộ tham số** cho họ mô hình DeepSeek-V4 trên Ascend. Đây không chỉ là câu chuyện “port code”, mà còn liên quan đến:\n\nĐiểm mới nằm ở giá trị **systems engineering** nhiều hơn là thuật toán thuần túy. Trong bối cảnh AI ngày càng phụ thuộc vào compute stack, các kết quả chứng minh khả năng hậu huấn luyện mô hình lớn trên nền tảng thay thế có ý nghĩa chiến lược rất lớn.\n\nNó cho thấy hệ sinh thái LLM đang dần **đa dạng hóa phần cứng**, giảm phụ thuộc vào một stack duy nhất.\n\nĐây là paper đáng chú ý nếu bạn quan tâm tới AI infrastructure hơn là chỉ benchmark mô hình.\n\n`2607.20061`\n\nTrong môi trường embodied AI, robot không chỉ cần “track một vật thể”, mà còn phải hiểu những chỉ dẫn kiểu: **“hãy theo dõi chiếc cốc màu đỏ trên bàn”**. Đây là bài toán kết hợp giữa **ngôn ngữ tham chiếu** và **theo dõi thị giác**.\n\nReferTrack đề xuất quy trình hai bước:\n\nCách tách này rất hợp lý vì nó phản ánh cách con người làm: đầu tiên hiểu “đối tượng nào”, sau đó mới “bám theo nó”.\n\nĐiểm mới là gắn chặt bài toán referring expression với embodied tracking, thay vì coi tracking là tác vụ đơn lẻ trên video tĩnh. Điều này giúp mô hình gần hơn với bối cảnh robot thực tế, nơi góc nhìn thay đổi liên tục do agent di chuyển.\n\nPaper này rất đáng chú ý vì nó nằm ở giao điểm giữa vision-language và robotics.\n\n`2605.09635`\n\nLLM cho giáo dục thường thiếu một cấu trúc tri thức rõ ràng gắn với **chương trình học K-12**. Nếu không có curriculum-aligned knowledge, mô hình có thể trả lời đúng ngẫu nhiên nhưng lại thiếu khả năng dạy học theo tiến trình.\n\nK12-KGraph xây dựng một **knowledge graph bám sát chương trình K-12**", "url": "https://wpnews.pro/news/top-ai-papers-on-hugging-face-2026-07-25", "canonical_source": "https://dev.to/y_hnhnhan_2f26de65ffcc4/top-ai-papers-on-hugging-face-2026-07-25-5hff", "published_at": "2026-07-25 12:01:34+00:00", "updated_at": "2026-07-25 12:33:23.883450+00:00", "lang": "en", "topics": ["artificial-intelligence", "machine-learning", "large-language-models", "robotics", "computer-vision"], "entities": ["Hugging Face", "AREX", "DeepSeek-V4", "Ascend SuperPOD", "ReferTrack", "K12-KGraph"], "alternates": {"html": "https://wpnews.pro/news/top-ai-papers-on-hugging-face-2026-07-25", "markdown": "https://wpnews.pro/news/top-ai-papers-on-hugging-face-2026-07-25.md", "text": "https://wpnews.pro/news/top-ai-papers-on-hugging-face-2026-07-25.txt", "jsonld": "https://wpnews.pro/news/top-ai-papers-on-hugging-face-2026-07-25.jsonld"}}