ChatPaper
AI 論文熱榜
近 7 天全球 AI 研究者都在按讚的論文,白話解讀
1
Repo-To-Skill:將 GitHub 儲存庫蒸餾為 AI4AI 技能
🔥 494
2026-09-02
深入閱讀
arXiv 原文
Repo-To-Skill: Distilling GitHub Repositories Into AI4AI Skills
2
StudentSim:訓練基於LLM的學生模擬器
🔥 458
2026-09-01
深入閱讀
arXiv 原文
StudentSim: Training LLM-based Student Simulators
3
Qwen-Drive-1.0:朝向自動駕駛視覺語言基礎模型的初步探索
🔥 337
2026-08-31
深入閱讀
arXiv 原文
Qwen-Drive-1.0: An Initial Step towards a Vision-Language Foundation Model for Autonomous Driving
4
HarnessDev:大型語言模型能否創建並演化自己的智能體框架?
🔥 224
2026-09-01
深入閱讀
arXiv 原文
HarnessDev: Can LLMs Create and Evolve Their Own Agent Harness?
5
Terminal-Universe:將代理軌跡轉化為可擴展的終端環境
🔥 213
2026-09-03
深入閱讀
arXiv 原文
Terminal-Universe: Turning Agent Trajectories into Scalable Terminal Environments
6
LLaDA-Image:以完全開放的訓練配方構建強大圖像生成器
🔥 196
2026-09-03
深入閱讀
arXiv 原文
LLaDA-Image: Building Strong Image Generators with Fully Open Training Recipes
7
Aspire:模型能否從模糊目標中自我進化?
🔥 173
2026-08-31
深入閱讀
arXiv 原文
Aspire: Can Models Self-Evolve from Vague Goals?
8
判斷何時不宜重用:自主大型語言模型後訓練中的條件式經驗遷移
🔥 139
2026-08-27
深入閱讀
arXiv 原文
Knowing When Not to Reuse: Conditional Experience Transfer in Autonomous LLM Post-Training
9
SolarWM:面向長時域視頻世界模型的開放數據與可擴展訓練
🔥 133
2026-09-02
深入閱讀
arXiv 原文
SolarWM: Open Data and Scalable Training for Long-Horizon Video World Models
10
隨機注意力:重新思考KV快取淘汰以實現高效推理
🔥 123
2026-09-03
深入閱讀
arXiv 原文
Random Attention: Rethinking KV Cache Eviction for Efficient Reasoning
11
EarlyEval:透過早期結果預測實現更經濟的代理評測
🔥 110
2026-09-02
深入閱讀
arXiv 原文
EarlyEval: Cheaper Agent Evaluation via Early Outcome Prediction
12
LatentPress:超越文字與視覺的上下文壓縮
🔥 102
2026-09-01
深入閱讀
arXiv 原文
LatentPress: Context Compression Beyond Text and Vision
13
同策略蒸馏真的在蒸馏吗?从噪声教师到自我改进
🔥 98
2026-08-31
深入閱讀
arXiv 原文
Does On-Policy Distillation Really Distill? From Noisy Teacher to Self-Improvement
14
LoopArena:將模型作為迴圈工程的運行時控制器進行基準測試
🔥 98
2026-08-28
深入閱讀
arXiv 原文
LoopArena: Benchmarking Models as Runtime Controllers for Loop Engineering
15
DreamX-Creator:普及2K分辨率的原生音视频生成
🔥 90
2026-08-31
深入閱讀
arXiv 原文
DreamX-Creator: Democratizing Native Audio-Video Generation at 2K Resolution
16
DART-SD:多輪工具調用智能體自蒸餾的鑽石拓撲感知檢索與調優
🔥 88
2026-08-19
深入閱讀
arXiv 原文
DART-SD: Diamond-topology Aware Retrieval and Tuning for Self-Distillation of Multi-Turn Tool-Calling Agents
17
超越資料擴展:以表徵為中心的視覺-語言-動作模型持續預訓練
🔥 84
2026-08-27
深入閱讀
arXiv 原文
Beyond Data Scaling: Representation-Centric Continued Pre-training for Vision-Language-Action Models
18
SMELT:計算匹配MoE循環Transformer的擴展定律
🔥 75
2026-09-01
深入閱讀
arXiv 原文
SMELT: Scaling Laws for Compute-Matched MoE Looped Transformers
19
Lucida:用於可組合真實到模擬場景建模的解析、生成與放置
🔥 72
2026-08-31
深入閱讀
arXiv 原文
Lucida: Parse, Generate, and Place for Composable Real-to-Sim Scene Modeling
20
為何門控DeltaNet能經受4位元量化:混合式270億參數大型語言模型中遞迴部分的NVFP4 W4A4
🔥 66
2026-09-03
深入閱讀
arXiv 原文
Why Gated DeltaNet Survives 4-Bit Quantization: NVFP4 W4A4 for the Recurrent Half of a Hybrid 27B LLM
每天 5 分鐘,跟上 AI 前沿
每日精選 5 篇熱門論文,講成白話,配一道小謎題。
去看今日刊 →