ChatPaper.ai
Открыть меню
Главная
Статьи Дня
arXiv
HuggingFace
Цены
Аккаунт
Рабочее пространство
🇷🇺
Русский
Loading...
•
•
•
•
•
•
•
•
•
•
Ежедневные Исследовательские Статьи по ИИ
Ежедневно отобранные исследовательские статьи по ИИ с переводами
December 17th, 2024
SplineGS: Надежный движущийся адаптивный сплайн для динамических трехмерных гауссовских функций в реальном времени из монокулярного видео.
SplineGS: Robust Motion-Adaptive Spline for Real-Time Dynamic 3D Gaussians from Monocular Video
Jongmin Park, Minh-Quan Viet Bui, Juan Luis Gonzalez Bello, Jaeho Moon, Jihyong Oh, Munchurl Kim
•
Dec 13, 2024
•
7
3
Whisper-GPT: Гибридная модель крупного языкового моделирования на основе аудио.
Whisper-GPT: A Hybrid Representation Audio Large Language Model
Prateek Verma
•
Dec 16, 2024
•
4
2
MaxInfoRL: Увеличение исследования в обучении с подкреплением через максимизацию прироста информации
MaxInfoRL: Boosting exploration in reinforcement learning through information gain maximization
Bhavya Sukhija, Stelian Coros, Andreas Krause, Pieter Abbeel, Carmelo Sferrazza
•
Dec 16, 2024
•
5
2
IDArb: Внутреннее разложение для произвольного числа входных видов и иллюминаций
IDArb: Intrinsic Decomposition for Arbitrary Number of Input Views and Illuminations
Zhibing Li, Tong Wu, Jing Tan, Mengchen Zhang, Jiaqi Wang, Dahua Lin
•
Dec 16, 2024
•
12
2
Причинные диффузионные трансформеры для генеративного моделирования
Causal Diffusion Transformers for Generative Modeling
Chaorui Deng, Deyao Zh, Kunchang Li, Shi Guan, Haoqi Fan
•
Dec 16, 2024
•
23
3
Меньшие языковые модели лучше эволюционируют в качестве инструкций.
Smaller Language Models Are Better Instruction Evolvers
Tingfeng Hui, Lulu Zhao, Guanting Dong, Yaqi Zhang, Hua Zhou, Sen Su
•
Dec 15, 2024
•
29
2
SPaR: Самоигра с уточнением поиска по дереву для улучшения Следования инструкциям в больших языковых моделях
SPaR: Self-Play with Tree-Search Refinement to Improve Instruction-Following in Large Language Models
Jiale Cheng, Xiao Liu, Cunxiang Wang, Xiaotao Gu, Yida Lu, Dan Zhang, Yuxiao Dong, Jie Tang, Hongning Wang, Minlie Huang
•
Dec 16, 2024
•
18
2
VividFace: Гибридная структура на основе диффузии для высококачественного видеообмена лицами.
VividFace: A Diffusion-Based Hybrid Framework for High-Fidelity Video Face Swapping
Hao Shao, Shulun Wang, Yang Zhou, Guanglu Song, Dailan He, Shuo Qin, Zhuofan Zong, Bingqi Ma, Yu Liu, Hongsheng Li
•
Dec 15, 2024
•
12
2
Свойство Гаусса: Интеграция физических свойств в трехмерные гауссианы с линейными моделями смеси
GaussianProperty: Integrating Physical Properties to 3D Gaussians with LMMs
Xinli Xu, Wenhang Ge, Dicong Qiu, ZhiFei Chen, Dongyu Yan, Zhuoyun Liu, Haoyu Zhao, Hanfeng Zhao, Shunsi Zhang, Junwei Liang, Ying-Cong Chen
•
Dec 15, 2024
•
13
2
Для защиты данных в вертикальном федеративном обучении достаточно простого преобразования.
Just a Simple Transformation is Enough for Data Protection in Vertical Federated Learning
Andrei Semenov, Philip Zmushko, Alexander Pichugin, Aleksandr Beznosikov
•
Dec 16, 2024
•
2
2
MOVIS: Улучшение синтеза нового вида для нескольких объектов в помещениях
MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes
Ruijie Lu, Yixin Chen, Junfeng Ni, Baoxiong Jia, Yu Liu, Diwen Wan, Gang Zeng, Siyuan Huang
•
Dec 16, 2024
•
6
2
Замечательные матрицы: объединение для более эффективной и эффективной архитектуры базовой модели.
Wonderful Matrices: Combining for a More Efficient and Effective Foundation Model Architecture
Jingze Shi, Bingheng Wu
•
Dec 16, 2024
•
8
2
Агент оценки: эффективная и масштабируемая рамка оценки для визуальных генеративных моделей
Evaluation Agent: Efficient and Promptable Evaluation Framework for Visual Generative Models
Fan Zhang, Shulin Tian, Ziqi Huang, Yu Qiao, Ziwei Liu
•
Dec 10, 2024
•
37
2
DynamicScaler: Бесшовная и масштабируемая генерация видео для панорамных сцен
DynamicScaler: Seamless and Scalable Video Generation for Panoramic Scenes
Jinxiu Liu, Shaoheng Lin, Yinxiao Li, Ming-Hsuan Yang
•
Dec 15, 2024
•
7
2
TidyBot++: Открытый голономный мобильный манипулятор для обучения роботов
TidyBot++: An Open-Source Holonomic Mobile Manipulator for Robot Learning
Jimmy Wu, William Chong, Robert Holmberg, Aaditya Prasad, Yihuai Gao, Oussama Khatib, Shuran Song, Szymon Rusinkiewicz, Jeannette Bohg
•
Dec 11, 2024
•
5
2
RLDG: Дистилляция общего политики робототехнического обобщенного агента с использованием обучения с подкреплением
RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning
Charles Xu, Qiyang Li, Jianlan Luo, Sergey Levine
•
Dec 13, 2024
•
1
2
Надежные, воспроизводимые и действительно быстрые таблицы лидеров с помощью Evalica.
Reliable, Reproducible, and Really Fast Leaderboards with Evalica
Dmitry Ustalov
•
Dec 15, 2024
•
2
2
Эмма-Х: Воплощенная мультимодальная модель действий с обоснованной цепочкой мыслей и пространственным предварительным рассмотрением.
Emma-X: An Embodied Multimodal Action Model with Grounded Chain of Thought and Look-ahead Spatial Reasoning
Qi Sun, Pengfei Hong, Tej Deep Pala, Vernon Toh, U-Xuan Tan, Deepanway Ghosal, Soujanya Poria
•
Dec 16, 2024
•
9
2
StrandHead: Текст к Strand-разделенным 3D аватаркам головы с использованием волос - геометрические априорные данные
StrandHead: Text to Strand-Disentangled 3D Head Avatars Using Hair Geometric Priors
Xiaokun Sun, Zeyu Cai, Zhenyu Zhang, Ying Tai, Jian Yang
•
Dec 16, 2024
•
11
2
Почти бесплатная защита от подражания с помощью персонализированных моделей диффузии
Nearly Zero-Cost Protection Against Mimicry by Personalized Diffusion Models
Namhyuk Ahn, KiYoon Yoo, Wonhyuk Ahn, Daesik Kim, Seung-Hun Nam
•
Dec 16, 2024
•
2
2
Преимущество открытого исходного кода в больших языковых моделях (LLM)
The Open Source Advantage in Large Language Models (LLMs)
Jiya Manchanda, Laura Boettcher, Matheus Westphalen, Jasser Jasser
•
Dec 16, 2024
•
10
2
Удивительная страна: навигация в трехмерных сценах по одному изображению
Wonderland: Navigating 3D Scenes from a Single Image
Hanwen Liang, Junli Cao, Vidit Goel, Guocheng Qian, Sergei Korolev, Demetri Terzopoulos, Konstantinos N. Plataniotis, Sergey Tulyakov, Jian Ren
•
Dec 16, 2024
•
16
2
BrushEdit: Все-в-одном восстановление и редактирование изображений.
BrushEdit: All-In-One Image Inpainting and Editing
Yaowei Li, Yuxuan Bian, Xuan Ju, Zhaoyang Zhang, Ying Shan, Qiang Xu
•
Dec 13, 2024
•
35
3
ColorFlow: Поиск с поддержкой извлечения цвета последовательности изображений
ColorFlow: Retrieval-Augmented Image Sequence Colorization
Junhao Zhuang, Xuan Ju, Zhaoyang Zhang, Yong Liu, Shiyi Zhang, Chun Yuan, Ying Shan
•
Dec 16, 2024
•
26
4
Трансформер с байтовыми латентными представлениями: фрагменты масштабируются лучше, чем токены.
Byte Latent Transformer: Patches Scale Better Than Tokens
Artidoro Pagnoni, Ram Pasunuru, Pedro Rodriguez, John Nguyen, Benjamin Muller, Margaret Li, Chunting Zhou, Lili Yu, Jason Weston, Luke Zettlemoyer, Gargi Ghosh, Mike Lewis, Ari Holtzman, Srinivasan Iyer
•
Dec 13, 2024
•
102
8
GeoX: Геометрическое решение проблем через унифицированное формализованное предварительное обучение на основе зрительного и языкового восприятия.
GeoX: Geometric Problem Solving Through Unified Formalized Vision-Language Pre-training
Renqiu Xia, Mingsheng Li, Hancheng Ye, Wenjie Wu, Hongbin Zhou, Jiakang Yuan, Tianshuo Peng, Xinyu Cai, Xiangchao Yan, Bin Wang, Conghui He, Botian Shi, Tao Chen, Junchi Yan, Bo Zhang
•
Dec 16, 2024
•
4
2
SepLLM: Ускорение больших языковых моделей путем сжатия одного сегмента в один разделитель
SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator
Guoxuan Chen, Han Shi, Jiawei Li, Yihang Gao, Xiaozhe Ren, Yimeng Chen, Xin Jiang, Zhenguo Li, Weiyang Liu, Chao Huang
•
Dec 16, 2024
•
11
5
RetroLLM: Доведение до совершенства больших языковых моделей для извлечения детализированных доказательств в процессе генерации
RetroLLM: Empowering Large Language Models to Retrieve Fine-grained Evidence within Generation
Xiaoxi Li, Jiajie Jin, Yujia Zhou, Yongkang Wu, Zhonghua Li, Qi Ye, Zhicheng Dou
•
Dec 16, 2024
•
37
4