ChatPaper.ai
Abrir Menu
Início
Artigos do Dia
arXiv
HuggingFace
Preços
Conta
Área de trabalho
🇬🇧
English
Loading...
•
•
•
•
•
•
•
•
•
•
Artigos de Pesquisa em IA Diários
Artigos de pesquisa em IA selecionados diariamente com traduções
April 4th, 2025
Segmentação Panóptica Não Supervisionada Centrada em Cenas
Scene-Centric Unsupervised Panoptic Segmentation
Oliver Hahn, Christoph Reich, Nikita Araslanov, Daniel Cremers, Christian Rupprecht, Stefan Roth
•
Apr 2, 2025
•
5
3
JavisDiT: Transformador de Difusão Conjunta Áudio-Vídeo com Sincronização Hierárquica de Prioridades Espaço-Temporais
JavisDiT: Joint Audio-Video Diffusion Transformer with Hierarchical Spatio-Temporal Prior Synchronization
Kai Liu, Wei Li, Lai Chen, Shengqiong Wu, Yanhao Zheng, Jiayi Ji, Fan Zhou, Rongxin Jiang, Jiebo Luo, Hao Fei, Tat-Seng Chua
•
Mar 30, 2025
•
54
4
SkyReels-A2: Compor Qualquer Coisa em Transformadores de Difusão de Vídeo
SkyReels-A2: Compose Anything in Video Diffusion Transformers
Zhengcong Fei, Debang Li, Di Qiu, Jiahua Wang, Yikun Dou, Rui Wang, Jingtao Xu, Mingyuan Fan, Guibin Chen, Yang Li, Yahui Zhou
•
Apr 3, 2025
•
36
3
Whisper-LM: Aprimorando Modelos de ASR com Modelos de Linguagem para Idiomas de Baixos Recursos
Whisper-LM: Improving ASR Models with Language Models for Low-Resource Languages
Xabier de Zuazo, Eva Navas, Ibon Saratxaga, Inma Hernáez Rioja
•
Mar 30, 2025
•
10
3
Avanços e Desafios em Agentes Fundamentais: Da Inteligência Inspirada no Cérebro a Sistemas Evolutivos, Colaborativos e Seguros
Advances and Challenges in Foundation Agents: From Brain-Inspired Intelligence to Evolutionary, Collaborative, and Safe Systems
Bang Liu, Xinfeng Li, Jiayi Zhang, Jinlin Wang, Tanjin He, Sirui Hong, Hongzhang Liu, Shaokun Zhang, Kaitao Song, Kunlun Zhu, Yuheng Cheng, Suyuchen Wang, Xiaoqiang Wang, Yuyu Luo, Haibo Jin, Peiyan Zhang, Ollie Liu, Jiaqi Chen, Huan Zhang, Zhaoyang Yu, Haochen Shi, Boyan Li, Dekun Wu, Fengwei Teng, Xiaojun Jia, Jiawei Xu, Jinyu Xiang, Yizhang Lin, Tianming Liu, Tongliang Liu, Yu Su, Huan Sun, Glen Berseth, Jianyun Nie, Ian Foster, Logan Ward, Qingyun Wu, Yu Gu, Mingchen Zhuge, Xiangru Tang, Haohan Wang, Jiaxuan You, Chi Wang, Jian Pei, Qiang Yang, Xiaoliang Qi, Chenglin Wu
•
Mar 31, 2025
•
270
7
OpenCodeReasoning: Avançando na Destilação de Dados para Programação Competitiva
OpenCodeReasoning: Advancing Data Distillation for Competitive Coding
Wasi Uddin Ahmad, Sean Narenthiran, Somshubra Majumdar, Aleksander Ficek, Siddhartha Jain, Jocelyn Huang, Vahid Noroozi, Boris Ginsburg
•
Apr 2, 2025
•
15
3
Difusão de Vídeo Controlada por Áudio-Visual com Modelagem de Espaços de Estado Seletivos Mascarados para Geração Natural de Cabeças Falantes
Audio-visual Controlled Video Diffusion with Masked Selective State Spaces Modeling for Natural Talking Head Generation
Fa-Ting Hong, Zunnan Xu, Zixiang Zhou, Jun Zhou, Xiu Li, Qin Lin, Qinglin Lu, Dan Xu
•
Apr 3, 2025
•
44
7
Interpretando o Planejamento Emergente no Aprendizado por Reforço Livre de Modelos
Interpreting Emergent Planning in Model-Free Reinforcement Learning
Thomas Bush, Stephen Chung, Usman Anwar, Adrià Garriga-Alonso, David Krueger
•
Apr 2, 2025
•
12
2
NeuralGS: Conectando Campos Neurais e Splatting Gaussiano 3D para Representações Compactas em 3D
NeuralGS: Bridging Neural Fields and 3D Gaussian Splatting for Compact 3D Representations
Zhenyu Tang, Chaoran Feng, Xinhua Cheng, Wangbo Yu, Junwu Zhang, Yuan Liu, Xiaoxiao Long, Wenping Wang, Li Yuan
•
Mar 29, 2025
•
11
2
WikiVideo: Geração de Artigos a Partir de Múltiplos Vídeos
WikiVideo: Article Generation from Multiple Videos
Alexander Martin, Reno Kriz, William Gantt Walden, Kate Sanders, Hannah Recknor, Eugene Yang, Francis Ferraro, Benjamin Van Durme
•
Apr 1, 2025
•
36
3
Geração de Parâmetros de Rede Neural Autoregressiva Orientada por Instruções
Instruction-Guided Autoregressive Neural Network Parameter Generation
Soro Bedionita, Bruno Andreis, Song Chong, Sung Ju Hwang
•
Apr 2, 2025
•
6
2
Repensando a Escalabilidade de RL para Modelos de Visão e Linguagem: Um Framework Transparente e do Zero com um Esquema de Avaliação Abrangente
Rethinking RL Scaling for Vision Language Models: A Transparent, From-Scratch Framework and Comprehensive Evaluation Scheme
Yan Ma, Steffi Chern, Xuyang Shen, Yiran Zhong, Pengfei Liu
•
Apr 3, 2025
•
30
3
Análise de Escalabilidade de Modelos de Linguagem com Intercalação de Fala e Texto
Scaling Analysis of Interleaved Speech-Text Language Models
Gallil Maimon, Michael Hassid, Amit Roth, Yossi Adi
•
Apr 3, 2025
•
28
2
Seleção Eficiente de Modelos para Previsão de Séries Temporais via LLMs
Efficient Model Selection for Time Series Forecasting via LLMs
Wang Wei, Tiankai Yang, Hongjie Chen, Ryan A. Rossi, Yue Zhao, Franck Dernoncourt, Hoda Eldardiry
•
Apr 2, 2025
•
16
2
ZClip: Mitigação Adaptativa de Picos para Pré-Treinamento de LLMs
ZClip: Adaptive Spike Mitigation for LLM Pre-Training
Abhay Kumar, Louis Owen, Nilabhra Roy Chowdhury, Fabian Güra
•
Apr 3, 2025
•
77
2
Leis de Escalonamento na Descoberta Científica com IA e Cientistas Robôs
Scaling Laws in Scientific Discovery with AI and Robot Scientists
Pengsong Zhang, Heng Zhang, Huazhe Xu, Renjun Xu, Zhenting Wang, Cong Wang, Animesh Garg, Zhibin Li, Arash Ajoudani, Xinyu Liu
•
Mar 28, 2025
•
12
2
Visão Além dos Pixels: Avaliação de Edição Visual Informada por Raciocínio
Envisioning Beyond the Pixels: Benchmarking Reasoning-Informed Visual Editing
Xiangyu Zhao, Peiyuan Zhang, Kexian Tang, Hao Li, Zicheng Zhang, Guangtao Zhai, Junchi Yan, Hua Yang, Xue Yang, Haodong Duan
•
Apr 3, 2025
•
67
2
Autoencoders Esparsos Aprendem Características Monossemânticas em Modelos de Visão e Linguagem
Sparse Autoencoders Learn Monosemantic Features in Vision-Language Models
Mateusz Pach, Shyamgopal Karthik, Quentin Bouniot, Serge Belongie, Zeynep Akata
•
Apr 3, 2025
•
10
2
GPT-ImgEval: Um Benchmark Abrangente para Diagnóstico do GPT4o na Geração de Imagens
GPT-ImgEval: A Comprehensive Benchmark for Diagnosing GPT4o in Image Generation
Zhiyuan Yan, Junyan Ye, Weijia Li, Zilong Huang, Shenghai Yuan, Xiangyang He, Kaiqing Lin, Jun He, Conghui He, Li Yuan
•
Apr 3, 2025
•
56
3
Escalonamento em Tempo de Inferência para Modelagem de Recompensas Generalistas
Inference-Time Scaling for Generalist Reward Modeling
Zijun Liu, Peiyi Wang, Runxin Xu, Shirong Ma, Chong Ruan, Peng Li, Yang Liu, Yu Wu
•
Apr 3, 2025
•
54
6
GenPRM: Escalonando o Cálculo em Tempo de Teste de Modelos de Recompensa de Processo por meio de Raciocínio Generativo
GenPRM: Scaling Test-Time Compute of Process Reward Models via Generative Reasoning
Jian Zhao, Runze Liu, Kaiyan Zhang, Zhimu Zhou, Junqi Gao, Dong Li, Jiafei Lyu, Zhouyi Qian, Biqing Qi, Xiu Li, Bowen Zhou
•
Apr 1, 2025
•
12
3
ShortV: Modelos Multimodais de Grande Escala Eficientes através do Congelamento de Tokens Visuais em Camadas Ineficazes
ShortV: Efficient Multimodal Large Language Models by Freezing Visual Tokens in Ineffective Layers
Qianhao Yuan, Qingyu Zhang, Yanjiang Liu, Jiawei Chen, Yaojie Lu, Hongyu Lin, Jia Zheng, Xianpei Han, Le Sun
•
Apr 1, 2025
•
21
2
FreSca: Revelando o Espaço de Escalonamento em Modelos de Difusão
FreSca: Unveiling the Scaling Space in Diffusion Models
Chao Huang, Susan Liang, Yunlong Tang, Li Ma, Yapeng Tian, Chenliang Xu
•
Apr 2, 2025
•
19
2