ChatPaper.ai
Abrir Menu
Início
Artigos do Dia
arXiv
HuggingFace
Preços
Conta
Área de trabalho
🇬🇧
English
Loading...
•
•
•
•
•
•
•
•
•
•
Artigos de Pesquisa em IA Diários
Artigos de pesquisa em IA selecionados diariamente com traduções
April 23rd, 2025
Kuwain 1.5B: Um Modelo de Linguagem Simples em Árabe via Injeção de Linguagem
Kuwain 1.5B: An Arabic SLM via Language Injection
Khalil Hennara, Sara Chrouf, Mohamed Motaism Hamed, Zeina Aldallal, Omar Hadid, Safwan AlModhayan
•
Apr 21, 2025
•
113
7
TTRL: Aprendizado por Reforço em Tempo de Teste
TTRL: Test-Time Reinforcement Learning
Yuxin Zuo, Kaiyan Zhang, Shang Qu, Li Sheng, Xuekai Zhu, Biqing Qi, Youbang Sun, Ganqu Cui, Ning Ding, Bowen Zhou
•
Apr 22, 2025
•
95
4
A Lição Amarga Aprendida com Mais de 2.000 Benchmarks Multilíngues
The Bitter Lesson Learned from 2,000+ Multilingual Benchmarks
Minghao Wu, Weixuan Wang, Sinuo Liu, Huifeng Yin, Xintong Wang, Yu Zhao, Chenyang Lyu, Longyue Wang, Weihua Luo, Kaifu Zhang
•
Apr 22, 2025
•
61
2
Descreva Qualquer Coisa: Legendagem Detalhada e Localizada de Imagens e Vídeos
Describe Anything: Detailed Localized Image and Video Captioning
Long Lian, Yifan Ding, Yunhao Ge, Sifei Liu, Hanzi Mao, Boyi Li, Marco Pavone, Ming-Yu Liu, Trevor Darrell, Adam Yala, Yin Cui
•
Apr 22, 2025
•
58
4
Aprendizado de Raciocínio Paralelo Adaptativo com Modelos de Linguagem
Learning Adaptive Parallel Reasoning with Language Models
Jiayi Pan, Xiuyu Li, Long Lian, Charlie Snell, Yifei Zhou, Adam Yala, Trevor Darrell, Kurt Keutzer, Alane Suhr
•
Apr 21, 2025
•
42
2
LiveCC: Aprendizado de Modelos de Linguagem de Vídeo em Grande Escala com Transcrição de Fala em Tempo Real
LiveCC: Learning Video LLM with Streaming Speech Transcription at Scale
Joya Chen, Ziyun Zeng, Yiqi Lin, Wei Li, Zejun Ma, Mike Zheng Shou
•
Apr 22, 2025
•
32
2
BookWorld: De Romances para Sociedades de Agentes Interativos para Geração Criativa de Histórias
BookWorld: From Novels to Interactive Agent Societies for Creative Story Generation
Yiting Ran, Xintao Wang, Tian Qiu, Jiaqing Liang, Yanghua Xiao, Deqing Yang
•
Apr 20, 2025
•
26
2
IV-Bench: Um Benchmark para Percepção e Raciocínio em Vídeos Baseados em Imagens em LLMs Multimodais
IV-Bench: A Benchmark for Image-Grounded Video Perception and Reasoning in Multimodal LLMs
David Ma, Yuanxing Zhang, Jincheng Ren, Jarvis Guo, Yifan Yao, Zhenlin Wei, Zhenzhu Yang, Zhongyuan Peng, Boyu Feng, Jun Ma, Xiao Gu, Zhoufutu Wen, King Zhu, Yancheng He, Meng Cao, Shiwen Ni, Jiaheng Liu, Wenhao Huang, Ge Zhang, Xiaojie Jin
•
Apr 21, 2025
•
22
2
LLMs são Agentes Gananciosos: Efeitos do Ajuste Fino com RL nas Habilidades de Tomada de Decisão
LLMs are Greedy Agents: Effects of RL Fine-tuning on Decision-Making Abilities
Thomas Schmied, Jörg Bornschein, Jordi Grau-Moya, Markus Wulfmeier, Razvan Pascanu
•
Apr 22, 2025
•
20
3
Escalonamento Eficiente do Comprimento de Pré-treinamento
Efficient Pretraining Length Scaling
Bohong Wu, Shen Yan, Sijun Zhang, Jianqiao Lu, Yutao Zeng, Ya Wang, Xun Zhou
•
Apr 21, 2025
•
19
2
WALL-E 2.0: Alinhamento Mundial por Aprendizado NeuroSimbólico Aprimora Agentes de LLM Baseados em Modelos Mundiais
WALL-E 2.0: World Alignment by NeuroSymbolic Learning improves World Model-based LLM Agents
Siyu Zhou, Tianyi Zhou, Yijun Yang, Guodong Long, Deheng Ye, Jing Jiang, Chengqi Zhang
•
Apr 22, 2025
•
18
4
Geração Personalizada de Texto para Imagem com Modelos Auto-Regressivos
Personalized Text-to-Image Generation with Auto-Regressive Models
Kaiyue Sun, Xian Liu, Yao Teng, Xihui Liu
•
Apr 17, 2025
•
18
3
CheXWorld: Explorando a Modelagem de Mundos de Imagens para a Representação de Radiografias
CheXWorld: Exploring Image World Modeling for Radiograph Representation Learning
Yang Yue, Yulin Wang, Chenxin Tao, Pan Liu, Shiji Song, Gao Huang
•
Apr 18, 2025
•
17
2
Da Reflexão à Perfeição: Escalonando a Otimização em Tempo de Inferência para Modelos de Difusão de Texto para Imagem via Reflexão Tuning
From Reflection to Perfection: Scaling Inference-Time Optimization for Text-to-Image Diffusion Models via Reflection Tuning
Le Zhuo, Liangbing Zhao, Sayak Paul, Yue Liao, Renrui Zhang, Yi Xin, Peng Gao, Mohamed Elhoseiny, Hongsheng Li
•
Apr 22, 2025
•
15
2
Vidi: Grandes Modelos Multimodais para Compreensão e Edição de Vídeos
Vidi: Large Multimodal Models for Video Understanding and Editing
Vidi Team, Celong Liu, Chia-Wen Kuo, Dawei Du, Fan Chen, Guang Chen, Jiamin Yuan, Lingxi Zhang, Lu Guo, Lusha Li, Longyin Wen, Qingyu Chen, Rachel Deng, Sijie Zhu, Stuart Siew, Tong Jin, Wei Lu, Wen Zhong, Xiaohui Shen, Xin Gu, Xing Mei, Xueqiong Qu
•
Apr 22, 2025
•
15
2
RealisDance-DiT: Uma Linha de Base Simples, porém Eficaz para Animação de Personagens Controlável em Ambientes Diversos
RealisDance-DiT: Simple yet Strong Baseline towards Controllable Character Animation in the Wild
Jingkai Zhou, Yifan Wu, Shikai Li, Min Wei, Chao Fan, Weihua Chen, Wei Jiang, Fan Wang
•
Apr 21, 2025
•
9
2
Progent: Controle Programável de Privilégios para Agentes de LLM
Progent: Programmable Privilege Control for LLM Agents
Tianneng Shi, Jingxuan He, Zhun Wang, Linyu Wu, Hongwei Li, Wenbo Guo, Dawn Song
•
Apr 16, 2025
•
7
2
MR. Vídeo: "MapReduce" é o Princípio para a Compreensão de Vídeos Longos
MR. Video: "MapReduce" is the Principle for Long Video Understanding
Ziqi Pang, Yu-Xiong Wang
•
Apr 22, 2025
•
6
2
CAPTURe: Avaliação do Raciocínio Espacial em Modelos de Linguagem Visual por meio da Contagem de Objetos Ocluídos
CAPTURe: Evaluating Spatial Reasoning in Vision Language Models via Occluded Object Counting
Atin Pothiraj, Elias Stengel-Eskin, Jaemin Cho, Mohit Bansal
•
Apr 21, 2025
•
5
2
IPBench: Avaliando o Conhecimento de Modelos de Linguagem de Grande Escala em Propriedade Intelectual
IPBench: Benchmarking the Knowledge of Large Language Models in Intellectual Property
Qiyao Wang, Guhong Chen, Hongbo Wang, Huaren Liu, Minghui Zhu, Zhifei Qin, Linwei Li, Yilin Yue, Shiqiang Wang, Jiayan Li, Yihang Wu, Ziqiang Liu, Longze Chen, Run Luo, Liyang Fan, Jiaming Li, Lei Zhang, Kan Xu, Hongfei Lin, Hamid Alinejad-Rokny, Shiwen Ni, Yuan Lin, Min Yang
•
Apr 22, 2025
•
4
2
DiffVox: Um Modelo Diferenciável para Captura e Análise de Distribuições de Efeitos Profissionais
DiffVox: A Differentiable Model for Capturing and Analysing Professional Effects Distributions
Chin-Yun Yu, Marco A. Martínez-Ramírez, Junghyun Koo, Ben Hayes, Wei-Hsiang Liao, György Fazekas, Yuki Mitsufuji
•
Apr 20, 2025
•
2
2