ChatPaper.ai
Abrir menú
Inicio
Artículos Diarios
arXiv
HuggingFace
Precios
Cuenta
Espacio de trabajo
🇪🇸
Español
Loading...
•
•
•
•
•
•
•
•
•
•
Artículos de Investigación en IA Diarios
Artículos de investigación en IA seleccionados diariamente con traducciones
November 25th, 2024
Adaptación de Modelos de Base de Visión para una Segmentación en la Nube Robusta en Imágenes de Teledetección
Adapting Vision Foundation Models for Robust Cloud Segmentation in Remote Sensing Images
Xuechao Zou, Shun Zhang, Kai Li, Shiying Wang, Junliang Xing, Lei Jin, Congyan Lang, Pin Tao
•
Nov 20, 2024
•
4
2
Uno para gobernarlos a todos: lenguaje natural para unir comunicación, percepción y acción.
One to rule them all: natural language to bind communication, perception and action
Simone Colombani, Dimitri Ognibene, Giuseppe Boccignone
•
Nov 22, 2024
•
3
2
Mi Máquina del Tiempo: Transformación Personalizada de Edad Facial
MyTimeMachine: Personalized Facial Age Transformation
Luchao Qi, Jiaye Wu, Bang Gong, Annie N. Wang, David W. Jacobs, Roni Sengupta
•
Nov 21, 2024
•
22
2
WildLMa: Manipulación Loco-Manipulativa a Largo Plazo en Entornos Naturales
WildLMa: Long Horizon Loco-Manipulation in the Wild
Ri-Zhao Qiu, Yuchen Song, Xuanbin Peng, Sai Aneesh Suryadevara, Ge Yang, Minghuan Liu, Mazeyu Ji, Chengzhe Jia, Ruihan Yang, Xueyan Zou, Xiaolong Wang
•
Nov 22, 2024
•
6
2
Tokenización eficiente de videos largos a través de la Reconstrucción de Parches basada en Coordenadas.
Efficient Long Video Tokenization via Coordinated-based Patch Reconstruction
Huiwon Jang, Sihyun Yu, Jinwoo Shin, Pieter Abbeel, Younggyo Seo
•
Nov 22, 2024
•
11
2
Una Metodología Flexible para el Desarrollo de Barreras de Protección de Modelos de Lenguaje Grandes aplicada a la Detección de Temas Fuera de Contexto.
A Flexible Large Language Models Guardrail Development Methodology Applied to Off-Topic Prompt Detection
Gabriel Chua, Shing Yee Chan, Shaun Khoo
•
Nov 20, 2024
•
23
2
Muestreador de SNR compatible con el estilo para Generación Dirigida por Estilo
Style-Friendly SNR Sampler for Style-Driven Generation
Jooyoung Choi, Chaehun Shin, Yeongtak Oh, Heeseung Kim, Sungroh Yoon
•
Nov 22, 2024
•
35
3
BALROG: Evaluación comparativa del razonamiento agente de LLM y VLM en juegos
BALROG: Benchmarking Agentic LLM and VLM Reasoning On Games
Davide Paglieri, Bartłomiej Cupiał, Samuel Coward, Ulyana Piterbarg, Maciej Wolczyk, Akbir Khan, Eduardo Pignatelli, Łukasz Kuciński, Lerrel Pinto, Rob Fergus, Jakob Nicolaus Foerster, Jack Parker-Holder, Tim Rocktäschel
•
Nov 20, 2024
•
18
2
TÜLU 3: Avanzando en los Límites en el Post-Entrenamiento de Modelos de Lenguaje Abiertos
TÜLU 3: Pushing Frontiers in Open Language Model Post-Training
Nathan Lambert, Jacob Morrison, Valentina Pyatkin, Shengyi Huang, Hamish Ivison, Faeze Brahman, Lester James V. Miranda, Alisa Liu, Nouha Dziri, Shane Lyu, Yuling Gu, Saumya Malik, Victoria Graf, Jena D. Hwang, Jiangjiang Yang, Ronan Le Bras, Oyvind Tafjord, Chris Wilhelm, Luca Soldaini, Noah A. Smith, Yizhong Wang, Pradeep Dasigi, Hannaneh Hajishirzi
•
Nov 22, 2024
•
63
2
OminiControl: Control Mínimo y Universal para el Transformador de Difusión
OminiControl: Minimal and Universal Control for Diffusion Transformer
Zhenxiong Tan, Songhua Liu, Xingyi Yang, Qiaochu Xue, Xinchao Wang
•
Nov 22, 2024
•
60
10
Los modelos multimodales grandes pueden interpretar características en modelos multimodales grandes.
Large Multi-modal Models Can Interpret Features in Large Multi-modal Models
Kaichen Zhang, Yifei Shen, Bo Li, Ziwei Liu
•
Nov 22, 2024
•
17
4
VideoEspresso: Un conjunto de datos a gran escala de cadena de pensamiento para razonamiento de video detallado a través de la selección de marcos centrales.
VideoEspresso: A Large-Scale Chain-of-Thought Dataset for Fine-Grained Video Reasoning via Core Frame Selection
Songhao Han, Wei Huang, Hairong Shi, Le Zhuo, Xiu Su, Shifeng Zhang, Xu Zhou, Xiaojuan Qi, Yue Liao, Si Liu
•
Nov 22, 2024
•
13
3
VideoRepair: Mejorando la Generación de Texto a Video a través de la Evaluación de Desalineación y Refinamiento Localizado
VideoRepair: Improving Text-to-Video Generation via Misalignment Evaluation and Localized Refinement
Daeun Lee, Jaehong Yoon, Jaemin Cho, Mohit Bansal
•
Nov 22, 2024
•
9
3
Extrapolación de Vistas Noveles con Priors de Difusión de Video
Novel View Extrapolation with Video Diffusion Priors
Kunhao Liu, Ling Shao, Shijian Lu
•
Nov 21, 2024
•
10
3