ChatPaper.ai
메뉴 열기
홈
오늘의 논문
arXiv
HuggingFace
요금제
계정
작업공간
🇰🇷
한국어
Loading...
•
•
•
•
•
•
•
•
•
•
AI 연구 논문 데일리
번역이 포함된 일일 선별된 AI 연구 논문
March 24th, 2025
비디오 확산 모델을 위한 다목적 제어 기능 활성화
Enabling Versatile Controls for Video Diffusion Models
Xu Zhang, Hao Zhou, Haoming Qin, Xiaobin Lu, Jiaxing Yan, Guanzhong Wang, Zeyu Chen, Yi Liu
•
Mar 21, 2025
•
15
2
TaoAvatar: 3D 가우시안 스플래팅 기반 증강 현실을 위한 실시간 생생한 전신 대화형 아바타
TaoAvatar: Real-Time Lifelike Full-Body Talking Avatars for Augmented Reality via 3D Gaussian Splatting
Jianchuan Chen, Jingchuan Hu, Gaige Wang, Zhonghua Jiang, Tiansong Zhou, Zhiwen Chen, Chengfei Lv
•
Mar 21, 2025
•
26
3
MARS: 자동 프롬프트 최적화를 위한 소크라테스식 지도를 통합한 다중 에이전트 프레임워크
MARS: A Multi-Agent Framework Incorporating Socratic Guidance for Automated Prompt Optimization
Jian Zhang, Zhangqi Wang, Haiping Zhu, Jun Liu, Qika Lin, Erik Cambria
•
Mar 21, 2025
•
45
2
적은 것이 충분할 때: 효율적인 이미지 표현을 위한 적응형 토큰 축소
When Less is Enough: Adaptive Token Reduction for Efficient Image Representation
Eduard Allakhverdov, Elizaveta Goncharova, Andrey Kuznetsov
•
Mar 20, 2025
•
73
2
FFaceNeRF: 신경 방사 필드에서의 소수 샷 얼굴 편집
FFaceNeRF: Few-shot Face Editing in Neural Radiance Fields
Kwan Yun, Chaelin Kim, Hangyeul Shin, Junyong Noh
•
Mar 21, 2025
•
5
2
단일 이미지 반복적 주체 기반 생성 및 편집
Single Image Iterative Subject-driven Generation and Editing
Yair Shpitzer, Gal Chechik, Idan Schwartz
•
Mar 20, 2025
•
14
2
장기 문맥 언어 모델링에 대한 포괄적 조사
A Comprehensive Survey on Long Context Language Modeling
Jiaheng Liu, Dawei Zhu, Zhiqi Bai, Yancheng He, Huanxuan Liao, Haoran Que, Zekun Wang, Chenchen Zhang, Ge Zhang, Jiebin Zhang, Yuanxing Zhang, Zhuo Chen, Hangyu Guo, Shilong Li, Ziqiang Liu, Yong Shan, Yifan Song, Jiayi Tian, Wenhao Wu, Zhejian Zhou, Ruijie Zhu, Junlan Feng, Yang Gao, Shizhu He, Zhoujun Li, Tianyu Liu, Fanyu Meng, Wenbo Su, Yingshui Tan, Zili Wang, Jian Yang, Wei Ye, Bo Zheng, Wangchunshu Zhou, Wenhao Huang, Sujian Li, Zhaoxiang Zhang
•
Mar 20, 2025
•
49
2
자기회귀적 시각적 생성을 위한 연속적 토큰과 이산적 토큰의 연결
Bridging Continuous and Discrete Tokens for Autoregressive Visual Generation
Yuqing Wang, Zhijie Lin, Yao Teng, Yuanzhi Zhu, Shuhuai Ren, Jiashi Feng, Xihui Liu
•
Mar 20, 2025
•
35
4
비전-언어 모델을 활용한 일반화된 소샷 3D 포인트 클라우드 분할
Generalized Few-shot 3D Point Cloud Segmentation with Vision-Language Model
Zhaochong An, Guolei Sun, Yun Liu, Runjia Li, Junlin Han, Ender Konukoglu, Serge Belongie
•
Mar 20, 2025
•
5
2
MathFlow: 시각적 수학 문제를 위한 MLLM의 지각적 흐름 강화
MathFlow: Enhancing the Perceptual Flow of MLLMs for Visual Mathematical Problems
Felix Chen, Hangjie Yuan, Yunqiu Xu, Tao Feng, Jun Cen, Pengwei Liu, Zeying Huang, Yi Yang
•
Mar 19, 2025
•
14
3
OpenVLThinker: 반복적 자기 개선을 통한 복잡한 시각-언어 추론에 대한 초기 탐구
OpenVLThinker: An Early Exploration to Complex Vision-Language Reasoning via Iterative Self-Improvement
Yihe Deng, Hritik Bansal, Fan Yin, Nanyun Peng, Wei Wang, Kai-Wei Chang
•
Mar 21, 2025
•
23
2
GAEA: 지리적 위치 인식 대화형 모델
GAEA: A Geolocation Aware Conversational Model
Ron Campos, Ashmal Vayani, Parth Parag Kulkarni, Rohit Gupta, Aritra Dutta, Mubarak Shah
•
Mar 20, 2025
•
6
2
ETVA: 세밀한 질문 생성 및 답변을 통한 텍스트-비디오 정렬 평가
ETVA: Evaluation of Text-to-Video Alignment via Fine-grained Question Generation and Answering
Kaisi Guan, Zhengfeng Lai, Yuchong Sun, Peng Zhang, Wei Liu, Kieran Liu, Meng Cao, Ruihua Song
•
Mar 21, 2025
•
11
2
다양한 창작 글쓰기를 위한 대규모 언어 모델 사후 학습 수정
Modifying Large Language Model Post-Training for Diverse Creative Writing
John Joon Young Chung, Vishakh Padmakumar, Melissa Roemmele, Yuqian Sun, Max Kreminski
•
Mar 21, 2025
•
36
2
FastCuRL: 효율적인 R1 유사 추론 모델 학습을 위한 점진적 컨텍스트 확장 기반 커리큘럼 강화 학습
FastCuRL: Curriculum Reinforcement Learning with Progressive Context Extension for Efficient Training R1-like Reasoning Models
Mingyang Song, Mao Zheng, Zheng Li, Wenjie Yang, Xuan Luo, Yue Pan, Feng Zhang
•
Mar 21, 2025
•
10
3
로보팩토리: 구성적 제약 조건을 통한 구체화된 에이전트 협업 탐구
RoboFactory: Exploring Embodied Agent Collaboration with Compositional Constraints
Yiran Qin, Li Kang, Xiufeng Song, Zhenfei Yin, Xiaohong Liu, Xihui Liu, Ruimao Zhang, Lei Bai
•
Mar 20, 2025
•
40
2
선호가 갈릴 때: 소수자 인식 적응형 DPO를 통한 확산 모델 정렬
When Preferences Diverge: Aligning Diffusion Models with Minority-Aware Adaptive DPO
Lingfan Zhang, Chen Liu, Chengming Xu, Kai Hu, Donghao Luo, Chengjie Wang, Yanwei Fu, Yuan Yao
•
Mar 21, 2025
•
6
2
대형 시각 언어 모델이 인간처럼 지도를 읽을 수 있을까?
Can Large Vision Language Models Read Maps Like a Human?
Shuo Xing, Zezhou Sun, Shuangyu Xie, Kaiyuan Chen, Yanjia Huang, Yuping Wang, Jiachen Li, Dezhen Song, Zhengzhong Tu
•
Mar 18, 2025
•
9
2
MAPS: 다중 에이전트 기반의 빅 세븐 성격 모델과 소크라테스식 안내를 활용한 다중모드 과학적 문제 해결 프레임워크
MAPS: A Multi-Agent Framework Based on Big Seven Personality and Socratic Guidance for Multimodal Scientific Problem Solving
Jian Zhang, Zhiyuan Wang, Zhangqi Wang, Xinyu Zhang, Fangzhi Xu, Qika Lin, Rui Mao, Erik Cambria, Jun Liu
•
Mar 21, 2025
•
54
2
머리부터 꼬리까지: 적응형 데이터 보정을 통한 대규모 시각-언어 모델의 균형 잡힌 표현 추구
From Head to Tail: Towards Balanced Representation in Large Vision-Language Models through Adaptive Data Calibration
Mingyang Song, Xiaoye Qu, Jiawei Zhou, Yu Cheng
•
Mar 17, 2025
•
9
2
PVChat: 원샷 학습을 통한 개인화된 비디오 채팅
PVChat: Personalized Video Chat with One-Shot Learning
Yufei Shi, Weilong Yan, Gang Xu, Yumeng Li, Yuchen Li, Zhenxi Li, Fei Richard Yu, Ming Li, Si Yong Yeo
•
Mar 21, 2025
•
7
2
추론 모델에서의 암묵적 편향 유사 패턴
Implicit Bias-Like Patterns in Reasoning Models
Messi H. J. Lee, Calvin K. Lai
•
Mar 14, 2025
•
7
2