ChatPaper.aiChatPaper

ResearchStudio-Reel: Automatizar la última milla de la investigación, desde el artículo hasta el póster, el video y el blog

ResearchStudio-Reel: Automate the Last Mile of Research from Paper to Poster, Video, and Blog

July 5, 2026
Autores: Lingao Xiao, Yalun Dai, Yangyu Huang, Qihao Zhao, Wenshan Wu, Hugo He, Ruishuo Chen, Jin Jiang, Qianli Ma, Jiahuan Zhang, Xin Zhang, Ying Xin, Yang Ou, Yan Xia, Scarlett Li, Longbo Huang, Zhipeng Zhang, Yang He, Yap Kim Hui, Yan Lu
cs.AI

Resumen

La difusión de investigaciones —convertir un artículo en un póster, un video de presentación y una publicación de blog— sigue siendo una última milla manual. La automatización previa trata cada artefacto de forma aislada, reextrayendo cada artículo desde cero, generalmente generando representaciones unidireccionales que el autor no puede reabrir en PowerPoint o Word, y condiciona la calidad a puntuaciones blandas de preferencia VLM que se estabilizan mientras secciones fundamentales aún se leen como vacías. Sostenemos que esta última milla se construye mejor como una composición de habilidades: contratos delgados legibles por agentes que comparten un extractor ascendente único y envuelven primitivas deterministas en un bucle de llenado medido, cuyas salidas son compuertas de renderizado duras de aprobado/rechazado. Materializamos esto como ResearchStudio-Reel, cinco habilidades de Claude Code y Codex organizadas en un extractor compartido (Paper2Assets), tres generadores editables (Paper2Poster, Paper2Video, Paper2Blog) y una capa de convergencia interactiva (Paper2Reel). Paper2Assets extrae cada artículo una vez en un paquete compartido reutilizable por cada habilidad descendente; los tres generadores producen un póster listo para impresión, un video de presentación sincronizado y un blog bilingüe que se mantienen factualmente consistentes y son editables en PowerPoint o Word; Paper2Reel luego une los tres en un visor HTML autónomo cuyos clics a nivel de sección saltan el video, las diapositivas, los subtítulos y el blog al contenido correspondiente. En el punto de referencia Paper2Poster, nuestros pósteres lideran todos los subcriterios estéticos y de información frente a sistemas automatizados previos y LLMs fronterizos de un solo disparo, superando a los propios autores en estética bajo dos jueces VLM retenidos y ganando en general en el 84% al 93% de los artículos; las auditorías de capacidad muestran además que, al combinar de forma única destacados en diapositivas alineados con la narración con un blog bilingüe controlado por una reparación de DOCX consciente del diseño, ResearchStudio-Reel es el único pipeline que genera los tres artefactos editables. El proyecto está disponible en https://aka.ms/ResearchStudio
English
Research dissemination, turning a paper into a poster, a talk video, and a blog post, is still a manual last mile. Prior automation treats each artifact in isolation that each re-extract the paper from scratch, usually ship one-way renders the author cannot reopen in PowerPoint or Word, and gates quality on soft VLM-preference scores that plateau while load-bearing sections still read as empty. We argue this last mile is best built as a composition of skills: thin agent-readable contracts that share one upstream extractor and wrap deterministic primitives in a measured-fill loop whose exits are hard pass/fail render gates. We instantiate this as ResearchStudio-Reel, five Claude Code and Codex skills organized into one shared extractor (Paper2Assets), three editable generators (Paper2Poster, Paper2Video, Paper2Blog), and one interactive convergence layer (Paper2Reel). Paper2Assets extracts each paper once into a shared bundle that can be reused by every downstream skill; The three generators produce a print-ready poster, a synchronized talk video, and a bilingual blog that stay factually consistent and round-trip through PowerPoint or Word; Paper2Reel then binds all three into a self-contained HTML viewer whose section-level clicks jump the video, slides, captions, and blog to matching content. On the Paper2Poster benchmark, our posters lead every aesthetic and information sub-criterion against both prior automated systems and single-shot frontier LLMs, surpassing the authors' own on aesthetics under two held-out VLM judges and winning overall on 84% to 93% of papers; capability audits further show that, by uniquely pairing narration-aligned on-slide highlights with a bilingual blog gated by layout-aware DOCX repair, ResearchStudio-Reel is the only pipeline to ship all three editable artifacts. Project is available at https://aka.ms/ResearchStudio