ResearchStudio-Reel: Automatisering van de laatste mijl van onderzoek - van paper naar poster, video en blog
ResearchStudio-Reel: Automate the Last Mile of Research from Paper to Poster, Video, and Blog
July 5, 2026
Auteurs: Lingao Xiao, Yalun Dai, Yangyu Huang, Qihao Zhao, Wenshan Wu, Hugo He, Ruishuo Chen, Jin Jiang, Qianli Ma, Jiahuan Zhang, Xin Zhang, Ying Xin, Yang Ou, Yan Xia, Scarlett Li, Longbo Huang, Zhipeng Zhang, Yang He, Yap Kim Hui, Yan Lu
cs.AI
Samenvatting
Onderzoeksverspreiding, het omzetten van een paper in een poster, een talkvideo en een blogpost, is nog steeds een handmatige laatste mijl. Eerdere automatisering behandelt elk artefact geïsoleerd, waarbij elk het paper opnieuw vanaf nul extraheert, meestal een eenrichtingsweergave oplevert die de auteur niet opnieuw kan openen in PowerPoint of Word, en de kwaliteit afremt op zachte VLM-voorkeursscores die een plateau bereiken terwijl dragende secties nog leeg aanvoelen. Wij stellen dat deze laatste mijl het beste kan worden gebouwd als een compositie van vaardigheden: dunne agent-leesbare contracten die één stroomopwaartse extractor delen en deterministische primitieven omhullen in een meetbare-vul-lus waarvan de uitgangen harde pass/fail-rendergates zijn.
We implementeren dit als ResearchStudio-Reel, vijf Claude Code- en Codex-vaardigheden georganiseerd in één gedeelde extractor (Paper2Assets), drie bewerkbare generatoren (Paper2Poster, Paper2Video, Paper2Blog) en één interactieve convergentielaag (Paper2Reel). Paper2Assets extraheert elk paper één keer in een gedeelde bundel die door elke stroomafwaartse vaardigheid kan worden hergebruikt; De drie generatoren produceren een printklare poster, een gesynchroniseerde talkvideo en een tweetalige blog die feitelijk consistent blijven en heen-en-weer kunnen in PowerPoint of Word; Paper2Reel bindt vervolgens alle drie samen in een zelfstandige HTML-viewer waarvan sectieklikken de video, dia's, bijschriften en blog naar overeenkomstige inhoud laten springen.
Op de Paper2Poster-benchmark leiden onze posters in elk esthetisch en informatie-subcriterium, zowel tegen eerdere geautomatiseerde systemen als tegen single-shot frontier-LLM's, en overtreffen ze de eigen posters van de auteurs op esthetiek onder twee gereserveerde VLM-beoordelaars, en winnen ze algemeen op 84% tot 93% van de papers; capaciteitsaudits tonen verder aan dat, door uniek vertelling-afgestemde highlights op dia's te combineren met een tweetalige blog die wordt gecontroleerd door lay-outbewuste DOCX-reparatie, ResearchStudio-Reel de enige pijplijn is die alle drie bewerkbare artefacten levert. Het project is beschikbaar op https://aka.ms/ResearchStudio
English
Research dissemination, turning a paper into a poster, a talk video, and a blog post, is still a manual last mile. Prior automation treats each artifact in isolation that each re-extract the paper from scratch, usually ship one-way renders the author cannot reopen in PowerPoint or Word, and gates quality on soft VLM-preference scores that plateau while load-bearing sections still read as empty. We argue this last mile is best built as a composition of skills: thin agent-readable contracts that share one upstream extractor and wrap deterministic primitives in a measured-fill loop whose exits are hard pass/fail render gates. We instantiate this as ResearchStudio-Reel, five Claude Code and Codex skills organized into one shared extractor (Paper2Assets), three editable generators (Paper2Poster, Paper2Video, Paper2Blog), and one interactive convergence layer (Paper2Reel). Paper2Assets extracts each paper once into a shared bundle that can be reused by every downstream skill; The three generators produce a print-ready poster, a synchronized talk video, and a bilingual blog that stay factually consistent and round-trip through PowerPoint or Word; Paper2Reel then binds all three into a self-contained HTML viewer whose section-level clicks jump the video, slides, captions, and blog to matching content. On the Paper2Poster benchmark, our posters lead every aesthetic and information sub-criterion against both prior automated systems and single-shot frontier LLMs, surpassing the authors' own on aesthetics under two held-out VLM judges and winning overall on 84% to 93% of papers; capability audits further show that, by uniquely pairing narration-aligned on-slide highlights with a bilingual blog gated by layout-aware DOCX repair, ResearchStudio-Reel is the only pipeline to ship all three editable artifacts. Project is available at https://aka.ms/ResearchStudio