Workshop Program
DocInsights 2026 program
Thursday, October 29, 2026 · Room F3 · Budapest, Hungary. All times are local Budapest time (CET, UTC+1).
Session 1 · 9:00 – 10:30
Keynote 1
TBA
Shared Task A: DocSem
Evidence-grounded quantitative reasoning over documents.
Break
Session 2 · 11:00 – 12:30
Keynote 2
TBA
Shared Task B: Dr.DocBench
Expert-level document parsing.
Break
Session 3 · 14:00 – 15:30
Poster Session
All 48 accepted papers are presented as posters. See the poster list below.
Break
Session 4 · 16:00 – 17:15
Panel Discussion / Keynote 3
TBA
Closing Ceremony & Best Paper Awards
Poster Session (14:00 – 15:30)
Workshop Papers
- A Human-Annotated Reference Corpus for Medication Information Extraction from MIMIC-IV Discharge Summaries
Provia Kadusabe, Abhishek Kaushik and Fiona Lawless
Presenter: Provia Kadusabe - The Right Information Extraction Pipeline Depends on the Document: Accuracy-Energy Trade-offs for Small, Local Models
Christoph Marjan Markus Walser, Mauricio Fadel Argerich and Jonathan Fürst
Presenter: Jonathan Fürst - Splitting Documents at Lower Cost: Multi-Split Boundary Decisions for LLM-Based Page Stream Segmentation
Nikhil Reddy Pottanigari, Sepideh Kharaghani, Saverio Vadacchino, Alejandro Posada and Ying Zhang
Presenter: Nikhil Reddy Pottanigari - Text, Pixels, or Both? Evaluating Input Representations for Multimodal Document QA
Nikhil Reddy Pottanigari, Sepideh Kharaghani, Saverio Vadacchino, Alejandro Posada, Kurt MacDonald and Ying Zhang
Presenter: Nikhil Reddy Pottanigari - AdaptiveDocRAG: Efficient Document Understanding with Multimodal Large Language Models
Surya Selvam and Anand Raghunathan
Presenter: Surya Selvam (virtual) - Evidence-Guided Schema Normalization for Temporal Tabular Reasoning
Ashish Thanga, Vibhu Dixit, Abhilash Shankarampeta and Vivek Gupta
Presenter: Prasham Titiya - Most of a Document-VQA Score Is Answer Formatting
Srinivas Harish
Presenter: Srinivas Harish (virtual) - Graph-Guided Passage Retrieval for Author-Centric Structured Feedback
Maitreya Prafulla Chitale, Ketaki Mangesh Shetye, Harshit Gupta, Manav Chaudhary, Manish Shrivastava and Vasudeva Varma
Presenter: Maitreya Prafulla Chitale (virtual) - GraphER: An Efficient Graph-Based Enrichment and Reranking Method for Retrieval-Augmented Generation
Ruizhong Miao, Yuying Wang, Rongguang Wang, Chenyang Li, Tao Sheng, Sujith Ravi and Dan Roth
Presenter: Ruizhong Miao (virtual) - LongDA: Benchmarking LLM Agents for Long-Document Data Analysis
Yiyang Li, Zheyuan Zhang, Tianyi Ma, Zehong Wang, Keerthiram Murugesan, Chuxu Zhang and Yanfang Ye
Presenter: Yiyang Li (virtual) - Reflect and Retrieve: Multimodal Agentic Retrieval with Reflection and Query Agents for Document Search
Tryambak Gangopadhyay, Md Sirajus Salekin, Yiyue Qian, Nkechinyere Nneka Agu, Shinan Zhang and Rinne Han
Presenter: Tryambak Gangopadhyay (virtual) - LLMs and Reasoning in Health Insurance Policy Documents: A Dataset and Argument Graph Extraction Study
Govind Arun, Sidharth N Krishna, Susie Xi Rao and Ajo Babu George
Presenter: Govind Arun (virtual) - NutriChat: Evaluating Safety-Aware Retrieval-Augmented Generation for Nutrition Textbook Question Answering
Hadis Ghafouri
Presenter: Hadis Ghafouri (virtual) - Self-Study Reconsidered: The Hidden Fragility of Self-Generated QA Supervision
Ekaterina Alimaskina, Denis Shveykin, Gleb Molodtsov, Shalygin Igor, Alexey Kadeishvili and Aleksandr Beznosikov
Presenter: Gleb Molodtsov - The Fragility of Structured Context Access in Low-Bit LLMs
Suren Kazarian, Ekaterina Alimaskina, Gleb Molodtsov and Aleksandr Beznosikov
Presenter: Gleb Molodtsov - Measuring Artifact Reliance in Machine-Generated Text Detectors
Anastasia Voznyuk and Andrey Grabovoy
Presenter: Anastasia Voznyuk - Graph Retrieval in Multimodal RAG for Biomedical Documents: A Pharmacokinetics and Pharmacodynamics Case Study
Primoz Kocbek, Katarina Meštrović, Nguyen Thu Huong, Ales Fajmut and Gregor Stiglic
Presenter: Primoz Kocbek - Q-STR: Diagnosing Query-Driven Text-to-Table Reasoning in Cricket Narratives
Ritam Upadhyay, Naman Ahuja, Rishabh Baral, Aparna Garimella and Vivek Gupta
Presenter: Ritam Upadhyay (virtual) - Ontology-Guided Procedural Knowledge Extraction and Validation Case Study on the Lockout-Tagout Documents
Cennet Oguz, Noon Pokaratsiri Goldstein, Jörg Steffen, Reetam Biswas and Günter Neumann
Presenter: Noon Pokaratsiri Goldstein - Perception, Layout, and Validation: Calibrated Confidence for Reliable Straight-Through Processing of Financial Documents
Yichao Jin, Yushuo Wang, Han Yuxuan, Ching Yee Sonia Kwan, Weiyang Song, Kent Chiu Jin Chun, Chong Hwee Wong, Tiong Kiat Wong, Kenneth Zhu Ke and Jingyuan Zhao
Presenter: Yuxuan Han - What Transfers from a VLM Teacher? Comparing Supervision Signals for Visual Document Retrieval
Saba Sturua and Han Xiao
Presenter: Saba Sturua - Tabstructor: Reconstructing Latent Borders in Borderless and Partially Ruled Tables
Alvin Sarraga Alon, Daniele De Rosa, Johannes Friedl and Riza Batista-Navarro
Presenter: Alvin Sarraga Alon - Does the Interface Matter? Grounded Document QA in Interactive PDFs
Eric S. Qiu and Joyce Gill
Presenter: Joyce Gill - Silent Structured-Content Corruption in Document Parsing: A Span-Typed Diagnostic and a Released Cross-Parser Resource
Ruiyang Zhang
Presenter: Ruiyang Zhang (virtual) - CsPICO: A Unified Benchmark for Citation Screening in Systematic Reviews beyond Classification to Explain Exclusion Reasons
Yewon Choi, Hyun Do Jung, Dain Ji, Hwiyoung Kim, Sungjun Kim and Jaehyung Kim
Presenter: Yewon Choi - Sorry Robot, Happy Human: Vision-Language Models Read Only One of Two Legible Typographic Layers
Mert İncidelen, Yamen Kashkash, Asya Berker and Murat Aydogan
Presenter: Mert İncidelen - What Should Occupy the Context Budget? Latent Compression versus Budget-Matched Truncation in Document QA
Artem Cherepanov and Albina Burlova
Presenter: Albina Burlova - RAG Components Are Not Independently Rankable
Vishnu Prasad Vijaya Kumar, Iaroslav Neverov, Pavel Chizhov, Anton Changalidis, Vaiva Kazanaviciute, Pierre-Carl Langlais, Anastasia Stasenko and Ivan P. Yamshchikov
Presenter: Vishnu Prasad Vijaya Kumar - PDFPrime: Deterministic PDF Text Extraction Evaluated Against Fidelity-Measured References
Shubhankit Singh and Aditya Jeevan Jethani
Presenter: Shubhankit Singh (virtual) - LaTeXTrans Structure-Aware Translation of Complex LaTeX Documents
Ziming Zhu, Chenglong Wang, Haosong Xu, Shunjie Xing, Yifu Huo, Fengning Tian, Quan Du, Di Yang, Chunliang Zhang, Tong Xiao and JingBo Zhu
Presenter: Chenglong Wang - "Did You CoSeCh?": Faithfulness- and Coherence-Aware Auditing of Content Selection in Poster Generation
Aaditya Deshpande, Savita Bhat and Shirish Karande
Presenter: Aaditya Deshpande (virtual) - Look Where It Matters: High-Resolution Crops Retrieval for Efficient VLMs
Nimrod Shabtay, Moshe Kimhi, Sivan Harary, Artem Spector, Ehud Rivlin, Chaim Baskin, Raja Giryes and Eli Schwartz
Presenter: Moshe Kimhi (virtual) - DistilVDR: A Compact End-to-End Visual Document Retriever via Dual-Student Distillation
Zhuchenyang Liu, Ziyi Wang, Yao Zhang and Yu Xiao
Presenter: Zhuchenyang Liu - Comparative Study of AI Agent Architecture Efficiency in Table Processing Tasks
Timur Gabbasov, Aleksandr Sandalov, Aleksandr Maksimov, Maria Khodorchenko and Nikolay Alekseevich Butakov
Presenter: Timur Gabbasov - MaDOVE: a Dataset for Multilingual Document VQA Evaluation
Elio Musacchio, Lucia Siciliani, Pierpaolo Basile, Giovanni Semeraro, Mark Federico Zampedroni and Asia Beatrice Uboldi
Presenter: Elio Musacchio - Generating Edit-Inducing Questions for AI Research Manuscripts
Sebastian Antony Joseph, Zichao Wang, Jennifer Healey, Alexa Siu, Junyi Jessy Li and Ani Nenkova
Presenter: Sebastian Joseph (virtual) - Sieve and Sage: Efficient Distraction Filtering for Reliable RALM Abstention
Jongbin Won, SungGeun AN and Jay-Yoon Lee
Presenter: Jongbin Won - InSight-doc: Agentic Visual Perception for Long-Document Understanding
Kaican Li, Weiyan Xie, Lewei Yao, Jiannan Wu, Lanqing Hong, Yongxiang Huang and Nevin L. Zhang
Presenter: Kaican Li (virtual) - Subtraction Gets You More: Gap-Aware Retrieval for Multimodal Multi-Hop QA
Sunah O and Jay-Yoon Lee
Presenter: Sunah O
Shared Task Papers
- Image Fidelity and VLM Ensemble for Expert-Level Single-Page Document Parsing on Dr.DocBench
Yushuo Wang, Han Yuxuan, Yichao Jin, Kenneth Zhu Ke and Jingyuan Zhao
Presenter: Yuxuan Han - Evidence Without Answers: Set-Difference Target Selection and a Label-Free Estimate of Answer Loss
Chen-Jui Yu, Shui-Hsiang Hsu, Shao-Cheng Lu, Jui-Piao Chen, Shen Chih Hsuan, Chi-Hsun Tsai, Ru-Zhen Hou, Ping-Jung Shih, I-Chi Lee, Hsiang-Yi Yen, Ming-Der Yang and Yao-Chung Fan
Presenter: Chen-Jui Yu - When the Evidence Is Right, the Math Is Easy: Understanding the Challenges of Document-Grounded Reasoning
Aftab Hossain Mikat and Tamjid Hasan Fahim
Presenter: Aftab Hossain Mikat (virtual) - Acessilia at Dr.DocBench 2026: Agentic Document Parsing through Canonical Tree Adjudication
Marcelo Akira Inuzuka, Marcos Paulo C M Queiroz, Jhonata Fernandes Cordeiro and Eduardo Fraga Pereira
Presenter: Marcelo Akira Inuzuka (virtual) - Evidence First, Arithmetic Second: A System Report and Failure Analysis for DOCSEM
Divya Godara and Sachin Gupta
Presenter: Sachin Gupta (virtual) - The Document Carries Its Own Answer Key: Elimination, Arbitration and Calibration for DocSEM
Shui-Hsiang Hsu, Chen-Jui Yu, Shao-Cheng Lu, Jui-Piao Chen, Shen Chih Hsuan, Chi-Hsun Tsai, Ru-Zhen Hou, Ping-Jung Shih, I-Chi Lee, Hsiang-Yi Yen, Ming-Der Yang and Yao-Chung Fan
Presenter: Shui-Hsiang Hsu - Retrieve, Reason, Verify: A Modular Multi-Model System for DocSem
Pranavi Tadivalasa
Presenter: Pranavi Tadivalasa (virtual) - A Cost-Efficient Vision-Text Cascade for Document QA: What Resolution Buys and What It Doesn't
Urjita Bedekar
Presenter: Urjita Bedekar - DFM at DocSEM 2026: Investigating a Guided-Reasoning Pipeline for Open Models Under a Validation-Test Shift
Dyonnatan Ferreira Maia
Presenter: Dyonnatan Ferreira Maia (virtual)