25 items with this tag.2026年9月02日SCVER — 解码状态条件的高分辨率视觉证据检索ocrdocument-parsingautoregressive-decodingvisual-retrievaldeformable-attentionhigh-resolutionefficiencyfront-detr-relevantback-ar-relevant2026年8月01日LayoutLite — Token 级隐式版面分析加速文档 OCRocrdocument-parsingvisual-token-compressionlayout-analysisgrporeinforcement-learningvlmkv-cachefront-detr-relevantback-ar-relevantplug-and-play2026年8月01日MORE — 149 语种多语言文档解析基准ocrdocument-parsingbenchmarkmultilingualevaluationtedscdmtencentreading-orderfront-detr-relevant2026年7月25日百度 Baidu / PaddleOCRorgocrdocument-parsingchina2026年7月25日上海人工智能实验室 / OpenDataLab(MinerU)orgocrdocument-parsingchina2026年7月25日小红书 Xiaohongshu / RedNote hi-laborgocrdocument-parsingchina2026年7月25日Zhipu AI(智谱)orgocrdocument-parsingchina2026年7月25日dots.ocr: Multilingual Document Layout Parsing (1.2B vision encoder + 1.7B decoder, ~3B)ocrdocument-parsingunified-vlmlayoutmultilingualend-to-endfrontendbackend2026年7月25日FireRed-OCR: Specializing General VLMs into OCR Modelsocrdocument-parsinggrpostructural-hallucinationdata-factorythree-stage-trainingmarkdown2026年7月25日GLM-OCR Technical Reportocrdocument-parsingcompactmulti-token-predictionmilestone2026年7月25日HPD-Parsing — 层次并行解码文档解析ocrdocument-parsingdecodingparallel-decodingmtpspeculative-decodingkv-cachevlmbaidufront-detr-relevantback-ar-relevant2026年7月25日HSD — 免训练层次投机解码加速文档解析ocrdocument-parsingdecodingspeculative-decodingparallel-decodingtraining-freekv-cacheback-ar-relevant2026年7月25日Ovis-OCR2: 0.8B End-to-End Document Parsing (OmniDocBench SOTA)ocrdocument-parsingend-to-endsmall-modeldata-enginesynthetic-datadistillationmilestone2026年7月25日Parser-Oriented Structural Refinement — 稳定 DETR→解析器 界面ocrdocument-parsingdetrd-finelayout-interfaceretentionreading-ordernms-freefront-detr-relevantback-ar-relevant2026年7月25日Unlimited OCR — R-SWA 恒定 KV 长文档解析ocrdocument-parsingkv-cachesliding-window-attentionlong-documentdecodingbaiduback-ar-relevant2026年7月23日Dolphin-v2: Scalable Anchor Prompting for Document Parsingocrdocument-parsinganchor-promptingphotographed-docsfine-grained-detectionhybrid-parsingfrontend2026年7月23日Dolphin: Document Image Parsing via Heterogeneous Anchor Promptingocrdocument-parsinganchor-promptingparallel-decodingtwo-stageanalyze-then-parsefrontendbackend2026年7月23日Logics-Parsing-Omni: Unified Omni Parsing (documents/images/AV)ocrdocument-parsingomnievidence-anchoringprogressive-parsingreading-order2026年7月23日Logics-Parsing: End-to-End LVLM with RL for Layout & Reading Orderocrdocument-parsingreinforcement-learningreading-orderlayouthtml-outputend-to-end2026年7月23日MinerU2.5-Pro: Data-Driven Document Parsing (same 1.2B architecture)ocrdocument-parsingdata-enginetraining-strategygrpoomnidocbenchmilestone2026年7月23日MinerU2.5: A Decoupled VLM for Efficient High-Resolution Document Parsingocrdocument-parsingvlmdecoupledhigh-resolutioncoarse-to-finefrontendbackend2026年7月23日PaddleOCR-VL: 0.9B Ultra-Compact VLM for Document Parsingocrdocument-parsingvlmsmall-modellayoutomnidocbenchfrontendbackend2026年7月23日POINTS-Reader: Distillation-Free Adaptation of VLMs for Document Conversionocrdocument-parsingdistillation-freesynthetic-dataself-improvementend-to-end2026年7月23日Youtu-Parsing: High-Parallelism Decoding for Document Parsingocrdocument-parsingparallel-decodingtoken-parallelismquery-parallelismregion-promptbackendfrontend2026年7月23日OCR/文档解析的合成数据 — 方法专题synthesissynthetic-datadata-engineocrdocument-parsingtraining-data