OCR 与文档智能研究 Wiki

Tag: benchmark

6 items with this tag.

  • 2026年9月02日

    ArmorOCR — 困难视觉文本的定位、识别与 Spotting 联合强化

    • ocr
    • scene-text
    • text-spotting
    • localization
    • adversarial-ocr
    • self-distillation
    • grpo
    • benchmark
    • front-detr-relevant
    • back-ar-relevant
  • 2026年8月04日

    OmniDocBench(文档解析基准)

    • benchmark
    • document-ai
    • ocr
  • 2026年8月01日

    MORE — 149 语种多语言文档解析基准

    • ocr
    • document-parsing
    • benchmark
    • multilingual
    • evaluation
    • teds
    • cdm
    • tencent
    • reading-order
    • front-detr-relevant
  • 2026年7月28日

    OCR 系统 vs 多模态 LLM 的系统性评测(Caravani et al., 2027)

    • ocr
    • benchmark
    • mllm
    • evaluation
    • latency
    • cost
    • fine-tuning
    • fca
  • 2026年7月23日

    端到端 OCR / 文档解析模型横评

    • ocr
    • document-ai
    • comparison
    • benchmark
  • 2026年7月23日

    GDP.pdf: Benchmarking Grounded Multimodal Reasoning over Professional PDF Documents

    • ocr
    • benchmark
    • document-reasoning
    • multimodal
    • milestone

6 items with this tag.

  • 2026年9月02日

    ArmorOCR — 困难视觉文本的定位、识别与 Spotting 联合强化

    • ocr
    • scene-text
    • text-spotting
    • localization
    • adversarial-ocr
    • self-distillation
    • grpo
    • benchmark
    • front-detr-relevant
    • back-ar-relevant
  • 2026年8月04日

    OmniDocBench(文档解析基准)

    • benchmark
    • document-ai
    • ocr
  • 2026年8月01日

    MORE — 149 语种多语言文档解析基准

    • ocr
    • document-parsing
    • benchmark
    • multilingual
    • evaluation
    • teds
    • cdm
    • tencent
    • reading-order
    • front-detr-relevant
  • 2026年7月28日

    OCR 系统 vs 多模态 LLM 的系统性评测(Caravani et al., 2027)

    • ocr
    • benchmark
    • mllm
    • evaluation
    • latency
    • cost
    • fine-tuning
    • fca
  • 2026年7月23日

    端到端 OCR / 文档解析模型横评

    • ocr
    • document-ai
    • comparison
    • benchmark
  • 2026年7月23日

    GDP.pdf: Benchmarking Grounded Multimodal Reasoning over Professional PDF Documents

    • ocr
    • benchmark
    • document-reasoning
    • multimodal
    • milestone

Created with Quartz © 2026

  • GitHub