Wener Notes

dots.ocr

约 1 分钟阅读
  • rednote-hilab/dots.ocrGitHubrednote-hilab/dots.ocrrednote-hilab/dots.ocr · dots.ocr: Multilingual Document Layout Parsing in a Single Vision-Language Model · by 小红书 · Layout 分析效果非常好笔记:dots.ocr
    • dots.ocr: Multilingual Document Layout Parsing in a Single Vision-Language Model
    • by 小红书
    • Layout 分析效果非常好
  • 参考
  • DotsOCRForCausalLM
    • Qwen2ForCausalLM
    • HF:rednote-hilab/dots.ocrHuggingFaceHF:rednote-hilab/dots.ocrrednote-hilab/dots.ocr · dots.ocr: Multilingual Document Layout Parsing in a Single Vision-Language Model · by 小红书 · Layout 分析效果非常好huggingface.co · huggingface.co/rednote-hilab/dots.ocr/blob/main/modeling_dots_ocr.py笔记:dots.ocr
  • dots.ocr
    • silu
    • hidden size 1536
    • max_position_embeddings/context length 131072 128k
    • 12 heads
    • 28 layers
    • 2 kv heads

关联信息

反向链接、本文链接的其他页面和外部资料。

References

GitHub2 条
HuggingFace2 条
其他外链1 条
最近更新commit 84163d5Edit

On this page