OCR 标签,匹配到约6个结果, 耗时0.0335秒
阿里开源 0.8B 文档解析模型 OvisOCR2,端到端模型首次超越流水线方法

阿里开源 0.8B 文档解析模型 OvisOCR2,端到端模型首次超越流水线方法

阿里开源 0.8B 文档解析模型 OvisOCR2,端到端模型首次超越流水线方法
阿里云开源 OvisOCR2,仅 0.8B 参数,在 OmniDocBench v1.6 上以 96.58 分登顶,首次证明端到端模型可超越传统流水线方法,大幅降低部署复杂度。无缝融入千问生态,为 RAG、企业知识库提供高效基础设施。 #A...
2026-07-24 · 浏览117次
Mistral AI 推出 OCR 4 模型:支持 170 种语言,输出更受人类青睐

Mistral AI 推出 OCR 4 模型:支持 170 种语言,输出更受人类青睐

Mistral AI 推出 OCR 4 模型:支持 170 种语言,输出更受人类青睐
Mistral OCR 4 基础 API 调用定价为每千页 4 美元,批处理方式可享受 50% 优惠;文档人工智能定价则是每千页 5 美元。...
2026-06-26 · 浏览173次
百度开源 Unlimited OCR 模型:基于 DeepSeek OCR,解析文档告别 AI 越生成越慢

百度开源 Unlimited OCR 模型:基于 DeepSeek OCR,解析文档告别 AI 越生成越慢

百度开源 Unlimited OCR 模型:基于 DeepSeek OCR,解析文档告别 AI 越生成越慢
百度于 6 月 22 日开源推出 Unlimited OCR 模型,总参数量 30 亿,推理时仅激活 5 亿参数,目标解决在解析长文档时,端到端 OCR 模型越生成越慢的问题。...
2026-06-25 · 浏览156次
智谱开源 GLM-OCR 模型:仅 0.9B 参数,多项基准取得 SOTA 表现

智谱开源 GLM-OCR 模型:仅 0.9B 参数,多项基准取得 SOTA 表现

智谱开源 GLM-OCR 模型:仅 0.9B 参数,多项基准取得 SOTA 表现
智谱AI正式开源GLM-OCR文档解析模型,仅0.9B参数,却在多项基准测试中取得SOTA表现。它支持手写体、复杂表格、代码及印章识别,并显著降低了推理成本。开源地址与在线体验已同步开放。#人工智能##开源##OCR技术#...
2026-02-03 · 浏览579次
DeepSeek-OCR 2 发布:让 AI 像人一样“读懂”复杂文档,识别性能提升 3.73%

DeepSeek-OCR 2 发布:让 AI 像人一样“读懂”复杂文档,识别性能提升 3.73%

DeepSeek-OCR 2 发布:让 AI 像人一样“读懂”复杂文档,识别性能提升 3.73%
DeepSeek发布新一代文档识别模型DeepSeek-OCR 2,引入“视觉因果流”概念,通过DeepEncoder V2编码器动态重排视觉token顺序,更贴近人类阅读逻辑。在OmniDocBench v1.5测试中整体得分达91.09...
2026-01-27 · 浏览343次
DeepSeek 团队开源新模型 DeepSeek-OCR:少量视觉 token 完成海量文本压缩

DeepSeek 团队开源新模型 DeepSeek-OCR:少量视觉 token 完成海量文本压缩

DeepSeek 团队开源新模型 DeepSeek-OCR:少量视觉 token 完成海量文本压缩
根据介绍,当文本 token 数量不超过视觉 token 的 10 倍(压缩比低于 10×)时,模型的 OCR 精度可达 97%;即便压缩比提高到 20×,准确率仍保持约 60%。...
2025-10-20 · 浏览616次
上一页 · 下一页 · 当前第1页