









DeepSeek OCR 是一个基于两阶段变换器的文档人工智能系统,利用上下文光学压缩技术提供一流的文档智能。它将高分辨率文档压缩为精简的视觉标记,然后借助 30 亿参数的专家混合模型进行解码,实现对 100 多种语言几乎无损的文本、布局和图表理解。支持在复杂布局下进行 GPU 高效处理,并在 3000 万个真实 PDF 页面和合成数据上训练,能够保留布局结构、表格、化学(SMILES 字符串)以及几何任务。
DeepSeek OCR 可以通过三种主要方式使用:1. 通过克隆 GitHub 仓库、本地下载 6.7 GB 的检查点并配置 PyTorch 在本地使用 GPU 部署。2. 通过其兼容 OpenAI 的 API 接口调用 DeepSeek OCR,提交图像并接收结构化文本。3. 将 DeepSeek OCR 集成到现有工作流中,将 OCR 输出转换为 JSON,连接 SMILES 字符串到化学信息学管道,或者自动为图表生成标题。
更多联系, 访问 the contact us page(https://deepseek-ocr.io/#contact)
Deepseek OCR 公司名字: DeepSeek .
Deepseek OCR 公司地理位置: .
更多关于Deepseek OCR, 请访问 the about us page(https://deepseek-ocr.io/#overview).
Deepseek OCR 价格链接: https://api-docs.deepseek.com/quick_start/pricing
Deepseek OCR Twitter链接: https://twitter.com/deepseek_ai
Deepseek OCR Github链接: https://github.com/deepseek-ai/DeepSeek-OCR

API 输入令牌(缓存命中)
$0.028
每 1M 输入令牌在缓存命中时的费用
API 输入令牌(缓存未命中)
$0.28
每 1M 输入令牌在缓存未命中时的费用
API 输出令牌
$0.42
每 1M 输出令牌的费用
如需要最新的产品价格, 请访问这个链接查询最新价格: https://api-docs.deepseek.com/quick_start/pricing

社交媒体聆听