欢迎回来

登录 EAKE AI,继续您的智能之旅

忘记密码?
还没有账号?立即注册

Qwen-VL OCR

2026-09-15 · 未分类

Qwen-VL OCR 是 阿里云通义千问 推出的 图像输入模型,上下文窗口 34,096 tokens,单次最大输出 4,096 tokens。

原厂描述:OCR model for extracting structured text from documents and screenshots

  • 厂商:阿里云通义千问(Alibaba)
  • 模型 ID:qwen-vl-ocr
  • 上下文:34,096 tokens
  • 最大输出:4,096 tokens
  • 定价:输入 $0.72 / 输出 $0.72 · 每百万 tokens
  • 能力:图像输入
  • 发布日期:2024-10-28

数据来源:models.dev

评论区

该文章暂未开放评论功能。