Mistral AI 表示这一 API 具备优秀的多模态文档处理能力,能从 PDF、幻灯片、数学表达式、LaTeX 学术文档等复杂文档元素中提取文本内容,所得结果将以 Markdown 文件的形式清晰呈现。
Mistral OCR 模型可解析、理解和转录数千种脚本、字体和语言。根据 Mistral AI 给出的数据,该模型现有版本在识别中的表现优于谷歌 Document AI、微软 Azure OCR、OpenAI GPT-4o 等一系列竞争者。 Mistral AI 推出 Mistral OCR API:宣称最快最准光学字符识别,千页 1 美元 - IT之家