搜索
当前所在位置:首页 >> 综合

【杭州学院泄露排名】欧洲“DeepSeek”发布了全世界最好的 OCR,网友:蹲蹲中国的免费开源版

发布时间:2025-09-13 17:28:38 作者:xzq 点击:4496 【 字体:

就在刚刚,欧洲那个曾经开源了首个 MoE 模型的发布欧洲初创公司 Mistral AI 在沉寂一段时间之后又出新活。

Mistral 团队发布了一个号称“全世界最好的全世 OCR”的产品 —— Mistral OCR,旨在将一些 AI 难以直接识别的界最粗糙且复杂的文件进行整理,便于 AI 操作识别。友蹲

欧洲“DeepSeek”发布了全世界最好的蹲中<strong>杭州学院泄露排名</strong> OCR,网友:蹲蹲中国的免费免费开源版

帖子一经发出,评论区瞬间充满了各种夸夸言论,开源但在一众赞美声中,欧洲也不乏一些真正用过产品的发布网友的理智发言。

就比如有网友对 Mistral OCR 的全世产品能力表示认同,但却有点接受不了它的界最产品定价,觉得有点太贵,友蹲并且期待中国 AI 公司早点发布一个类似的蹲中杭州中学实拍地址开源版本,把价格打下来。免费

欧洲“DeepSeek”发布了全世界最好的 OCR,网友:蹲蹲中国的免费开源版

同时也有网友亲自上手,上传扫描了手写板的内容,但最后识别出的文字结果正确率并不是很高。

欧洲“DeepSeek”发布了全世界最好的 OCR,网友:蹲蹲中国的免费开源版

除此之外,还有被 Mistral 所宣传的“可以识别超多种语言”噱头吸引过来的网友,但使用后却失望的发现它无法识别自己所用语言。

欧洲“DeepSeek”发布了全世界最好的 OCR,网友:蹲蹲中国的免费开源版

尽管 Mistral OCR 目前还存在着一定的局限性,但它的出现确实是一次从字符识别到场景智能的跨越。

从图文到结构化数据的一大步

与传统的 OCR API 不同,Mistral OCR 是一款多模态 API,它不仅可以识别文本中是否嵌入了插图或照片,还会为这些图形元素创建边界框,并将它们包含在输出中。

从 Mistral AI 团队放出的 Demo 视频可以看出,Mistral OCR 能够将图文混排的 PDF 文件转换成结构清晰的 Markdown 格式文件。

例如表格+数字的 PDF 组合。

欧洲“DeepSeek”发布了全世界最好的 OCR,网友:蹲蹲中国的免费开源版

PDF 图片中数学公式的转换。

欧洲“DeepSeek”发布了全世界最好的 OCR,网友:蹲蹲中国的免费开源版

PDF 宣传图片中的印地语。

欧洲“DeepSeek”发布了全世界最好的 OCR,网友:蹲蹲中国的免费开源版

拍得并不方正的论文照片。

欧洲“DeepSeek”发布了全世界最好的 OCR,网友:蹲蹲中国的免费开源版

甚至带有水印的文字也可以轻松识别。

欧洲“DeepSeek”发布了全世界最好的 OCR,网友:蹲蹲中国的免费开源版

从字符识别到场景智能的一大步

除了直观的 Demo 外,Mistral AI 团队还列举了 6 点 Mistral OCR 的绝对优势:

卓越的复杂文档解析能力:Mistral OCR 在理解复杂文档结构方面表现出色,能够精准解析交错的图像、数学公式、表格以及 LaTeX 等高级排版格式。这使其在处理包含图表、图形、公式和插图的科学论文等富文本文档时更具优势。

原生支持多语言与多模态:Mistral OCR 自带多语言和多模态处理能力,能够灵活应对不同语言以及多种类型的内容,无需额外适配。

行业领先的基准测试表现:在多项行业基准测试中,Mistral OCR 均取得优异成绩,充分展示了其强劲的性能和高准确度。

同类产品中处理速度最快:Mistral OCR 采用轻量化架构,处理速度远超同类产品,单节点每分钟可解析高达 2000 页文档。无论在高负载环境还是大规模数据处理中,它都能保持高效运行,确保稳定性能。

创新性的“文档即提示”结构化输出:Mistral OCR 率先引入“文档即提示”概念,使用户能够直接使用文档作为指令,以获取更加精准和定制化的结果。它还能输出 JSON 等结构化格式,便于与后续任务或自动化流程衔接,实现更智能的内容提取。

可选的自托管部署方案:针对数据隐私要求严格的企业或机构,Mistral OCR 提供自托管部署选项,确保敏感信息始终存储在本地基础设施内,满足合规性与安全性需求。

欧洲“DeepSeek”发布了全世界最好的 OCR,网友:蹲蹲中国的免费开源版

团队还将 Mistral OCR 将 Google Document AI、Azure OCR、Gemini 系列模型以及 GPT-4o 的产品性能进行对比。

最终的结果表明,Mistral OCR 在总体准确率、数学公式识别等方面表现优异,特别是在 2503 版本中,各项指标均大幅提升,达到了新的高度。

欧洲“DeepSeek”发布了全世界最好的 OCR,网友:蹲蹲中国的免费开源版

在多语言处理方面,得出的数据更是远远优于 Google Document AI 和 Azure OCR。

欧洲“DeepSeek”发布了全世界最好的 OCR,网友:蹲蹲中国的免费开源版

欧洲也有自己的“DeepSeek”

Mistral AI 是一家位于法国的初创公司,凭借其 AI 助手 Le Chat 和多个基础模型,已被官方视为法国最具前途的科技公司之一,并被认为是唯一有潜力与 OpenAI 竞争的欧洲企业。

Mistral AI 的三位创始人都拥有在全球顶级科技公司中积累的丰富 AI 研究经验。首席执行官 Arthur Mensch 曾在谷歌 DeepMind 部门工作,首席技术官 Timothée Lacroix 和首席科学家 Guillaume Lample 则曾是 Meta 的核心成员。凭借着强大的技术背景,Mistral AI 的创始团队带领公司迅速发展。

欧洲“DeepSeek”发布了全世界最好的 OCR,网友:蹲蹲中国的免费开源版

值得一提的是,雷峰网(公众号:雷峰网)得知自 2023 年成立以来,Mistral AI 在筹集资金方面取得了显著成绩,目标是将前沿 AI 技术普及给每个人,虽然这一目标并未直接挑战 OpenAI,但它强调了公司对于 AI 开放性的坚定支持。

作为 ChatGPT 的替代品,Mistral AI 推出了聊天助手 Le Chat,并在 iOS 和 Android 上成功上线。在发布后仅两周,Le Chat 的下载量便突破了 100 万次,并一度在 iOS App Store 中登顶法国免费下载榜单。

除此之外,截至 2025 年 2 月,Mistral AI 已筹集了约 10 亿欧元(约 10.4 亿美元)的资金,其中包括几轮股权融资和部分债务融资。尤其值得注意的是,在 2023 年 6 月公司发布首批模型之前,Mistral AI 就成功完成了创纪录的 1.12 亿美元种子轮融资,成为欧洲历史上最大的一轮种子融资,当时公司估值达 2.6 亿美元。

参考链接:

https://mistral.ai/fr/news/mistral-ocr

https://x.com/MistralAI/status/1897694143180112096

雷峰网原创文章,未经授权禁止转载。详情见转载须知。

欧洲“DeepSeek”发布了全世界最好的 OCR,网友:蹲蹲中国的免费开源版

阅读全文
相关推荐

国务院任免国家工作人员

国务院任免国家工作人员
国务院任免国家工作人员。任命王文君女)为国家医疗保障局副局长;任命王志刚为国家宗教事务局副局长。免去王辰的中国工程院副院长职务。 ...

大模型时代下的数字安全答案,藏在一本实战指南里

大模型时代下的数字安全答案,藏在一本实战指南里
作者:郭思编辑:陈彩娴在大模型不断成熟的背景下,企业也日益倾向于在云端大规模应用AI技术。这一进程中,以往可能忽视的数据资源,突显出了前所未有的战略意义,数据的价值评估随之动态调整。与此同时,企业上云 ...

RASP技术,"入侵者"如何成为网络安全"守护神"?

RASP技术,"入侵者"如何成为网络安全"守护神"?
作者丨赖文昕编辑丨陈彩娴应用安全危机四伏2024年的网络安全形势依旧严峻。2月,澳大利亚电信公司 Tangerine 遭遇网络攻击,导致23万人的个人信息泄露;3月,人工智能图像编辑工具 Cutout ...

体育中考「上难度」,视觉 AI 下场「减负」

体育中考「上难度」,视觉 AI 下场「减负」
“组织体育中考30年了,今年是第一年没有遇到12345投诉的考试。”“监考17年,第一次能准点吃饭,提前下班。”上面这些评价,来自今年北京市部分体育中考考场裁判老师。每年3月到5月,是各地学校组织体育 ...

阿里领投首家人形机器人:逐际动力完成亿元 A 轮融资;谷歌 Eureka AI 模型提前曝光丨AI情报局

阿里领投首家人形机器人:逐际动力完成亿元 A 轮融资;谷歌 Eureka AI 模型提前曝光丨AI情报局
今日融资快报通用机器人公司逐际动力完成亿元A轮融资:逐际动力是一家通用机器人公司,专注于具身智能与足式机器人的研发和制造,产品包括人形双足、四轮足机器人及相关软硬件解决方案。创始人张巍是南方科技大学长 ...

上海交大新跑出一家具身智能公司「穹彻智能」

上海交大新跑出一家具身智能公司「穹彻智能」
作者丨郭 思编辑丨陈彩娴AI 科技评论独家获悉:近日,上海交大新跑出了一家机器人公司——上海穹彻智能科技有限公司,定位是具身智能方向,正处于第一轮融资状态,融资金额千万级别。企查查信息显示,该公司于今 ...

从 0 到 1,揭秘中国首个 AI 音乐 SOTA 模型

从 0 到 1,揭秘中国首个 AI 音乐 SOTA 模型
【雷峰网(公众号:雷峰网)】雨果曾经说过:“开启人类智慧宝库的三把钥匙,即数字、字母、音符。”音乐早已成为人类表达情感的最佳载体。但音乐创作是一件门槛很高的事情,因为音乐创作不是某一个人的独角戏,而一 ...

大模型落地,向量数据库能做什么?

大模型落地,向量数据库能做什么?
在保险行业这个海量数据的“聚居地”上,数据库应用已久。近年来,保司数据化转型提速,各类文本、音视频的凭证票证核保及跑批需求不断增加,许多机构便将数据库引入至业务流程中。但是,随着数据库深入保司业务,一 ...

哀悼 !中国计算机视觉领军者、商汤创始人汤晓鸥去世

哀悼 !中国计算机视觉领军者、商汤创始人汤晓鸥去世
12 月 16 日中午雷峰网获悉:上海人工智能实验室主任、商汤科技创始人、香港中文大学信息工程学系教授汤晓鸥去世。经多位独立信源确认,此消息属实,目前等待官方发布讣告。20世纪60年代末,汤晓鸥出生于 ...

AI短剧公司获百度投资;苹果AI将登VisionPro,今秋或将接入谷歌Gemini;上海医院用AI自动生成病历丨AI情报局

AI短剧公司获百度投资;苹果AI将登VisionPro,今秋或将接入谷歌Gemini;上海医院用AI自动生成病历丨AI情报局
融资快报CreativeFitting获百度PreA+轮融资:CreativeFitting井英科技)推出全球首款AI短剧APP,Reel.AI在海外市场正式发布,并迅速登上娱乐应用畅销榜,主创团队获 ...

亮点剧透丨大模型产业应用如何落地,WAIC 探讨技术突破与最新实践

亮点剧透丨大模型产业应用如何落地,WAIC 探讨技术突破与最新实践
以大模型为代表的新一代人工智能技术变革仍在加速迭代,为“新质生产力”的发展注入强劲动力,助力产业智能化升级和经济发展。目前,大模型在产业端,已经开始从任务简单、容错率高的场景向任务复杂、容错率低的场景 ...

独家|杨红霞创业入局“端侧模型”,投后估值 1.5 亿美元

独家|杨红霞创业入局“端侧模型”,投后估值 1.5 亿美元
近日,关于字节跳动大语言模型研发技术专家杨红霞离职创业的事情,坊间传得沸沸扬扬。雷峰网独家获悉,杨红霞已于 5 月下旬正式从字节跳动离职,开始筹备 AI 创业项目。不过,杨红霞不做“大”模型,而是将方 ...
返回顶部