Skip to content
Merged
Show file tree
Hide file tree
Changes from all commits
Commits
File filter

Filter by extension

Filter by extension

Conversations
Failed to load comments.
Loading
Jump to
Jump to file
Failed to load files.
Loading
Diff view
Diff view
11 changes: 10 additions & 1 deletion README.md
Original file line number Diff line number Diff line change
Expand Up @@ -62,7 +62,14 @@ English | [简体中文](./readme/README_cn.md) | [繁體中文](./readme/README

## 📣 Recent updates

### 🔥 2026.06.11: Release of PaddleOCR 3.7.0
### 🔥 2026.07.22: HPD-Parsing is now available
- **HPD-Parsing** is a lightweight vision-language model designed for high-throughput document parsing. It adopts a hierarchical parallel decoding paradigm and Progressive Multi-Token Prediction (P-MTP), achieving a peak throughput of 4,752 tokens/s on public benchmarks while maintaining competitive parsing accuracy.
- HPD-Parsing supports both OpenAI-compatible serving and local inference through a customized vLLM runtime, making it suitable for document parsing scenarios with high demands on inference efficiency and deployment throughput.
- See the [HPD-Parsing usage tutorial](https://www.paddleocr.ai/latest/en/version3.x/pipeline_usage/HPD-Parsing.html) for environment setup, serving, and local inference instructions.

<details>
<summary><strong>2026.06.11: Release of PaddleOCR 3.7.0</strong></summary>

- PP-OCRv6 highlights:

- **Accuracy boost**: Medium tier achieves +4.6% detection and +5.1% recognition over PP-OCRv5_server, surpassing mainstream VLMs (Qwen3-VL-235B, GPT-5.5) with only 34.5M parameters.
Expand All @@ -72,6 +79,8 @@ English | [简体中文](./readme/README_cn.md) | [繁體中文](./readme/README
- **Three tiers for all scenarios**: tiny (1.5M) / small (7.7M) / medium (34.5M) for edge, mobile, and server deployment.
- **Model availability**: All models are available on [HuggingFace](https://huggingface.co/collections/PaddlePaddle/pp-ocrv6) and [ModelScope](https://www.modelscope.cn/collections/PaddlePaddle/PP-OCRv6).

</details>

<details>
<summary><strong>2026.05.28: Release of PaddleOCR 3.6.0</strong></summary>

Expand Down
11 changes: 10 additions & 1 deletion readme/README_ar.md
Original file line number Diff line number Diff line change
Expand Up @@ -63,7 +63,14 @@

## 📣 آخر التحديثات

### 🔥 2026.06.11: إصدار PaddleOCR 3.7.0
### 🔥 2026.07.22: أصبح HPD-Parsing متاحاً
- **HPD-Parsing** هو نموذج رؤية-لغة خفيف مصمم لتحليل المستندات عالي الإنتاجية. يعتمد على نموذج فك ترميز هرمي متوازي و Progressive Multi-Token Prediction (P-MTP)، ويحقق ذروة إنتاجية تبلغ 4,752 tokens/s على المعايير المرجعية العامة مع الحفاظ على دقة تحليل تنافسية.
- يدعم HPD-Parsing الاستدلال الخدمي المتوافق مع OpenAI والاستدلال المحلي عبر runtime مخصص من vLLM، مما يجعله مناسباً لسيناريوهات تحليل المستندات ذات المتطلبات العالية لكفاءة الاستدلال وإنتاجية النشر.
- راجع [دليل استخدام HPD-Parsing](https://www.paddleocr.ai/latest/en/version3.x/pipeline_usage/HPD-Parsing.html) لمعرفة إعداد البيئة والاستدلال الخدمي والاستدلال المحلي.

<details>
<summary><strong>2026.06.11: إصدار PaddleOCR 3.7.0</strong></summary>

- أبرز مزايا PP-OCRv6:

- **تحسين الدقة**: يحقق الطراز medium تحسيناً +4.6% في الكشف و+5.1% في التعرف مقارنة بـ PP-OCRv5_server، متفوقاً على النماذج اللغوية البصرية الرئيسية بـ 34.5M معلمة فقط.
Expand All @@ -73,6 +80,8 @@
- **ثلاثة مستويات لجميع السيناريوهات**: tiny (1.5M) / small (7.7M) / medium (34.5M) للأجهزة الطرفية والمحمولة والخوادم.
- **توفر النماذج**: جميع النماذج متاحة على [HuggingFace](https://huggingface.co/collections/PaddlePaddle/pp-ocrv6) و [ModelScope](https://www.modelscope.cn/collections/PaddlePaddle/PP-OCRv6).

</details>

<details>
<summary><strong>2026.05.28: إصدار PaddleOCR 3.6.0</strong></summary>

Expand Down
11 changes: 10 additions & 1 deletion readme/README_cn.md
Original file line number Diff line number Diff line change
Expand Up @@ -61,7 +61,14 @@

## 📣 最新动态

### 🔥 2026.06.11: PaddleOCR 3.7.0 发布
### 🔥 2026.07.22: HPD-Parsing 新增上线
- **HPD-Parsing** 是面向高吞吐文档解析的轻量级视觉语言模型。它采用层级并行解码范式和渐进式多 token 预测(P-MTP),在公开基准上达到 4,752 tokens/s 的峰值吞吐,同时保持有竞争力的解析精度。
- HPD-Parsing 基于定制版 vLLM 运行时,支持 OpenAI 兼容服务化调用和本地推理,适用于对推理效率和部署吞吐要求较高的文档解析场景。
- 查看 [HPD-Parsing 使用教程](https://www.paddleocr.ai/latest/version3.x/pipeline_usage/HPD-Parsing.html),了解环境准备、服务化部署与本地推理说明。

<details>
<summary><strong>2026.06.11: PaddleOCR 3.7.0 发布</strong></summary>

- PP-OCRv6 核心亮点如下:

- **精度全面提升**:medium 档相比 PP-OCRv5_server 检测精度提升 4.6%、识别精度提升 5.1%,以仅 34.5M 参数超越 Qwen3-VL-235B、GPT-5.5 等主流视觉语言大模型。
Expand All @@ -71,6 +78,8 @@
- **三档模型覆盖全场景**:tiny(1.5M)/ small(7.7M)/ medium(34.5M)分别面向端侧/移动端/服务端部署。
- **模型获取**:所有模型均可通过 [HuggingFace](https://huggingface.co/collections/PaddlePaddle/pp-ocrv6) 和 [ModelScope](https://www.modelscope.cn/collections/PaddlePaddle/PP-OCRv6) 获取。

</details>

<details>
<summary><strong>2026.05.28: PaddleOCR 3.6.0 发布</strong></summary>

Expand Down
11 changes: 10 additions & 1 deletion readme/README_es.md
Original file line number Diff line number Diff line change
Expand Up @@ -61,7 +61,14 @@

## 📣 Actualizaciones recientes

### 🔥 2026.06.11: Lanzamiento de PaddleOCR 3.7.0
### 🔥 2026.07.22: HPD-Parsing ya está disponible
- **HPD-Parsing** es un modelo ligero de visión-lenguaje diseñado para el análisis de documentos de alto rendimiento. Adopta un paradigma de decodificación paralela jerárquica y Progressive Multi-Token Prediction (P-MTP), alcanzando un rendimiento máximo de 4,752 tokens/s en benchmarks públicos mientras mantiene una precisión de análisis competitiva.
- HPD-Parsing admite serving compatible con OpenAI e inferencia local mediante un runtime vLLM personalizado, por lo que es adecuado para escenarios de análisis de documentos con altas exigencias de eficiencia de inferencia y rendimiento de despliegue.
- Consulta el [tutorial de uso de HPD-Parsing](https://www.paddleocr.ai/latest/en/version3.x/pipeline_usage/HPD-Parsing.html) para la preparación del entorno, el serving y la inferencia local.

<details>
<summary><strong>2026.06.11: Lanzamiento de PaddleOCR 3.7.0</strong></summary>

- Aspectos destacados de PP-OCRv6:

- **Mejora de precisión**: El nivel medium logra +4.6% en detección y +5.1% en reconocimiento sobre PP-OCRv5_server, superando a los principales VLMs (Qwen3-VL-235B, GPT-5.5) con solo 34.5M parámetros.
Expand All @@ -71,6 +78,8 @@
- **Tres niveles para todos los escenarios**: tiny (1.5M) / small (7.7M) / medium (34.5M) para despliegue en edge, móvil y servidor.
- **Disponibilidad de modelos**: Todos los modelos están disponibles en [HuggingFace](https://huggingface.co/collections/PaddlePaddle/pp-ocrv6) y [ModelScope](https://www.modelscope.cn/collections/PaddlePaddle/PP-OCRv6).

</details>

<details>
<summary><strong>2026.05.28: Lanzamiento de PaddleOCR 3.6.0</strong></summary>

Expand Down
11 changes: 10 additions & 1 deletion readme/README_fr.md
Original file line number Diff line number Diff line change
Expand Up @@ -61,7 +61,14 @@

## 📣 Mises à jour récentes

### 🔥 2026.06.11 : Publication de PaddleOCR 3.7.0
### 🔥 2026.07.22 : HPD-Parsing est disponible
- **HPD-Parsing** est un modèle vision-langage léger conçu pour l'analyse de documents à haut débit. Il adopte un décodage parallèle hiérarchique et Progressive Multi-Token Prediction (P-MTP), atteignant un débit maximal de 4,752 tokens/s sur des benchmarks publics tout en conservant une précision d'analyse compétitive.
- HPD-Parsing prend en charge le serving compatible OpenAI et l'inférence locale via un runtime vLLM personnalisé, ce qui le rend adapté aux scénarios d'analyse de documents exigeants en efficacité d'inférence et en débit de déploiement.
- Consultez le [tutoriel d'utilisation de HPD-Parsing](https://www.paddleocr.ai/latest/en/version3.x/pipeline_usage/HPD-Parsing.html) pour la préparation de l'environnement, le serving et l'inférence locale.

<details>
<summary><strong>2026.06.11 : Publication de PaddleOCR 3.7.0</strong></summary>

- Points forts de PP-OCRv6 :

- **Amélioration de la précision** : Le niveau medium atteint +4.6% en détection et +5.1% en reconnaissance par rapport à PP-OCRv5_server, surpassant les principaux VLMs (Qwen3-VL-235B, GPT-5.5) avec seulement 34.5M paramètres.
Expand All @@ -71,6 +78,8 @@
- **Trois niveaux pour tous les scénarios** : tiny (1.5M) / small (7.7M) / medium (34.5M) pour le déploiement edge, mobile et serveur.
- **Disponibilité des modèles** : Tous les modèles sont disponibles sur [HuggingFace](https://huggingface.co/collections/PaddlePaddle/pp-ocrv6) et [ModelScope](https://www.modelscope.cn/collections/PaddlePaddle/PP-OCRv6).

</details>

<details>
<summary><strong>2026.05.28 : Publication de PaddleOCR 3.6.0</strong></summary>

Expand Down
11 changes: 10 additions & 1 deletion readme/README_ja.md
Original file line number Diff line number Diff line change
Expand Up @@ -62,7 +62,14 @@

## 📣 最新情報

### 🔥 2026.06.11: PaddleOCR 3.7.0リリース
### 🔥 2026.07.22: HPD-Parsing が利用可能になりました
- **HPD-Parsing** は、高スループットな文書解析向けに設計された軽量な視覚言語モデルです。階層型並列デコードと Progressive Multi-Token Prediction(P-MTP)を採用し、競争力のある解析精度を維持しながら、公開ベンチマークで最大 4,752 tokens/s のスループットを達成します。
- HPD-Parsing はカスタム vLLM ランタイムを通じて、OpenAI 互換のサービングとローカル推論の両方をサポートし、推論効率とデプロイスループットが重視される文書解析シナリオに適しています。
- 環境構築、サービング、ローカル推論の手順は [HPD-Parsing 使用チュートリアル](https://www.paddleocr.ai/latest/en/version3.x/pipeline_usage/HPD-Parsing.html) を参照してください。

<details>
<summary><strong>2026.06.11: PaddleOCR 3.7.0リリース</strong></summary>

- PP-OCRv6の主な特徴:

- **精度向上**: mediumティアはPP-OCRv5_serverと比較して検出+4.6%、認識+5.1%を達成、34.5Mパラメータのみで主要VLM(Qwen3-VL-235B、GPT-5.5)を上回る。
Expand All @@ -72,6 +79,8 @@
- **全シナリオ対応3ティア**: tiny(1.5M)/ small(7.7M)/ medium(34.5M)でエッジからサーバーまで対応。
- **モデル入手**: 全モデルは [HuggingFace](https://huggingface.co/collections/PaddlePaddle/pp-ocrv6) および [ModelScope](https://www.modelscope.cn/collections/PaddlePaddle/PP-OCRv6) で公開中。

</details>

<details>
<summary><strong>2026.05.28: PaddleOCR 3.6.0リリース</strong></summary>

Expand Down
11 changes: 10 additions & 1 deletion readme/README_ko.md
Original file line number Diff line number Diff line change
Expand Up @@ -62,7 +62,14 @@

## 📣 최근 업데이트

### 🔥 2026.06.11: PaddleOCR 3.7.0 출시
### 🔥 2026.07.22: HPD-Parsing 사용 가능
- **HPD-Parsing** 은 높은 처리량의 문서 분석을 위해 설계된 경량 비전-언어 모델입니다. 계층적 병렬 디코딩 패러다임과 Progressive Multi-Token Prediction(P-MTP)을 적용하여, 경쟁력 있는 분석 정확도를 유지하면서 공개 벤치마크에서 최대 4,752 tokens/s 처리량을 달성합니다.
- HPD-Parsing은 맞춤형 vLLM 런타임을 통해 OpenAI 호환 서빙과 로컬 추론을 모두 지원하며, 추론 효율과 배포 처리량 요구가 높은 문서 분석 시나리오에 적합합니다.
- 환경 설정, 서빙, 로컬 추론 방법은 [HPD-Parsing 사용 튜토리얼](https://www.paddleocr.ai/latest/en/version3.x/pipeline_usage/HPD-Parsing.html)을 참고하세요.

<details>
<summary><strong>2026.06.11: PaddleOCR 3.7.0 출시</strong></summary>

- PP-OCRv6 주요 특징:

- **정확도 향상**: medium 티어가 PP-OCRv5_server 대비 검출 +4.6%, 인식 +5.1% 달성, 34.5M 파라미터만으로 주류 VLM(Qwen3-VL-235B, GPT-5.5)을 능가.
Expand All @@ -72,6 +79,8 @@
- **전 시나리오 3단계 모델**: tiny(1.5M) / small(7.7M) / medium(34.5M)으로 엣지부터 서버까지 대응.
- **모델 다운로드**: 모든 모델은 [HuggingFace](https://huggingface.co/collections/PaddlePaddle/pp-ocrv6) 및 [ModelScope](https://www.modelscope.cn/collections/PaddlePaddle/PP-OCRv6)에서 제공됩니다.

</details>

<details>
<summary><strong>2026.05.28: PaddleOCR 3.6.0 출시</strong></summary>

Expand Down
11 changes: 10 additions & 1 deletion readme/README_ru.md
Original file line number Diff line number Diff line change
Expand Up @@ -61,7 +61,14 @@

## 📣 Последние обновления

### 🔥 2026.06.11: Выпуск PaddleOCR 3.7.0
### 🔥 2026.07.22: HPD-Parsing теперь доступен
- **HPD-Parsing** — это легкая vision-language модель для высокопроизводительного разбора документов. Она использует иерархическое параллельное декодирование и Progressive Multi-Token Prediction (P-MTP), достигая пикового throughput 4,752 tokens/s на публичных бенчмарках при сохранении конкурентной точности разбора.
- HPD-Parsing поддерживает OpenAI-совместимый serving и локальный инференс через кастомизированный runtime vLLM, что делает его подходящим для сценариев разбора документов с высокими требованиями к эффективности инференса и throughput развертывания.
- См. [руководство по использованию HPD-Parsing](https://www.paddleocr.ai/latest/en/version3.x/pipeline_usage/HPD-Parsing.html) для настройки окружения, serving и локального инференса.

<details>
<summary><strong>2026.06.11: Выпуск PaddleOCR 3.7.0</strong></summary>

- Ключевые особенности PP-OCRv6:

- **Повышение точности**: уровень medium достигает +4.6% детекции и +5.1% распознавания по сравнению с PP-OCRv5_server, превосходя ведущие VLM (Qwen3-VL-235B, GPT-5.5) с всего 34.5M параметрами.
Expand All @@ -71,6 +78,8 @@
- **Три уровня для всех сценариев**: tiny (1.5M) / small (7.7M) / medium (34.5M) для периферии, мобильных устройств и серверов.
- **Доступность моделей**: Все модели доступны на [HuggingFace](https://huggingface.co/collections/PaddlePaddle/pp-ocrv6) и [ModelScope](https://www.modelscope.cn/collections/PaddlePaddle/PP-OCRv6).

</details>

<details>
<summary><strong>2026.05.28: Выпуск PaddleOCR 3.6.0</strong></summary>

Expand Down
11 changes: 10 additions & 1 deletion readme/README_tcn.md
Original file line number Diff line number Diff line change
Expand Up @@ -60,7 +60,14 @@

## 📣 最新動態

### 🔥 2026.06.11: PaddleOCR 3.7.0 發布
### 🔥 2026.07.22: HPD-Parsing 新增上線
- **HPD-Parsing** 是面向高吞吐文檔解析的輕量級視覺語言模型。它採用層級並行解碼範式和漸進式多 token 預測(P-MTP),在公開基準上達到 4,752 tokens/s 的峰值吞吐,同時保持具競爭力的解析精度。
- HPD-Parsing 基於定制版 vLLM 運行時,支持 OpenAI 兼容服務化調用和本地推理,適用於對推理效率和部署吞吐要求較高的文檔解析場景。
- 查看 [HPD-Parsing 使用教程](https://www.paddleocr.ai/latest/version3.x/pipeline_usage/HPD-Parsing.html),了解環境準備、服務化部署與本地推理說明。

<details>
<summary><strong>2026.06.11: PaddleOCR 3.7.0 發布</strong></summary>

- PP-OCRv6 核心亮點如下:

- **精度全面提升**:medium 檔相比 PP-OCRv5_server 檢測精度提升 4.6%、識別精度提升 5.1%,以僅 34.5M 參數超越 Qwen3-VL-235B、GPT-5.5 等主流視覺語言大模型。
Expand All @@ -70,6 +77,8 @@
- **三檔模型覆蓋全場景**:tiny(1.5M)/ small(7.7M)/ medium(34.5M)分別面向端側/移動端/服務端部署。
- **模型取得**:所有模型均可透過 [HuggingFace](https://huggingface.co/collections/PaddlePaddle/pp-ocrv6) 和 [ModelScope](https://www.modelscope.cn/collections/PaddlePaddle/PP-OCRv6) 取得。

</details>

<details>
<summary><strong>2026.05.28: PaddleOCR 3.6.0 發布</strong></summary>

Expand Down