PP‑OCRv6 86,2 %-os detektálási pontossággal, 50 nyelven
A PP‑OCRv6 medium modell +4,6 %-kal javítja a szövegdetektálást és +5,1 %-kal növeli a karakterfelismerést a korábbi PP‑OCRv5‑hez képest — a PaddlePaddle szerint.

Mire képes a modell
A PP‑OCRv6_medium 86,2 %-os detektálási H‑mean és 83,2 %-os felismerési pontosságot ér el, ami 4,6 százalékpontos javulást jelent a detektálásban és 5,1‑et a felismertetésben a PP‑OCRv5_serverhez képest — írja a Hugging Face. A számok a PaddleOCR belső benchmarkjei alapján vannak, független ellenőrzés hiányzik.
Architektúra és új elemek
Az új generáció egységes PPLCNetV4 hátlappal működik, a szövegdetektálást a RepLKFPN könnyű nagy‑kernelű piramis hálózat biztosítja, a felismerést pedig az EncoderWithLightSVTR kombinálja, amely helyi kontextust és globális figyelmet egyesít.
Kapcsolódó: Nvidia Nemotron OCR v2
Modellméretek és nyelvi lefedettség
Három méret közül választhat: a PP‑OCRv6_tiny 1,5 M paraméterrel 80,6 %-os detektálást és 73,5 %-os felismerést nyújt, a PP‑OCRv6_small 7,7 M paraméterrel 84,1 % és 81,3 % pontosságot ér el, a PP‑OCRv6_medium 34,5 M paraméterrel 86,2 % és 83,2 % értékeket produkál. A medium és a small változat egy modellcsaládban 50 nyelvet támogat, köztük kínai, japán és 46 latin‑betűs nyelvet.
Kapcsolódó: Hugging Face TRL v1.0
Rugalmas telepítési lehetőségek
A modell három futtatási háttérrel kompatibilis: a Paddle Inference natív környezet, a Transformers backend a Hugging Face‑hez, valamint az ONNX Runtime portabilis megoldás, így a fejlesztők könnyen integrálhatják különböző platformokon.
Kapcsolódó: Photoroom képgenerátor modell
Alkalmazási területek
A tiny változat ideális szél‑eszközökön és alacsony késleltetésű demókon, a small változat mobil‑ és asztali alkalmazásokhoz, a medium változat pedig szerver‑oldali, ipari címkék és dokumentum‑beolvasás feladataira alkalmas, ahol a magas pontosság kulcsfontosságú.
Kapcsolódó: DeepSeek multimodális modell
Elérhetőség
A PP‑OCRv6 június 22‑én jelent meg a Hugging Face Hub‑on, a PaddlePaddle ingyenes letöltést biztosít, a modellek safetensors, Paddle‑inference és ONNX formátumban érhetők el.
Kapcsolódó: NVIDIA Nemotron 3 Ultra