
Chandra
نموذج OCR متقدم مفتوح المصدر للتعرف على النصوص في المستندات المعقدة، يتعامل مع الخط اليدوي، الجداول، المعادلات الرياضية، والنماذج مع الحفاظ على التنسيق الكامل.
التنصيفات: أدوات الذكاء الاصطناعي
Detailed overview of Chandra
Chandra هو نموذج OCR (التعرف الضوئي على الحروف) متطور من Datalab، مصمم خصيصاً للتعامل مع المستندات الصعبة التي تعجز عنها أدوات OCR التقليدية. يدعم النموذج التعرف على الكتابة اليدوية (بما في ذلك الملاحظات الطبية)، الجداول المعقدة (مع الحفاظ على الخلايا المدمجة)، المعادلات الرياضية (مع تحويلها إلى LaTeX)، النماذج (بما في ذلك مربعات الاختيار وأزرار الراديو)، والتخطيطات متعددة الأعمدة. يوفر Chandra طريقتين للتشغيل: محلياً عبر HuggingFace Transformers، أو عبر خادم vLLM للإنتاجية العالية. يدعم أكثر من 40 لغة، ويخرج النتائج بصيغ Markdown، HTML، أو JSON مع بيانات الموقع (bounding boxes) لكل عنصر. يتوفر كخدمة API مستضافة مع بيئة تجريبية مجانية.
Learn more about Chandra
أخر الأخبار و تحديثات حول Chandra
اللغات المدعومة
الإنجليزية
أخر تحديث للصفحة 10 August، 2026
