
Chandra
نموذج OCR متقدم مفتوح المصدر للتعرف على النصوص في المستندات المعقدة، يتعامل مع الخط اليدوي، الجداول، المعادلات الرياضية، والنماذج مع الحفاظ على التنسيق الكامل.
التنصيفات: أدوات الذكاء الاصطناعي
نبذة مفصلة عن Chandra
Chandra هو نموذج OCR (التعرف الضوئي على الحروف) متطور من Datalab، مصمم خصيصاً للتعامل مع المستندات الصعبة التي تعجز عنها أدوات OCR التقليدية. يدعم النموذج التعرف على الكتابة اليدوية (بما في ذلك الملاحظات الطبية)، الجداول المعقدة (مع الحفاظ على الخلايا المدمجة)، المعادلات الرياضية (مع تحويلها إلى LaTeX)، النماذج (بما في ذلك مربعات الاختيار وأزرار الراديو)، والتخطيطات متعددة الأعمدة. يوفر Chandra طريقتين للتشغيل: محلياً عبر HuggingFace Transformers، أو عبر خادم vLLM للإنتاجية العالية. يدعم أكثر من 40 لغة، ويخرج النتائج بصيغ Markdown، HTML، أو JSON مع بيانات الموقع (bounding boxes) لكل عنصر. يتوفر كخدمة API مستضافة مع بيئة تجريبية مجانية.
تعلم أكثر عن Chandra
أخر الأخبار و تحديثات حول Chandra
اللغات المدعومة
الإنجليزية
أخر تحديث للصفحة 10 أغسطس، 2026
