نمایش نوار کناری

DeepSeek OCR

https://cdn.i-scmp.com/sites/default/files/styles/652x446/public/d8/images/canvas/2025/10/20/a3c838ce-bac9-421d-8f8b-7cc0dcdbb0be_dd6b806e.jpg?itok=5HlUGfel&v=1760963833DeepSeek‑OCR

منبع: مورنیگ پست

تاریخ: 9 آگوست

شرکت DeepSeek، استارتاپ چینی حوزه هوش مصنوعی، مدل چندرسانه‌ای جدیدی به‌نام DeepSeek‑OCR را عرضه کرده که از قدرت بینایی ماشین (vision) برای فشرده‌سازی ورودی‌های متنی بهره می‌برد.
این مدل بازمتن (open-source) از پلتفرم‌هایی مثل Hugging Face و GitHub در دسترس است.
بنابر گزارش، با استفاده از ترکیب “انتکدِر بینایی” (vision encoder) و مبدل متنی، این سیستم توانسته تعداد “توکن‌ها” (کوچک‌ترین واحد پردازش متن) را ۷ تا ۲۰ برابر کاهش دهد؛ یعنی متن‌های بسیار بزرگ‌تر را با هزینه محاسباتی بسیار کم‌تر پردازش کند.
بدین ترتیب، مدل‌های زبان بزرگ (LLM) می‌توانند اسناد بسیار طولانی یا مجموعه داده‌های حجیم را با کارایی بهتر و هزینه کمتر مدیریت کنند.

 

لینک:

https://www.scmp.com/print/tech/tech-trends/article/3329707/deepseek-unveils-multimodal-ai-model-uses-visual-perception-compress-text-input

 

 

نوشتن دیدگاه

اگر تصمیم به تغییر و شروع یک حرکت جدی گرفتی، صدرا تا آخر کنارته…!

صدرا،
شروعی برای رشد و پرورش استعدادهای شما