Diba STT
تبدیل بلادرنگ گفتار فارسی به متن، داخل مرورگر
Iranian team focused on fine-tuning state-of-the-art AI models for local needs and applications.
We build Diba — an Iranian large language model (LLM) family ما دیبا را میسازیم — یک خانوادهی مدل زبانی بزرگ (LLM) ایرانی
🌐 dibachain.ir · ✉️ info@dibachain.ir · 🤖 Try the Diba agent
Dibachain is an Iranian artificial-intelligence and software company. Our mission is the localization (بومیسازی) of AI for Persian — building AI that genuinely understands the Persian language, Iran, and the needs of Iranian businesses and users, instead of foreign tools that fall short on Farsi.
At the center of this is Diba, our Iranian large language model (LLM) family: efficient, open-weight Persian-first models that understand Farsi natively, know Iran and its history, write code, see images, listen to Persian speech, and search your own documents. They are light enough to run even on modest hardware — offline.
If you are looking for an Iranian LLM, a Persian language model, a Farsi chatbot, Persian speech-to-text, or Persian text embeddings for search and RAG — that is exactly what we build.
The Diba Agent is a single Persian AI assistant that can chat and write code, see images, PDFs and files, listen to your voice (real-time Persian speech-to-text), and search your own documents (RAG). It replies in the language you write in.
Diba-Base, our Iranian LLM, measured against same-size open models on identical Persian, code and Iran-history tests:
For a 4B-class model, Diba leads on code, matches the best on replying in the right language, and is far ahead on Persian knowledge of Iran — where general models are weak.
Diba-mini (~2B) is the small, fast member of the family — Persian and Iran knowledge only, ~1.3 GB on a CPU. Against same-size open models on the same 40 Iran-history questions it answers twice as many as the best peer (20/40 vs 10/40), while always replying in the user's language:
| Model | What it is | Status |
|---|---|---|
| Diba-Base | Iranian LLM — Persian-first chat & code model, runs on CPU (GGUF) | Released |
| Diba-mini | Small Iranian LLM (~2B) — fast, offline Persian assistant for CPUs and edge devices (CPU build) | Released |
| Diba-Embed | Persian text-embedding model for semantic search & RAG | Released |
| Diba-Vision | Vision-language model — sees images and answers in Persian | Released |
| Diba-STT | Persian speech-to-text — real-time, offline, in the browser | Released |
| Diba-Code · Diba-TTS · Diba-Image · Diba-ImageEdit | Code, speech and image models | On the roadmap |
Try Diba: 🤖 Agent (all-in-one) · Chat GPU · Chat CPU · Vision · Speech-to-Text
All delivered on scalable, secure and reliable cloud infrastructure.
دیباچین یک شرکت ایرانیِ هوش مصنوعی و نرمافزار است. مأموریت ما بومیسازی هوش مصنوعی برای زبان فارسی است؛ ساختن هوش مصنوعیای که واقعاً فارسی، ایران و نیازهای کسبوکارها و کاربران ایرانی را میفهمد — بهجای ابزارهای خارجی که در فارسی ضعیف عمل میکنند.
در قلب این کار، دیبا قرار دارد؛ خانوادهی مدل زبانی بزرگ (LLM) ایرانیِ ما: مدلهای کارآمد و متنباز فارسیمحور که فارسی را بهصورت بومی میفهمند، ایران و تاریخش را میشناسند، کد مینویسند، عکس میبینند، گفتار فارسی را میشنوند و در اسناد خودتان جستوجو میکنند. آنقدر سبک هستند که حتی روی سختافزار ساده و آفلاین اجرا شوند.
اگر دنبال یک مدل زبانی ایرانی، مدل زبان فارسی، چتبات فارسی، تبدیل گفتار فارسی به متن یا بردارسازی متن فارسی برای جستوجو و RAG هستید — دقیقاً همان چیزی است که میسازیم.
دیبا ایجنت یک دستیار هوش مصنوعی فارسی است که گفتگو و کدنویسی میکند، عکس، PDF و فایل را میبیند، به صدای شما گوش میدهد (تبدیل بلادرنگ گفتار فارسی به متن) و در اسناد خودتان جستوجو میکند (RAG). به همان زبانی که بنویسید پاسخ میدهد.
دیبا-بیس، مدل زبانی ایرانیِ ما، در برابر مدلهای متنباز هماندازه روی تستهای یکسانِ فارسی، کد و تاریخ ایران:
با توجه به اندازهی ۴ میلیاردی، دیبا در کدنویسی پیشتاز است، در پاسخ به زبان درست همتراز بهترینهاست، و در دانش فارسی دربارهی ایران با اختلاف زیاد جلوتر است؛ جایی که مدلهای عمومی ضعیفاند.
دیبا مینی (حدود ۲ میلیارد پارامتر) عضو کوچک و سریع خانواده است؛ فقط فارسی و شناخت ایران، با حجم حدود ۱٫۳ گیگابایت روی CPU. در همان ۴۰ پرسش تاریخ ایران، دو برابرِ بهترین مدل هماندازه پاسخ درست میدهد (۲۰ در برابر ۱۰ از ۴۰) و همیشه به زبان کاربر پاسخ میدهد:
| مدل | چیست | وضعیت |
|---|---|---|
| Diba-Base | مدل زبانی ایرانی — گفتگو و کدنویسی فارسیمحور، قابل اجرا روی CPU (GGUF) | منتشرشده |
| Diba-mini | مدل زبانی کوچک ایرانی (حدود ۲ میلیارد) — دستیار فارسیِ سریع و آفلاین برای CPU و دستگاههای لبه (نسخهی CPU) | منتشرشده |
| Diba-Embed | مدل بردارسازی متن فارسی برای جستوجوی معنایی و RAG | منتشرشده |
| Diba-Vision | مدل بینایی-زبانی — عکس را میبیند و فارسی جواب میدهد | منتشرشده |
| Diba-STT | تبدیل گفتار فارسی به متن — بلادرنگ، آفلاین، در مرورگر | منتشرشده |
| Diba-Code · Diba-TTS · Diba-Image · Diba-ImageEdit | مدلهای کد، گفتار و تصویر | در نقشهی راه |
امتحان دیبا: 🤖 ایجنت (همهکاره) · چت GPU · چت CPU · بینایی · گفتار به متن
۱. مشاورهی هوش مصنوعی و استراتژی کسبوکار: تحلیل فرآیندها، شناسایی فرصتهای اتوماسیون و هوش مصنوعی، و نقشهی راه روشن برای اجرا. ۲. توسعهی راهکارهای سفارشی: نرمافزار اختصاصی، CRM و ERP هوشمند، چتبات و دستیار هوشمند، و داشبورد مدیریتی. ۳. تحول دیجیتال و اتوماسیون: خودکارسازی فرآیندها، یکپارچهسازی سیستمها، و زیرساخت ابری امن و مقیاسپذیر. ۴. تحقیق و توسعهی مدلهای زبانی: پژوهش در حوزهی مدلهای زبانی بزرگ ایرانی و فارسی، توسعهی مدلهای کوچک و کارآمد، و ارائهی راهکارهای مبتنی بر مدل.
همهی راهکارها بر بستر زیرساخت ابری امن، پایدار و مقیاسپذیر ارائه میشوند.
دیباچین · Dibachain — dibachain.ir · info@dibachain.ir
Iranian LLM · Persian language model · هوش مصنوعی ایرانی · بومیسازی هوش مصنوعی · مدل زبانی فارسی