هوش مصنوعی دیپ سیک چیست و چگونه کار می‌کند؟

هوش مصنوعی دیپ سیک مجموعه‌ای از مدل‌های زبانی بزرگ ساخت یک شرکت چینی است که هم به‌صورت چت‌بات رایگان در دسترس عموم قرار دارد و هم وزن مدل‌هایش را برای دانلود منتشر می‌کند. اسم این سرویس «جست‌وجوی عمیق» معنی می‌دهد و همین یک برداشت اشتباه رایج ساخته است: دیپ‌سیک موتور جست‌وجو نیست. یک دستیار گفت‌وگویی است که متن می‌نویسد، کد تولید می‌کند، مسئله‌ی ریاضی حل می‌کند و می‌تواند فایل‌های طولانی را بخواند و خلاصه کند.


دیپ‌سیک را چه کسی ساخته است؟

شرکت دیپ‌سیک در ژوئیه‌ی ۲۰۲۳ در شهر هانگژوی چین و به دست لیانگ ون‌فنگ تأسیس شد. سرمایه‌ی آن از صندوق سرمایه‌گذاری کمّی High-Flyer می‌آید که ون‌فنگ یکی از بنیان‌گذارانش است (منبع: پروفایل فوربس).

نام این شرکت در ژانویه‌ی ۲۰۲۵ و با انتشار مدل R1 سر زبان‌ها افتاد. تیم سازنده در مقاله‌ی فنی نوشت که هزینه‌ی توان پردازشی آموزش مدل کمتر از ۶ میلیون دلار بوده، رقمی که کنار بودجه‌های چندمیلیارددلاری شرکت‌های آمریکایی بسیار کوچک به نظر می‌رسید (گزارش الجزیره، ژانویه‌ی ۲۰۲۵). مارک اندریسن، سرمایه‌گذار سیلیکون‌ولی، آن را «لحظه‌ی اسپوتنیکِ هوش مصنوعی» نامید.

نکته‌ی مهم‌تر برای کاربر عادی این بود که دیپ‌سیک مدل R1 را با مجوز MIT منتشر کرد؛ یعنی هر کسی اجازه دارد وزن‌ها را دانلود کند، تغییر دهد و حتی تجاری استفاده کند (اعلام رسمی دیپ‌سیک، ۲۰ ژانویه‌ی ۲۰۲۵).


هوش مصنوعی دیپ سیک چگونه کار می‌کند؟

مثل بقیه‌ی مدل‌های زبانی، دیپ‌سیک متن را توکن‌به‌توکن پیش‌بینی می‌کند. توکن تکه‌ای از متن است، چیزی در حد یک کلمه یا بخشی از آن. اما چهار تصمیم فنی باعث شده این مدل‌ها با هزینه‌ی کمتری کار کنند:

  1. پیش‌آموزش. مدل حجم عظیمی از متن را می‌خواند و الگوی زبان را یاد می‌گیرد. دیپ‌سیک برای نسخه‌ی V3 عدد ۱۴.۸ تریلیون توکن را اعلام کرده است.

  2. پس‌آموزش با یادگیری تقویتی. در این مرحله به مدل پاداش داده می‌شود وقتی به جواب درست می‌رسد. دیپ‌سیک اعلام کرده که R1 با یادگیری تقویتی در مقیاس بزرگ و با کمترین داده‌ی برچسب‌خورده آموزش دیده. خروجی این کار همان چیزی است که موقع کار با مدل می‌بینید: قبل از پاسخ نهایی، مسئله را مرحله‌به‌مرحله می‌شکافد.

  3. معماری ترکیب متخصص‌ها یا MoE. تصور کنید ساختمانی پر از کارشناس دارید. برای هر پرونده لازم نیست همه سر کار بیایند؛ فقط دو سه نفری که به آن پرونده مربوط‌اند فعال می‌شوند. در V4-Pro از مجموع ۱.۶ تریلیون پارامتر، برای تولید هر توکن حدود ۴۹ میلیارد پارامتر فعال می‌شود (اعلام رسمی دیپ‌سیک، ۲۴ آوریل ۲۰۲۶). هزینه‌ی اجرا به همان نسبت پایین می‌آید.

  4. شیوه‌ی خواندن متن‌های طولانی. دیپ‌سیک در نسل چهارم از روشی به نام DeepSeek Sparse Attention به‌همراه فشرده‌سازی توکنی استفاده کرده تا مدل بتواند متن بلند را با حافظه و محاسبات کمتری پردازش کند. پنجره‌ی متن هر دو مدل این نسل یک میلیون توکن است.


حالت تفکر با حالت عادی چه فرقی دارد؟

در حالت تفکر، مدل قبل از نوشتن جواب یک زنجیره‌ی استدلال برای خودش تولید می‌کند و بعد نتیجه را می‌نویسد. در وب و اپلیکیشن این دو حالت با نام Expert Mode و Instant Mode انتخاب می‌شوند و در API سه سطح تلاش فکری وجود دارد: low برای کارهای ساده، high برای کارهای روزمره و max برای مسائل پیچیده (اعلام رسمی دیپ‌سیک، ۱۳ آگوست ۲۰۲۶).

کِی به دردتان می‌خورد؟ وقتی مسئله چند مرحله دارد: پیدا کردن باگ در کد، حل یک مسئله‌ی ریاضی، مقایسه‌ی چند قرارداد. برای «پایتخت ژاپن کجاست» حالت تفکر فقط وقت و توکن مصرف می‌کند.


کدام مدل دیپ‌سیک را انتخاب کنیم: V4-Pro یا V4-Flash؟

اگر کارتان روزمره است با Flash شروع کنید و فقط وقتی جواب رضایت‌بخش نبود سراغ Pro بروید. تفاوت اصلی در اندازه و سرعت است، نه در قابلیت‌های پایه.

مدل

پارامتر کل / فعال

پنجره‌ی متن

مناسب برای

DeepSeek-V4-Pro

۱.۶ تریلیون / ۴۹ میلیارد

۱ میلیون توکن

کارهای پیچیده، برنامه‌نویسی، ایجنت

DeepSeek-V4-Flash

۲۸۴ میلیارد / ۱۳ میلیارد

۱ میلیون توکن

پاسخ سریع، کار روزمره، هزینه‌ی کمتر

نسل قبلی هم هنوز قابل دانلود است؛ V3 با ۶۷۱ میلیارد پارامتر کل و ۳۷ میلیارد پارامتر فعال. اما نام‌های قدیمی در API، یعنی deepseek-chat و deepseek-reasoner، از ۲۴ ژوئیه‌ی ۲۰۲۶ بازنشسته شده‌اند و دیگر کار نمی‌کنند.


تصور غلط رایج: «آموزش دیپ‌سیک فقط ۶ میلیون دلار خرج برداشت»

این عدد واقعی است ولی فقط یک تکه از ماجرا را نشان می‌دهد. به گزارش CNBC، دیپ‌سیک در مقاله‌ی خود رقم ۵.۵۷۶ میلیون دلار را برای «آموزش رسمی» مدل نوشت و در همان مقاله تصریح کرد که پژوهش‌های قبلی و آزمایش‌های معماری و داده در این عدد حساب نشده است. مؤسسه‌ی تحلیلی SemiAnalysis بعداً تخمین زد که کل هزینه‌ی سرورهای دیپ‌سیک حدود ۱.۶ میلیارد دلار بوده و نزدیک ۹۴۴ میلیون دلار آن صرف راه‌اندازی و نگهداری خوشه‌های پردازشی شده است.

پس ۶ میلیون دلار هزینه‌ی یک دور آموزش نهایی است، نه قیمت ساختن این شرکت. دستاورد دیپ‌سیک واقعی است، ولی نه به آن معنایی که در بسیاری از خبرها تکرار شد.


چطور از دیپ‌سیک استفاده کنیم؟

چهار راه وجود دارد و سه‌تایش برای کاربر عادی کافی است:

  1. نسخه‌ی وب در نشانی chat.deepseek.com. ثبت‌نام با ایمیل و استفاده‌ی رایگان.

  2. اپلیکیشن موبایل که همان حساب کاربری وب را می‌پذیرد.

  3. API برای توسعه‌دهنده‌ها. کلید را از platform.deepseek.com می‌گیرید و نام مدل را deepseek-v4-pro یا deepseek-v4-flash می‌گذارید. این API با فرمت OpenAI و Anthropic سازگار است، پس کد قبلی‌تان معمولاً با تغییر یک خط کار می‌کند.

  4. اجرای محلی روی سرور خودتان، از روی وزن‌های منتشرشده در هاگینگ‌فیس با مجوز MIT.

قیمت API از ۱۶ آگوست ۲۰۲۶ دو نرخی شده است: ساعت‌های اوج و غیراوج، که نرخ غیراوج ۵۰ درصد کمتر از اوج است (اعلام رسمی دیپ‌سیک). چون این نرخ‌ها تغییر می‌کنند، قبل از برنامه‌ریزی هزینه حتماً صفحه‌ی قیمت رسمی را ببینید.

پرداخت در پلتفرم رسمی به کارت بین‌المللی نیاز دارد. اگر کارت ندارید، می‌توانید از طریق صفحه‌ی اکانت دیپ‌سیک آسیاتکین اکانت یا اعتبار API تهیه کنید.


محدودیت‌هایی که بهتر است بدانید

مدل گاهی با لحن مطمئن اشتباه می‌گوید. هر عدد، تاریخ، آدرس یا منبعی که برایتان مهم است را جای دیگری چک کنید. این محدودیت مخصوص دیپ‌سیک نیست و در همه‌ی مدل‌های زبانی دیده می‌شود.

اطلاعات حساس را داخل چت نگذارید: رمز عبور، کد ملی، متن کامل قرارداد. هر چیزی که تایپ می‌کنید روی سرور شرکت پردازش می‌شود.

درباره‌ی کیفیت فارسی هم دیپ‌سیک در اعلام‌های رسمی‌اش سنجه‌ی جداگانه‌ای منتشر نکرده است. اگر قرار است روی متن فارسی کار جدی انجام دهید، اول با سه چهار نمونه‌ی واقعی خودتان تستش کنید.


پرسش‌های پرتکرار

دیپ سیک رایگان است؟

نسخه‌ی وب و اپلیکیشن رایگان است و برای استفاده‌ی شخصی محدودیت پرداخت ندارد. API جداگانه و بر اساس مصرف توکن حساب می‌شود.

دیپ سیک بهتر است یا چت جی پی تی؟

به کارتان بستگی دارد و بهترین راه، تست کردن یک کار واقعی روی هر دو است. تفاوت ساختاری مهم این است که وزن مدل‌های دیپ‌سیک با مجوز MIT منتشر می‌شود و می‌توانید آن‌ها را روی سرور خودتان اجرا کنید؛ چیزی که درباره‌ی مدل‌های بسته امکان‌پذیر نیست.

می‌شود دیپ سیک را روی کامپیوتر خانگی اجرا کرد؟

مدل‌های اصلی برای سخت‌افزار سروری طراحی شده‌اند و روی یک کامپیوتر خانگی اجرا نمی‌شوند. اما دیپ‌سیک همراه R1 شش مدل کوچک‌تر تقطیرشده هم منتشر کرد که برای سیستم‌های قوی‌تر شخصی گزینه‌ی معقولی هستند.

دیپ سیک به فارسی جواب می‌دهد؟

بله، به فارسی پاسخ می‌دهد. کیفیت آن را خودتان با چند نمونه بسنجید، چون شرکت عددی درباره‌ی عملکرد فارسی منتشر نکرده است.

برای کار با API دیپ سیک به چه چیزی نیاز دارم؟

یک کلید API از پنل رسمی، اعتبار دلاری در حساب، و نام مدل. اگر قبلاً با کتابخانه‌های OpenAI کد نوشته‌اید، فقط آدرس پایه و نام مدل را عوض می‌کنید.

از کجا شروع کنم؟

یک کار واقعی از کارهای خودتان انتخاب کنید، مثلاً خلاصه‌کردن یک قرارداد چندصفحه‌ای یا پیدا کردن خطای یک قطعه کد. همان را یک بار در حالت عادی و یک بار در حالت تفکر بدهید و جواب‌ها را کنار هم بگذارید. این مقایسه در پنج دقیقه چیزی به شما نشان می‌دهد که هیچ توضیحی جایش را نمی‌گیرد: اینکه برای کار شما کدام حالت و کدام مدل صرف می‌کند.