هوش مصنوعی دیپ سیک چیست و چگونه کار میکند؟
هوش مصنوعی دیپ سیک مجموعهای از مدلهای زبانی بزرگ ساخت یک شرکت چینی است که هم بهصورت چتبات رایگان در دسترس عموم قرار دارد و هم وزن مدلهایش را برای دانلود منتشر میکند. اسم این سرویس «جستوجوی عمیق» معنی میدهد و همین یک برداشت اشتباه رایج ساخته است: دیپسیک موتور جستوجو نیست. یک دستیار گفتوگویی است که متن مینویسد، کد تولید میکند، مسئلهی ریاضی حل میکند و میتواند فایلهای طولانی را بخواند و خلاصه کند.
دیپسیک را چه کسی ساخته است؟
شرکت دیپسیک در ژوئیهی ۲۰۲۳ در شهر هانگژوی چین و به دست لیانگ ونفنگ تأسیس شد. سرمایهی آن از صندوق سرمایهگذاری کمّی High-Flyer میآید که ونفنگ یکی از بنیانگذارانش است (منبع: پروفایل فوربس).
نام این شرکت در ژانویهی ۲۰۲۵ و با انتشار مدل R1 سر زبانها افتاد. تیم سازنده در مقالهی فنی نوشت که هزینهی توان پردازشی آموزش مدل کمتر از ۶ میلیون دلار بوده، رقمی که کنار بودجههای چندمیلیارددلاری شرکتهای آمریکایی بسیار کوچک به نظر میرسید (گزارش الجزیره، ژانویهی ۲۰۲۵). مارک اندریسن، سرمایهگذار سیلیکونولی، آن را «لحظهی اسپوتنیکِ هوش مصنوعی» نامید.
نکتهی مهمتر برای کاربر عادی این بود که دیپسیک مدل R1 را با مجوز MIT منتشر کرد؛ یعنی هر کسی اجازه دارد وزنها را دانلود کند، تغییر دهد و حتی تجاری استفاده کند (اعلام رسمی دیپسیک، ۲۰ ژانویهی ۲۰۲۵).
هوش مصنوعی دیپ سیک چگونه کار میکند؟
مثل بقیهی مدلهای زبانی، دیپسیک متن را توکنبهتوکن پیشبینی میکند. توکن تکهای از متن است، چیزی در حد یک کلمه یا بخشی از آن. اما چهار تصمیم فنی باعث شده این مدلها با هزینهی کمتری کار کنند:
پیشآموزش. مدل حجم عظیمی از متن را میخواند و الگوی زبان را یاد میگیرد. دیپسیک برای نسخهی V3 عدد ۱۴.۸ تریلیون توکن را اعلام کرده است.
پسآموزش با یادگیری تقویتی. در این مرحله به مدل پاداش داده میشود وقتی به جواب درست میرسد. دیپسیک اعلام کرده که R1 با یادگیری تقویتی در مقیاس بزرگ و با کمترین دادهی برچسبخورده آموزش دیده. خروجی این کار همان چیزی است که موقع کار با مدل میبینید: قبل از پاسخ نهایی، مسئله را مرحلهبهمرحله میشکافد.
معماری ترکیب متخصصها یا MoE. تصور کنید ساختمانی پر از کارشناس دارید. برای هر پرونده لازم نیست همه سر کار بیایند؛ فقط دو سه نفری که به آن پرونده مربوطاند فعال میشوند. در V4-Pro از مجموع ۱.۶ تریلیون پارامتر، برای تولید هر توکن حدود ۴۹ میلیارد پارامتر فعال میشود (اعلام رسمی دیپسیک، ۲۴ آوریل ۲۰۲۶). هزینهی اجرا به همان نسبت پایین میآید.
شیوهی خواندن متنهای طولانی. دیپسیک در نسل چهارم از روشی به نام DeepSeek Sparse Attention بههمراه فشردهسازی توکنی استفاده کرده تا مدل بتواند متن بلند را با حافظه و محاسبات کمتری پردازش کند. پنجرهی متن هر دو مدل این نسل یک میلیون توکن است.
حالت تفکر با حالت عادی چه فرقی دارد؟
در حالت تفکر، مدل قبل از نوشتن جواب یک زنجیرهی استدلال برای خودش تولید میکند و بعد نتیجه را مینویسد. در وب و اپلیکیشن این دو حالت با نام Expert Mode و Instant Mode انتخاب میشوند و در API سه سطح تلاش فکری وجود دارد: low برای کارهای ساده، high برای کارهای روزمره و max برای مسائل پیچیده (اعلام رسمی دیپسیک، ۱۳ آگوست ۲۰۲۶).
کِی به دردتان میخورد؟ وقتی مسئله چند مرحله دارد: پیدا کردن باگ در کد، حل یک مسئلهی ریاضی، مقایسهی چند قرارداد. برای «پایتخت ژاپن کجاست» حالت تفکر فقط وقت و توکن مصرف میکند.
کدام مدل دیپسیک را انتخاب کنیم: V4-Pro یا V4-Flash؟
اگر کارتان روزمره است با Flash شروع کنید و فقط وقتی جواب رضایتبخش نبود سراغ Pro بروید. تفاوت اصلی در اندازه و سرعت است، نه در قابلیتهای پایه.
مدل | پارامتر کل / فعال | پنجرهی متن | مناسب برای |
|---|---|---|---|
DeepSeek-V4-Pro | ۱.۶ تریلیون / ۴۹ میلیارد | ۱ میلیون توکن | کارهای پیچیده، برنامهنویسی، ایجنت |
DeepSeek-V4-Flash | ۲۸۴ میلیارد / ۱۳ میلیارد | ۱ میلیون توکن | پاسخ سریع، کار روزمره، هزینهی کمتر |
نسل قبلی هم هنوز قابل دانلود است؛ V3 با ۶۷۱ میلیارد پارامتر کل و ۳۷ میلیارد پارامتر فعال. اما نامهای قدیمی در API، یعنی deepseek-chat و deepseek-reasoner، از ۲۴ ژوئیهی ۲۰۲۶ بازنشسته شدهاند و دیگر کار نمیکنند.
تصور غلط رایج: «آموزش دیپسیک فقط ۶ میلیون دلار خرج برداشت»
این عدد واقعی است ولی فقط یک تکه از ماجرا را نشان میدهد. به گزارش CNBC، دیپسیک در مقالهی خود رقم ۵.۵۷۶ میلیون دلار را برای «آموزش رسمی» مدل نوشت و در همان مقاله تصریح کرد که پژوهشهای قبلی و آزمایشهای معماری و داده در این عدد حساب نشده است. مؤسسهی تحلیلی SemiAnalysis بعداً تخمین زد که کل هزینهی سرورهای دیپسیک حدود ۱.۶ میلیارد دلار بوده و نزدیک ۹۴۴ میلیون دلار آن صرف راهاندازی و نگهداری خوشههای پردازشی شده است.
پس ۶ میلیون دلار هزینهی یک دور آموزش نهایی است، نه قیمت ساختن این شرکت. دستاورد دیپسیک واقعی است، ولی نه به آن معنایی که در بسیاری از خبرها تکرار شد.
چطور از دیپسیک استفاده کنیم؟
چهار راه وجود دارد و سهتایش برای کاربر عادی کافی است:
نسخهی وب در نشانی chat.deepseek.com. ثبتنام با ایمیل و استفادهی رایگان.
اپلیکیشن موبایل که همان حساب کاربری وب را میپذیرد.
API برای توسعهدهندهها. کلید را از platform.deepseek.com میگیرید و نام مدل را deepseek-v4-pro یا deepseek-v4-flash میگذارید. این API با فرمت OpenAI و Anthropic سازگار است، پس کد قبلیتان معمولاً با تغییر یک خط کار میکند.
اجرای محلی روی سرور خودتان، از روی وزنهای منتشرشده در هاگینگفیس با مجوز MIT.
قیمت API از ۱۶ آگوست ۲۰۲۶ دو نرخی شده است: ساعتهای اوج و غیراوج، که نرخ غیراوج ۵۰ درصد کمتر از اوج است (اعلام رسمی دیپسیک). چون این نرخها تغییر میکنند، قبل از برنامهریزی هزینه حتماً صفحهی قیمت رسمی را ببینید.
پرداخت در پلتفرم رسمی به کارت بینالمللی نیاز دارد. اگر کارت ندارید، میتوانید از طریق صفحهی اکانت دیپسیک آسیاتکین اکانت یا اعتبار API تهیه کنید.
محدودیتهایی که بهتر است بدانید
مدل گاهی با لحن مطمئن اشتباه میگوید. هر عدد، تاریخ، آدرس یا منبعی که برایتان مهم است را جای دیگری چک کنید. این محدودیت مخصوص دیپسیک نیست و در همهی مدلهای زبانی دیده میشود.
اطلاعات حساس را داخل چت نگذارید: رمز عبور، کد ملی، متن کامل قرارداد. هر چیزی که تایپ میکنید روی سرور شرکت پردازش میشود.
دربارهی کیفیت فارسی هم دیپسیک در اعلامهای رسمیاش سنجهی جداگانهای منتشر نکرده است. اگر قرار است روی متن فارسی کار جدی انجام دهید، اول با سه چهار نمونهی واقعی خودتان تستش کنید.
پرسشهای پرتکرار
دیپ سیک رایگان است؟
نسخهی وب و اپلیکیشن رایگان است و برای استفادهی شخصی محدودیت پرداخت ندارد. API جداگانه و بر اساس مصرف توکن حساب میشود.
دیپ سیک بهتر است یا چت جی پی تی؟
به کارتان بستگی دارد و بهترین راه، تست کردن یک کار واقعی روی هر دو است. تفاوت ساختاری مهم این است که وزن مدلهای دیپسیک با مجوز MIT منتشر میشود و میتوانید آنها را روی سرور خودتان اجرا کنید؛ چیزی که دربارهی مدلهای بسته امکانپذیر نیست.
میشود دیپ سیک را روی کامپیوتر خانگی اجرا کرد؟
مدلهای اصلی برای سختافزار سروری طراحی شدهاند و روی یک کامپیوتر خانگی اجرا نمیشوند. اما دیپسیک همراه R1 شش مدل کوچکتر تقطیرشده هم منتشر کرد که برای سیستمهای قویتر شخصی گزینهی معقولی هستند.
دیپ سیک به فارسی جواب میدهد؟
بله، به فارسی پاسخ میدهد. کیفیت آن را خودتان با چند نمونه بسنجید، چون شرکت عددی دربارهی عملکرد فارسی منتشر نکرده است.
برای کار با API دیپ سیک به چه چیزی نیاز دارم؟
یک کلید API از پنل رسمی، اعتبار دلاری در حساب، و نام مدل. اگر قبلاً با کتابخانههای OpenAI کد نوشتهاید، فقط آدرس پایه و نام مدل را عوض میکنید.
از کجا شروع کنم؟
یک کار واقعی از کارهای خودتان انتخاب کنید، مثلاً خلاصهکردن یک قرارداد چندصفحهای یا پیدا کردن خطای یک قطعه کد. همان را یک بار در حالت عادی و یک بار در حالت تفکر بدهید و جوابها را کنار هم بگذارید. این مقایسه در پنج دقیقه چیزی به شما نشان میدهد که هیچ توضیحی جایش را نمیگیرد: اینکه برای کار شما کدام حالت و کدام مدل صرف میکند.
گفتوگو
نظرات خوانندگان
سؤال یا تجربهٔ خود را دربارهٔ این مطلب بنویسید.
در حال بارگذاری نظرات…