مدل زبانی بزرگی که دیپ سیک از آن استفاده میکند نه فقط از بسیاری همتایان غربی خود بزرگتر است، بلکه برتریهایی هم نسبت به آنها دارد و با مدلهای انحصاری گوگل و OpenAI برابری میکند. «پل گوتیه» (Paul Gauthier)، بنیانگذار ایدر «ایدر» (Aider)، پلتفرم کدنویسی هوش مصنوعی، v3، را روی بنچمارک کدنویسی خود اجرا کرد و متوجه شد این مدل از همه رقبایش، بهجز o1، پیشی گرفته است. این مدل در رتبهبندی چتباتها به نام Lmsys در رتبه هفتم قرار گرفته است. جایگاه مدل جدید شرکت دیپ سیک در این رتبهبندی از تمام مدلهای متنباز موجود بالاتر است و برترین مدلی محسوب میشود که شرکتی غیر از گوگل یا OpenAI تولید کرده است.
اکنون صنعت هوش مصنوعی چین ازنظر کیفیت بهقدری به رقبای آمریکایی خود نزدیک شده که سم آلتمن، مدیرعامل OpenAI، خود را ملزم به توضیح درباره کاهش این فاصله میداند. او مدت کوتاهی پس از انتشار v3 دیپ سیک با ناراحتی توییتی با متن زیر منتشر کرد:
کپیکردن چیزی که میدانید کار میکند (نسبتاً) آسان است اما انجام کاری جدید، پرخطر و دشوار که نمیدانید جواب میدهد یا نه، بسیار سخت است.
دلایل پیشرفت صنعت هوش مصنوعی چین

صنعت هوش مصنوعی چین ابتدا دستدوم به نظر میرسید؛ شاید دلیل آن تا حدی به لزوم مقابله چین با تحریمهای آمریکا مربوط شود. سال ۲۰۲۲، آمریکا صادرات تراشههای پیشرفته به چین را ممنوع کرد و باعث شد انویدیا، شرکت پیشتاز آمریکایی در زمینه ساخت پردازندههای گرافیکی، نسخههای ویژهای از محصولاتش را برای بازار چین طراحی کند که عملکرد پایینتری داشتند. در ضمن، آمریکا با حربههایی تلاش کرد مانع توسعه توانایی چین برای تولید تراشههای پیشرفته در داخل کشور شود؛ مانند ممنوعیت صادرات تجهیزات لازم و تهدید به مجازات شرکتهای غیرآمریکایی که ممکن است به چین کمک کنند.
مانع دیگر پیشرفت صنعت هوش مصنوعی در چین عامل داخلی است؛ شرکتهای چینی دیر به مدلهای زبانی بزرگ روی آوردند و یکی از دلایل این تأخیر نگرانیهای نظارتی بود. نگران واکنش سانسورچیها به مدلهایی بودند که ممکن است «توهم» ایجاد کنند و اطلاعات نادرست ارائه دهند یا بدتر از آن، جملات سیاسی خطرناکی بیان کنند. بایدو، موتور جستجوی چینی، سالها با مدل زبانی بزرگ بومی آزمایش شده بود و مدلی به نام «ERNIE» ایجاد کرده بود اما در انتشار آن برای عموم مردم تردید داشت. حتی وقتی موفقیت ChatGPT باعث شد این شرکت در رویکردش تجدیدنظر کند، ابتدا دسترسی به ERNIEbot را فقط از طریق دعوت امکانپذیر کرد.
مقامات چینی درنهایت مقرراتی برای ارتقای صنعت هوش مصنوعی وضع کردند. اگرچه از سازندگان مدل خواستند بر محتوای سالم تمرکز کنند و به «ارزشهای سوسیالیستی» پایبند باشند، متعهد شدند «توسعه نوآورانه هوش مصنوعی تولیدی» را نیز تشویق کنند.
مدل کوئن علی بابا یک سال تمام هیچ هیجانی نداشت و فقط مدل زبانی مبتنیبر مدل زبان بزرگ متنباز Llama متا محسوب میشد اما در سال ۲۰۲۴ که علیبابا نسخههای متوالی آن را منتشر کرد، کیفیتش بهتر و بهتر شد.
جک کلارک (Jack Clark)، محقق فعال در آزمایشگاه هوش مصنوعی غربی آنتروپیک، یک سال پیش وقتی علی بابا کوئن را منتشر کرد و فقط توانایی تحلیل تصاویر و متن را داشت، درباره مدلهای زبان بزرگ چینی گفت:
به نظر میرسد این مدلها با مدلهای بسیار قدرتمندی که در آزمایشگاههای پیشرو غرب توسعه یافتهاند، رقابت میکنند.
دیگر غولهای اینترنتی چین، ازجمله هواوی و تنسنت، نیز مشغول ساخت مدلهای خودشاناند اما درمورد دیپ سیک قضیه کاملاً فرق میکند؛ این شرکت حتی زمانی که علیبابا اولین مدل کوئن را منتشر کرد، نیز هنوز وجود نداشت. دیپ سیک زیرمجموعه های فلایر (High-Flyer) محسوب میشود. های فلایر صندوق سرمایهگذاری مشترکی است که سال ۲۰۱۵ برای استفاده از هوش مصنوعی در دستیابی به برتری در تجارت سهام تأسیس شد.
البته انگیزههای شرکتهای هوش مصنوعی چینی صرفاً تجاری نبودند. به گفته «لیانگ ونفنگ» (Liang Wenfeng)، بنیانگذار های فلایر، اولین حامیان OpenAI بهدنبال بازگشت سرمایه نبودند و به گفته او انگیزه حامیان این شرکت «دنبالکردن مأموریت» بود. های فلایر سال ۲۰۲۳ که کوئن راهاندازی شد، اعلام کرد میخواهد وارد مسابقه ایجاد هوش مصنوعی در سطح انسان شود و واحد تحقیقاتی هوش مصنوعی خود را با عنوان دیپ سیک به راه انداخت.
دیپ سیک نیز مانند OpenAI وعده داد هوش مصنوعی را برای منفعت عمومی توسعه دهد. آقای لیانگ اذعان کرد این شرکت نتایج آموزش خود را عمومی خواهد کرد تا از «انحصاری شدن» فناوری در دست چند فرد یا شرکت جلوگیری کند. دیپ سیک برخلاف OpenAI که مجبور شد برای پوشش هزینههای افزایشی آموزش دنبال تأمین مالی خصوصی بگردد، همیشه به منابع عظیم قدرت محاسباتیهای فلایر دسترسی داشته است.
تنها ویژگی قابلتوجه مدل زبانی بزرگ دیپ سیک مقیاسش نیست، بلکه به این دلیل که هنگام آموزش از انرژی کمی مصرف شده است، توانست نظرات را جلب کند. در این فرایند، مدل با دادههایی تغذیه میشود که با استفاده از آنها پارامترهای خود را استنتاج میکند. به گفته نیک لین (Nic Lane) از دانشگاه کمبریج، دلیل چنین موفقیتی بهرهمندی از یک نوآوری بزرگ نبود و فقط مجموعهای از بهبودهای جزئی عامل دستیابی به آن بودند.
صنعت هوش مصنوعی چین تهدیدی جدی برای آمریکا؟

در پایان باید بگوییم دفاع ما از مدلهای AI و چتباتهای چینی لزوماً به معنای پیشرفت حتی آنها در آینده نیست؛ زیرا پلتفرمهای هوش مصنوعی آمریکایی همچنان قابلیتهایی دارند که در رقبای چینیشان دیده نمیشود؛ برای مثال چتباتهای کلاد و OpenAI نهفقط در نوشتن کدها، بلکه در اجرای آنها نیز کمکتان میکنند. کلاد تمام اپلیکیشنها را ایجاد و میزبانی خواهد کرد. استدلال گامبهگام تنها راهحل مسائل پیچیده نیست. میتوانید از نسخه معمولی ChatGPT همان سؤال ریاضی را بکنید که از نسخه پیشرفتهتر آن میپرسید و چت پات در پاسخ برنامهای ساده برای پاسخ به سؤال شما مینویسد.
انتظار میرود Open AI بهزودی خبر ایجاد «ابرعامل در سطح دکترا» را اعلام کند. این ابرعامل با توانایی برابر با انسان در زمینه انجام وظایف مختلف علمی را نوآوریهای بیشتری در راه است. به گفته آقای آلتمن ممکن است رقابت حاضر با صنعت هوش مصنوعی آمریکا، به تحقق اهداف بزرگتر این صنعت منجر شود.