مدل‌های مفتِ مفت هوش‌ مصنوعی برای همه

به گزارش گروه آنلاین روزنامه دنیای اقتصاد-حسین موسوی: این اولین بار نیست که یک چت‌بات چینی در واشنگتن جنجال به پا می‌کند. شرکت هوش مصنوعی مون¬شات ای¬آی مستقر در پکن، جدیدترین مدل خود با نام Kimi K۳ را منتشر کرد و ادعا کرد که این مدل «به طور مداوم از هر مدل دیگری در بازار به جز جدیدترین مدل‌های رقبای آمریکایی خود یعنی اوپن¬ای¬آی و آنتروپیک بهتر عمل کرده است». غول فناوری چینی، علی‌بابا، دو روز بعد ادعاهای مشابهی را در مورد توانایی مدل Qwen ۳.۸ که به زودی عرضه خواهد شد، مطرح کرد. این مدل فعلا در مرحله بتا قابل دسترسی برای همگان است.

به نوشته مجله فارن پالیسی، درست مانند کاری که شرکت چینی دیپ‌سیک سال گذشته انجام داد، مدل‌های جدید دوباره سوالاتی را در مورد اینکه آیا ایالات متحده هنوز در رقابت هوش مصنوعی از چین پیشی می‌گیرد، پکن چقدر به کم کردن این فاصله نزدیک است و واشنگتن برای حفظ این برتری چه کاری می‌تواند انجام دهد، برانگیخته‌اند.

دو مدل جدید سر و صدای زیادی به پا کرده‌اند؛ به خصوص مدل Kimi که آنقدر محبوب شد که مون‌شات مجبور شد اشتراک‌های جدید را ظرف ۴۸ ساعت پس از عرضه به حالت تعلیق درآورد و دلیل آن را بار بیش از حد سخت‌افزار مورد استفاده برای تأمین انرژی مدل‌هایش (که در اصطلاح صنعتی به آن «محاسبه» می‌گویند) عنوان کرد. اما اگرچه توقف ثبت‌نام به دلیل تقاضای بسیار بالا ممکن است یک برد بزرگ بازاریابی باشد، تحلیلگران می‌گویند که این امر محدودیت‌های محاسباتی بسیار واقعی را که توسعه‌دهندگان هوش مصنوعی چینی با آن مواجه هستند، آشکار می‌کند.

شرکت‌های آمریکایی مانند انویدیا بر تولید تراشه‌های نیمه‌هادی پیشرفته مورد استفاده برای آموزش و تقویت مدل‌های هوش مصنوعی تسلط دارند و شرکت‌هایی مانند اوپن¬ای¬آی، آنتروپیک، گوگل و مایکروسافت ده‌ها میلیارد دلار برای محاسبات هزینه کرده‌اند؛ همه اینها در حالی است که دولت ایالات متحده از طریق کنترل صادرات، دسترسی چین به این تراشه‌ها را قطع کرده است.

رایان فداسیوک، یکی از اعضای موسسه امریکن انترپرایز در واشنگتن دی¬سی که پیش از این به عنوان مشاور چین و فناوری در وزارت امور خارجه ایالات متحده خدمت کرده است، گفت: «پرتاب جدید کیمی یک «پیشرفت جدی» است و می‌توان آن را به طور واقع‌بینانه به عنوان «دومین لحظه دیپ‌سیک» توصیف کرد.» اما او افزود: «همچنین برخی از محدودیت‌های ساختاری جدی پیش روی صنعت هوش مصنوعی چین را نشان می‌دهد.»

آنچه باعث نگرانی در دولت و صنعت ایالات متحده شده، روش‌هایی است که چین برای غلبه بر این محدودیت‌ها به کار گرفته است. اوپن¬ای¬آی و آنتروپیک شرکت‌های هوش مصنوعی چینی را متهم کرده‌اند که از مدل‌های پیشرفته آمریکایی برای آموزش مدل‌های خود استفاده می‌کنند و در واقع از قدرت مدل‌های آمریکایی بهره می‌برند و در عین حال از کسری از قدرت محاسباتی از طریق فرآیندی به نام تقطیر استفاده می‌کنند. در حالی که تقطیر یک روش نسبتاً رایج در صنعت هوش مصنوعی است (شرکت‌ها اغلب از آن به صورت داخلی برای ایجاد نسخه‌های ابتدایی‌تر و مقرون به صرفه‌تر از مدل‌های خود استفاده می‌کنند)، اما غول‌های فناوری و مقامات ایالات متحده ادعا می‌کنند که شرکت‌های چینی از این تکنیک برای «اهداف غیرقانونی» برای سرقت فناوری اختصاصی استفاده کرده‌اند.

مت شیهان، یکی از اعضای ارشد بنیاد کارنگی برای صلح بین‌المللی که اکوسیستم هوش مصنوعی چین را مطالعه می‌کند، گفت: «این اساساً به جبران کسری محاسباتی آنها کمک می‌کند. اگر آنها به دلیل محدودیت‌های محاسباتی ۴۰ درصد عقب باشند، تقطیر نیمی از این عقب‌ماندگی را تشکیل می‌دهد. این بدان معنا نیست که شرکت‌های هوش مصنوعی چینی بسیار خوب و بسیار نوآور نیستند - فکر می‌کنم اگر محدودیت‌های محاسباتی را برداریم، انتظار داریم این شکاف تا حد زیادی بسته شود.»

چندین مقام دولت ترامپ شرکت مون¬شات را به «سرقت» فناوری ایالات متحده برای آموزش مدل پیشرفته خود متهم کردند و مایکل کراتسیوس، مدیر دفتر سیاست‌گذاری علوم و فناوری کاخ سفید، با استناد به «اطلاعاتی» مبنی بر اینکه این شرکت چینی آخرین مدل Claude Fable شرکت آنتروپیک را تقطیر کرده و به¬طور غیرقانونی به واحدهای پردازش انویدیا دسترسی پیدا کرده است، گفت: «تقطیر صنعتی مخفیانه و در مقیاس بزرگ با هدف سرقت فناوری اختصاصی ایالات متحده و تضعیف تحقیقات آمریکایی غیرقابل قبول است.»

جیکوب هلبرگ، معاون وزیر امور خارجه ایالات متحده در امور اقتصادی، افزود: «دروغ گفتن، تقلب کردن و دزدی نوآوری نیست. این کارها برای فعالیت اقتصادی مولد و توسعه اقتصادی سالم ملت‌ها مخرب است.»

اسکات بسنت، وزیر خزانه‌داری، پا را فراتر گذاشت و در پستی در وب‌سایت ایکس تهدید کرد که شرکت‌های هوش مصنوعی چینی را به فهرست دولت ایالات متحده اضافه خواهد کرد که دسترسی آنها به فناوری‌های ایالات متحده را به دلایل امنیت ملی محدود می‌کند.

چنین اظهاراتی گمانه‌زنی‌هایی را تقویت می‌کند مبنی بر اینکه دولت ترامپ در حال زمینه‌سازی برای ممنوعیت جامع مدل‌های هوش مصنوعی چینی است که می‌تواند استفاده از آنها توسط شرکت‌های آمریکایی و سایر افرادی که از فناوری آمریکایی استفاده می‌کنند را محدود کند.

اما انجام این کار به هیچ وجه ساده نخواهد بود. همچنین به دلیل یکی دیگر از ارکان کلیدی استراتژی هوش مصنوعی چین، با مخالفت‌های داخلی و بین‌المللی روبرو خواهد شد.

اعلامیه‌های اخیر کیمی و Qwen با تعهدی مبنی بر انتشار عمومی تمام پارامترهای عددی که مدل‌هایشان را به کار می‌اندازند - که به عنوان وزن‌های مدل شناخته می‌شوند - همراه بود. این امر به هر کسی اجازه می‌دهد تا اسکلت مدل‌ها را به صورت رایگان دانلود کند و برنامه‌ها یا ویژگی‌های خود را بر روی آنها بسازد.

این رویکرد به اصطلاح وزن باز، که توسط دیپ¬سیک نیز به کار گرفته شده است، در تضاد با سیستم‌های جعبه سیاه بسته‌تر آنتروپیک و پیشرفته‌ترین مدل‌های اوپن¬ای¬آی است که فقط با عضویت در خود مدل‌ها و پرداخت هزینه برای استفاده مداوم از آنها قابل استفاده هستند.

شیهان گفت: «اگر وزن بسته باشد به این معنی است که از نظر عملکردی تنها راه دسترسی به مدل از طریق شرکت ارائه¬دهنده آن است.» او افزود: «من کاملاً از طریق سیستم آنها کار می‌کنم و آنها می‌توانند هر مبلغی را که می‌خواهند از من دریافت کنند.» در حالی که با مدل‌های وزن باز شما می‌توانید کل مدل را خودتان دانلود کنید و در آن مرحله است کاملا جدا می‌شود، شرکت دیگر هیچ کنترلی بر آن ندارد و می‌توانید هر طور که می‌خواهید از آن استفاده کنید.

این امر همچنین مدل‌های چینی را برای استارت‌آپ‌های آمریکایی بسیار ارزان‌تر و استفاده از آنها را آسان‌تر می‌کند. ده‌ها مورد از آنها این هفته از دولت ترامپ درخواست کردند که از ادامه ممنوعیت جلوگیری کند. شیهان در توضیح محاسبات آن شرکت‌های کوچک‌تر گفت: «آیا قرار است این هزینه‌های اشتراک بسیار بالا را بپردازم تا همه درخواست‌هایم را به کلود برگردانم و او بهترین پاسخ‌ها را به من بدهد، یا ترجیح می‌دهم فقط یک مدل چینی را دانلود کنم که تقریباً به همان خوبی است و برای مورد استفاده من کاملاً مناسب است و تنها هزینه آن، هزینه اجرای مدل است؟»

این منطق به کشورهای دیگر نیز تعمیم می‌یابد، به¬ویژه قدرت‌های متوسط در جنوب جهان که در حال انتخاب بین اختصاص منابع محدود خود به فناوری ایالات متحده یا چین هستند. اقدام اخیر دولت ترامپ در جلوگیری از استفاده اتباع خارجی از جدیدترین مدل‌های شرکت آنتروپیک، بی‌اعتمادی جهانی به واشنگتن را عمیق‌تر کرده و به شی جین‌پینگ، رئیس‌جمهوری چین، راه دیگری برای معرفی پکن به عنوان بازیگر جهانی مسئولیت‌پذیرتر و قابل اعتمادتر داده است.

شی جین پینگ دقیقاً همین کار را اخیرا در سخنرانی خود در کنفرانس جهانی هوش مصنوعی چین در شانگهای انجام داد، جایی که او بارها از «باز بودن» در توسعه جهانی هوش مصنوعی حمایت کرد. او گفت: «ما باید از این فرصت نادر و تاریخی برای تشویق منبع باز، باز بودن، همکاری و اشتراک‌گذاری استفاده کنیم.» او افزود: «چین آماده است تا بازتر باشد، اقدامات عملی‌تری انجام دهد و دیدگاهی آینده‌نگرانه‌تر اتخاذ کند.» در حال حاضر نشانه‌هایی وجود دارد که این پیشنهاد مخاطبان خارجی را به خود جذب کرده است، به طوری که ۲۹ کشور به سازمان همکاری جهانی هوش مصنوعی چین که پیش از کنفرانس شانگهای راه‌اندازی شده بود، پیوسته‌اند.

با این حال، اینکه این گشودگی تا چه زمانی در سیستم اقتدارگرایانه چین و محدودیت‌های شدید آن بر اینترنت داخلی دوام خواهد آورد، همچنان یک سوال بی‌پاسخ است. در واقع، حتی در همان سخنرانی، شی به لزوم «عدم از دست دادن کنترل» بر فناوری اشاره کرد.

شیهان گفت که پذیرش رویکرد وزن باز توسط چین بیشتر ناشی از ضرورت دسترسی کمتر به محاسبات بود. او گفت: «فکر نمی‌کنم که آنها استراتژی وزن باز خود را به دلیل ژئوپلیتیک توسعه داده باشند، اما با آن بسیار مطابقت دارد. تنها راه برای شروع جلب حمایت از سایر نقاط جهان، ارائه رایگان این مدل‌ها است.»

فداسیوک گفت، به¬رغم هیاهو و وعده‌های اولیه، آزمون واقعی برای مدل‌های چینی این خواهد بود که آیا می‌توانند سطح عملکرد خود را در درازمدت حفظ کنند، پیش از آنکه کمبود محاسبات مانع از پذیرش گسترده آنها شود. او گفت: «ماهیت رقابت تغییر کرده است. مسئله ساخت مدلی نیست که در معیارها بهترین امتیاز را کسب کند. مسئله ارائه مدل‌ها به مردم و رساندن آنها به دست مردم است و این واقعاً حوزه‌ای است که چین در آن مشکل دارد و به مشکل خود ادامه خواهد داد.»

محمد سلیمان، مدیر شرکت مشاوره استراتژیک McLarty Associates که بر زیرساخت‌های جهانی هوش مصنوعی تمرکز دارد، گفت: اما استراتژی وزن باز شرکت‌های چینی همچنین به این معنی است که پذیرش گسترده می‌تواند کمبود محاسبات را جبران کند. او گفت: «از آنجا که متن‌باز است، می‌توانید آن را به مراکز داده، ارائه‌دهندگان ابری، کاربران، برای اجرای نسخه‌های خودشان از مدل‌ها منتقل کنید» و بنابراین مدل‌ها را از طریق محاسبات آن کاربران گسترش دهید.

این یک تاکتیکِ سیل‌آسا است که چین به طور مؤثر برای سایر فناوری‌ها از آن استفاده کرده است. سلیمان افزود: «این استراتژی از ناکجاآباد نمی‌آید؛ بلکه از استراتژی صنعتی چین در مورد انرژی خورشیدی، وسایل نقلیه الکتریکی و فضا نیز ناشی می‌شود. شما مدل را منتشر می‌کنید زیرا می‌خواهید بیشترین تعداد کاربران از آن استفاده کنند. بنابراین بله، آنها ممکن است امروز محدود باشند، اما در آینده واقعاً محدود نخواهند بود.»/