جنگ سرد دیجیتالی و کپیبرداری از مغزهای مصنوعی
تبادل میلیونها درخواست در دنیای هوش مصنوعی و اتهامات کپیبرداری از مدلهای غولهای آمریکایی، حالا به یک تقابل جدی تبدیل شده است. شرکتهای چینی از روشی به نام «تقطیر» یا Distillation استفاده کردهاند تا تواناییهای مدلهای پیشرفته آمریکا را استخراج کرده و در مدلهای خودشان پیاده کنند. در واقع آنها به جای ساخت یک مدل از صفر، از خروجیهای مدلهای قدرتمندتر برای آموزش مدلهای خودشان بهره بردهاند.
درک این موضوع به ما کاربران کمک میکند بفهمیم چرا برخی مدلهای جدید ناگهان جهش میکنند. وقتی میبینیم رقابت روی بهینهسازی خروجیهای دیگران است، متوجه میشویم آینده هوش مصنوعی شاید نه در خلق دادههای جدید، بلکه در نحوه پالایش و استفاده هوشمندانه از دادههای موجود نهفته باشد. شرکت DeepSeek در مرکز این جنجال قرار دارد. مقامات آمریکایی معتقدند این شرکت برای آموزش مدل R1، از دادههای Claude، Gemini، GPT و Grok استفاده کرده است. مدل R1 که اوایل سال ۲۰۲۵ منتشر شد، یک مدل استدلالی متنباز و بسیار قدرتمند است که دنیا را غافلگیر کرد.
“عملکردها و قابلیتهای اختصاصی مدلهای پیشرفته آمریکایی توسط شرکتهای چینی استخراج شده است”
DeepSeek و مدل R1 در اوایل سال ۲۰۲۵
داستان فقط به DeepSeek ختم نمیشود. شرکت Moonshot AI هم متهم شده که برای آموزش Kimi K3، دادههای قابل توجهی از مدل Fable (ساخته Anthropic) استخراج کرده است. Kimi K3 اکنون یکی از پیشرفتهترین مدلهای چینی به شمار میرود و حتی مدل Kimi K2 هم از دادههای GPT-4o تغذیه کرده است.
این مدلها سعی میکنند همان حس و حال و دقت مدلهای آمریکایی را تقلید کنند. چنین روندی باعث شده مرز بین نوآوری واقعی و کپیبرداری هوشمندانه بسیار باریک شود.
چطور از تنوع مدلهای AI به نفع خودمان استفاده کنیم؟
وقتی مدلهای مختلف (چه آمریکایی و چه چینی) از هم کپی میکنند یا روی هم اثر میگذارند، در واقع کاربر برنده است. شما میتوانید بسته به نوع نیازتان، از مدلهای متفاوتی استفاده کنید.
برای کارهای تحلیلی سنگین، GPT-4o یا Claude گزینههای بهتری هستند. برای تست کردن استدلالهای جدید، مدلهای متنباز مثل R1 جذابیتهای خاص خود را دارند. بهتر است هرگز به یک مدل تکیه نکنید؛ یک درخواست را در سه مدل مختلف بفرستید تا بهترین نتیجه را بگیرید.
اگر به دنیای خلاقیت و هنر علاقه دارید، تماشای این رقابتها کمک میکند بفهمید ابزارهای تولید محتوا چطور تکامل مییابند. برای مثال میتوانید نگاهی به فیلمسازی با هوش مصنوعی بیندازید تا ببینید این تکنولوژیها کجا به جایی میرسند که احساسات انسانی را شبیهسازی کنند.
میلیاردها توکن و هشدار NSA و FBI
سازمان امنیت ملی (NSA)، آژانس امنیت سایبری و زیرساخت (CISA) و اداره تحقیقات فدرال (FBI) در یک هشدار مشترک اعلام کردند که این کپیبرداری در ابعاد صنعتی اتفاق افتاده است. آنها مدعیاند شرکتهایی مثل Alibaba، MiniMax، StepFun و Z.AI میلیاردها توکن را از میلیونها تبادل و درخواست مدلهای آمریکایی استخراج کردهاند.
این نهادها از عبارت «کمپینهای دیستillation مخرب» استفاده کردهاند. این یعنی ما با یک اتفاق ساده روبرو نیستیم، بلکه یک برنامه سیستماتیک برای دور زدن هزینههای هنگفت تحقیق و توسعه در جریان بوده است. سال ۲۰۲۴ نقطه شروع این فشارها بود و از اوایل سال گذشته، شرکتهای آمریکایی متوجه حسابهای کاربری مشکوک شدند.
OpenAI و مایکروسافت مدتی پیش اعلام کردند حسابهایی که قصد تقطیر فناوریهای آنها را داشتند، مسدود کردهاند. نکته عجیب اینجاست که این رفتار فقط مختص شرکتهای چینی نیست. ایلان ماسک هم در جریان یک دادخواستی اعتراف کرد که برای آموزش مدلهای xAI از خروجیهای OpenAI استفاده کرده است. انگار در دنیای AI، همه از هم یاد میگیرند، حتی اگر این یادگیری با بحثهای حقوقی همراه باشد.
این وضعیت نشان میدهد رقابت هوش مصنوعی از مرحله ساخت زیرساخت به مرحله بهینهسازی دادهها رسیده است. برای کاربر عادی، این اتفاق به معنای دسترسی به مدلهای قدرتمند با قیمت کمتر یا حتی رایگان است؛ چون هزینه آموزش اولیه توسط شرکتهای پیشرو پرداخت شده و بقیه مدلها با روش تقطیر سریعتر رشد میکنند.
آنچه باید بدانید
روش تقطیر یا Distillation در هوش مصنوعی دقیقا چیست؟
در این روش، یک مدل کوچکتر و ضعیفتر (شاگرد) را با استفاده از خروجیهای یک مدل بزرگ و قدرتمند (استاد) آموزش میدهند. هدف این است که مدل کوچکتر بتواند رفتارهای مدل بزرگ را تقلید کند، بدون اینکه نیاز باشد تمام دادههای عظیم اولیه را پردازش کند.
کدام شرکتهای چینی متهم به کپیبرداری شدهاند؟
شرکتهایی نظیر DeepSeek، Moonshot AI، Alibaba، MiniMax، StepFun و Z.AI در لیست متهمان آمریکایی قرار دارند.
آیا فقط شرکتهای چینی از این روش استفاده میکنند؟
خیر، طبق گزارشها ایلان ماسک تایید کرده که مدلهای xAI برای آموزش از خروجیهای OpenAI بهره بردهاند.