نکات کلیدی به قلم بلومبرگ هوش مصنوعی
- گوگل عرضه جمینای ۴ آرگون، مدل پرچمدار و مدتها منتظرشده هوش مصنوعی خود را آغاز کرده است، اما این شرکت با تردیدهای داخلی درباره عملکرد آن در حوزههای کلیدی دستوپنجه نرم میکند.
- برخی منابع داخلی میگویند جمینای ۴ در آزمونهای معیار عملکرد خوبی داشته، اما در انجام برخی وظایف برنامهنویسی مانند طراحی فرانتاند دچار مشکل میشود و تواناییهای برنامهنویسی آن یکدست نیست.
- گوگل اعلام کرد که این ادعا که جمینای ۴ در حوزههایی مانند برنامهنویسی ضعیف عمل میکند نادرست است و به اظهارات رئیس گوگل دیپمایند اشاره کرد که گفته از عملکرد این مدل دلگرم شده است.
گوگل، زیرمجموعه آلفابت، عرضه جمینای ۴ آرگون، مدل پرچمدار و مدتها منتظرشده هوش مصنوعی خود را آغاز کرده است، اما این شرکت با تردیدهای داخلی درباره عملکرد آن در حوزههای کلیدی مانند برنامهنویسی دستوپنجه نرم میکند.
گوگل روز چهارشنبه این مدل را به گروه کوچکی از شرکای مورد اعتماد امنیت سایبری معرفی کرد و اعلام کرد پس از آزمایشهای بیشتر، دسترسی به آن را گسترش خواهد داد و ابتدا مشترکان پولی را در اولویت قرار میدهد. این شرکت گفت جمینای ۴ در چندین آزمون معیار امتیازهای پیشتاز کسب کرده است، از جمله شکست دادن مدل آسترا اوپنایآی در آزمونی که مهارتهای امنیتی را میسنجد.
اما برخی منابع داخلی میگویند این شاخصها تمام واقعیت را بازگو نمیکنند. به گفته افرادی که دسترسی مستقیم به این تلاش دارند، جمینای ۴ در آزمونهای معیاری که بهطور گسترده برای سنجش کارآمدی مدلها به کار میرود عملکرد خوبی داشته است، اما وقتی کارکنان آن را در عمل به کار میگیرند، عملکردش ضعیفتر میشود. این افراد که برای بحث درباره موضوعی داخلی خواستند نامشان فاش نشود، گفتند این مدل در انجام برخی وظایف برنامهنویسی دچار مشکل میشود.
سهام آلفابت پس از اعلام این خبر در معاملات پس از ساعت کاری حدود ۱.۷ درصد افزایش یافت. در اواخر معاملات عادی، این سهام پس از گزارش بلومبرگ درباره تردید کارکنان نسبت به این مدل، بخشی از رشد زودهنگام روز چهارشنبه را از دست داد.
گوگل اخیراً برای توسعه مدلهایی که بتوانند با اوپنایآی و آنتروپیک پیبیسی رقابت کنند، تلاش زیادی کرده است. به گفته این افراد، این شرکت قصد داشت در ژوئن نسخه دیگری به نام جمینای ۳.۵ پرو را عرضه کند، اما این تلاش را رها کرد.
گوگل گفت که این ادعا که جمینای ۴ در حوزههایی مانند برنامهنویسی ضعیف عمل میکند نادرست است. این شرکت بلومبرگ را به اظهارات هفته گذشته کورای کاووکاوغلو، رئیس گوگل دیپمایند، ارجاع داد که گفته از عملکرد این مدل دلگرم شده است.
کاووکاوغلو در کنفرانسی که وبسایت خبری فناوری «د اینفورمیشن» برگزار کرده بود، گفت: «من نهایت اعتماد را به تیم دارم. به نظر من، مسلم است که ما همیشه در خط مقدم خواهیم بود.»
در داخل گوگل طیفی از نظرات وجود دارد. برخی کارکنان معتقدند مدلهای فِیبل آنتروپیک و آسترا اوپنایآی با سرعت بیشتری نسبت به جمینای در حال پیشرفت هستند. این افراد باور دارند که جمینای ۴ — حتی در بهترین حالت — در برخی حوزهها همچنان از آن مدلها عقبتر خواهد بود. کارکنان دیگری معتقدند نسخه پیشرو به آزمایشگاههای پیشرو هوش مصنوعی رسیده است.
یک کارمند گوگل که با روند توسعه مدل آشناست گفت در داخل شرکت «اجماع گستردهای» وجود دارد که جمینای ۴ در خط مقدم قرار دارد. این فرد گفت شرکت آزمونهای سختگیرانهای روی مدلها انجام داده است و این ادعا را که آنها در وظایف برنامهنویسی پیچیده و واقعی دچار مشکل میشوند رد کرد.
گوگل بهشدت به موفقیت جمینای ۴ نیاز دارد. نسخههایی از این مدل زیربنای تقریباً همه محصولاتی است که این شرکت میفروشد، از پاسخهای هوش مصنوعی در بالای جستوجوی گوگل — موتور اصلی سودآوری شرکت — تا نقشهها، جیمیل و کروم. هر یک از این محصولات بیش از یک میلیارد کاربر دارند؛ مزیتی در توزیع که برخی رقبای شرکت از آن بیبهرهاند.
اما اوپنایآی و آنتروپیک بهطور فزایندهای از فروش مدل فراتر رفته و در حال ساخت محصولات خود، از جمله عاملهای برنامهنویسی، هستند. ناکامی در ارائه یک مدل پیشرو میتواند به رقبای گوگل زمان بیشتری بدهد تا مصرفکنندگان، توسعهدهندگان و کسبوکارها را متقاعد کنند که آینده جستوجو و نرمافزار باید روی پلتفرمهای آنها اجرا شود.
گوگل در پاسخ به پرسشهای بلومبرگ گفت هرچند آخرین مدل پروی آن در فوریه عرضه شده، از آن زمان رشد در محصولات هوش مصنوعی این شرکت، از جمله نسخه سازمانی جمینای و همچنین اپلیکیشن چتبات مصرفی و حالت هوش مصنوعی در جستوجوی گوگل را شاهد بوده است؛ دو مورد آخر از مرز یک میلیارد کاربر گذشتهاند.
جمینای ۳
نوامبر گذشته، گوگل از جمینای ۳ رونمایی کرد؛ مدلی که با استقبال خوبی روبهرو شد و بهطور گسترده نقطه عطفی در تلاشهای این شرکت برای همگام شدن با اوپنایآی و آنتروپیک تلقی شد. گوگل در کنفرانس I/O خود در ماه مه نسخه جدیدی به نام جمینای ۳.۵ پرو را معرفی کرد و وعده داد آن را ماه بعد عرضه کند. اما آن مهلت گذشت و به گفته افراد مطلع، این شرکت از آن زمان ۳.۵ پرو را رها کرده است.
این تصمیم علاوه بر آسیب زدن به جاهطلبیهای گوگل در حوزه هوش مصنوعی، احتمالاً هزینه سنگینی از نظر زمان و پول به شرکت تحمیل کرده است. به گفته ماندیپ سینگ، تحلیلگر بلومبرگ اینتلیجنس، دورههای آموزش برای ساخت چنین مدلی میتواند تا ۴۰۰ میلیون دلار هزینه داشته باشد. استفاده از پژوهشگران هوش مصنوعی با حقوق بالا میتواند این رقم را بیشتر هم بکند.
اکنون گوگل با چالشهای گوناگونی درباره جمینای ۴ روبهروست. به گفته افراد مطلع از ارزیابیهای داخلی این مدل، تواناییهای برنامهنویسی آن یکدست نیست. یک منبع گفت جمینای در طراحی فرانتاند، که ظاهر و حس اپلیکیشنها و وبسایتها را شکل میدهد، چندان ماهر نیست. این میتواند یک ناکامی بالقوه جدی باشد، زیرا گوگل در رقابت در بازار داغ ابزارهای برنامهنویسی هوش مصنوعی دچار مشکل شده است.
علاوه بر این، به گفته فردی که با روند توسعه آن آشناست، این مدل بسیار بزرگ است. معمولاً اجرای مدلهای بزرگ پرهزینه است و میتواند به حاشیه سود گوگل فشار وارد کند.
«بنچمکسینگ»
کارشناسان میگویند ممکن است گوگل از گرایش صنعت به تمرکز بر آزمونهای معیار رنج ببرد؛ پدیدهای که به «بنچمکسینگ» معروف است، یعنی زمانی که مهندسان بیش از ساختن محصولی که کاری را به خوبی انجام دهد، بر کسب امتیاز خوب تمرکز میکنند. آزمایشگاههای هوش مصنوعی معمولاً این کار را میکنند زیرا مشتریان اغلب مدلها را بر اساس امتیازهای آزمون معیارشان قضاوت میکنند. به گفته دو فرد مطلع از این مدل، به نظر میرسد جمینای ۴ نیز از این فرایند تأثیر پذیرفته است.
ادوین چن، بنیانگذار استارتاپ هوش مصنوعی Surge AI، گفت تکیه بر آزمونهای معیار میتواند آزمایشگاهها را به تمرکز بر ساخت مدلهایی سوق دهد که کد را به زبان خاصی مینویسند، نه ساختن اپلیکیشنهایی که استفاده از آنها آسان یا طراحیشان خوب است.
چن گفت: «تشبیهش این است: