اخبار هوش مصنوعی، ۱۵ آگوست ۲۰۲۶

خلاصه اخبار و آزمون هوش مصنوعی: ۱۵ آگوست ۲۰۲۶

اسپیس ایکس رسماً خرید شرکت Cursor را نهایی کرد

کرسر رسماً بخشی از اسپیس‌ایکس است. این استارت‌آپ کدنویسی هوش مصنوعی می‌گوید این قرارداد به آن امکان دسترسی به چیزی را می‌دهد که آن را بزرگترین ناوگان پردازنده‌های گرافیکی جهان می‌نامد - چیزی شبیه به یک کمد محاسباتی. 

این خرید پس از توافق قبلی انجام شد که به اسپیس ایکس حق خرید کرسر را به قیمت ۶۰ میلیارد دلار می‌داد. کرسر اکنون در کنار جاه‌طلبی‌های رو به گسترش اسپیس ایکس در حوزه هوش مصنوعی و محاسبات، از جمله زیرساخت‌هایی که قبلاً به شرکت‌هایی مانند آنتروپیک و گوگل اجاره داده شده است، قرار دارد. (تک‌کرانچ)

شرکت آنتروپیک جزئیات بیشتری در مورد نحوه عملکرد واترمارک‌های جدید کلود به اشتراک می‌گذارد

شرکت آنتروپیک توضیح داد که واترمارک متن نامرئی کلود در عمل چگونه کار خواهد کرد. این شرکت قصد دارد از رویکرد SynthID-Text گوگل استفاده کند و به طور نامحسوس بر انتخاب کلمات تأثیر بگذارد، به طوری که متن تولید شده حاوی یک الگوی آماری قابل تشخیص باشد، بدون اینکه خروجی به طور قابل مشاهده تغییر کند.

شرکت آنتروپیک همچنین در حال برنامه‌ریزی برای یک API تشخیص واترمارک است. ویرایش سبک ممکن است واترمارک را دست‌نخورده باقی بگذارد، در حالی که یک بازنویسی کامل می‌تواند آن را حذف کند - بنابراین بله، هوشمندانه است، اما به سختی می‌توان آن را با جوهر جادویی توصیف کرد. کد باید سیگنال‌های واترمارک بسیار ضعیف‌تری را حمل کند زیرا مدل‌ها آزادی کمتری در مورد کلمات دلخواه دارند. (تک‌کرانچ)

وال استریت ژورنال گزارش داد که انویدیا ضمانت تأمین مالی برای مرکز داده OpenAI اوهایو را کاهش می‌دهد

طبق گزارش‌ها، انویدیا ضمانت مالی که برای پروژه عظیم مرکز داده اوهایو OpenAI در نظر گرفته بود را کاهش داد. اکنون انتظار می‌رود که پشتوانه اولیه کمتر از ۱۲۰ میلیارد دلار باشد، نه ۲۵۰ میلیارد دلاری که قبلاً مورد بحث قرار گرفته بود. 

بنا به گزارش‌ها، این تغییر پس از نگرانی سرمایه‌گذاران در مورد سرمایه‌گذاری بیش از حد انویدیا در امور مالی رخ داده است. OpenAI هنوز در حال مذاکره برای اجاره‌نامه‌ای الزام‌آور است که کل سایت ۱۰ گیگاواتی را پوشش می‌دهد - هزینه‌های زیرساختی در مقیاسی که کمتر شبیه محاسبات ابری و بیشتر شبیه ساختن یک کشور کوچک است. (رویترز)

توضیح: ابتکار عمل Daybreak از OpenAI و GPT-5.6.Cyber

OpenAI برنامه امنیت سایبری Daybreak خود را با دو سطح دسترسی گسترش داد: Daybreak Blue برای کارهای امنیتی دفاعی با استفاده از مدل‌های frontier و Daybreak Red برای تحقیقات فشرده‌تر با استفاده از GPT-5.6-Cyber.

طبق گزارش‌ها، این مدل تخصصی سایبری، ۹۵٪ از درخواست‌های امنیت سایبری پیشرفته را بدون رد کردن آنها تکمیل کرده است، در حالی که این رقم برای مدل قبلی ۵۷.۳٪ بوده است. OpenAI همچنین می‌گوید که این مدل به شناسایی دو آسیب‌پذیری ناشناخته قبلی در موتور جاوا اسکریپت V8 گوگل کمک کرده است. این مدل قدرتمند... و طبیعتاً، این کاهش نرخ رد درخواست‌ها، سندباکسینگ دقیق را بسیار مهم می‌کند. (aimagazine.com)

یک ارزیابی مهار شده چیزی را یافت که بررسی کیفی نتوانست: مدل‌های هوش مصنوعی وقتی اشتباه می‌کنند، بیشترین اطمینان را دارند

یک آزمایش هوش مصنوعی سازمانی، یک مشکل قابل اعتماد بودن ناخوشایند را نشان داد: خروجی‌هایی که به نظر شسته رفته و قانع‌کننده می‌آمدند، اغلب در مقایسه با واقعیت‌های شناخته شده، شکست می‌خوردند. در سخت‌ترین موارد، اطمینان مدل، شاخص قابل اعتمادی برای صحت نبود. 

راه‌حل پیشنهادی نسبتاً ساده اما مهم است - با استفاده از موارد آزمایشی کنترل‌شده که در آن‌ها پاسخ صحیح از قبل مشخص است، مهارهای ارزیابی بسازید، سپس امتیاز دهید که آیا مدل آن پاسخ را به درستی شناسایی و رتبه‌بندی می‌کند یا خیر. اساساً، درجه‌بندی هوش مصنوعی را بر اساس اطمینان سطحی متوقف کنید. (اطلاعات فناوری اطلاعات)

زنی ادعا می‌کند ناپدری‌اش از گروک برای تبدیل عکس‌های دوران کودکی‌اش به تصاویر مستهجن استفاده کرده است

زنی به طرح دعوی علیه xAI پیوست و ادعا کرد که از گروک برای تبدیل عکس دوران کودکی‌اش به هزاران تصویر مستهجن استفاده شده است. این پرونده به ادعاهای سه نوجوان می‌پیوندد که این شرکت را به عدم اجرای حفاظت‌های کافی در برابر تولید تصاویر توهین‌آمیز شامل افراد واقعی و خردسالان متهم می‌کنند.

این ادعاها توجه ناخوشایند دیگری را به حفاظت از تصویر مولد جلب می‌کند - زیرا ظاهراً دیگر توانایی تمام مسابقه نیست. جلوگیری از استفاده از مدل‌ها علیه افراد واقعی به همان اندازه مهم می‌شود. (TechCrunch)

سوالات متداول

چرا اسپیس ایکس شرکت کرسر (Cursor) را خریداری کرد؟

خرید Cursor به این استارت‌آپ کدنویسی هوش مصنوعی، دسترسی به زیرساخت بزرگ پردازنده گرافیکی SpaceX را می‌دهد و در عین حال آن را در چارچوب استراتژی گسترده‌تر هوش مصنوعی و محاسباتی این شرکت قرار می‌دهد. SpaceX پیش از این، گزینه خرید Cursor را با قیمت ۶۰ میلیارد دلار تضمین کرده بود. این معامله همچنین Cursor را به زیرساخت‌هایی متصل می‌کند که SpaceX در حال حاضر به شرکت‌های هوش مصنوعی، از جمله Anthropic و Google اجاره می‌دهد.

واترمارک متن Claude از شرکت Anthropic چگونه کار خواهد کرد؟

شرکت آنتروپیک قصد دارد از رویکرد SynthID-Text گوگل برای ایجاد الگوهای آماری نامرئی در متن تولید شده توسط کلود استفاده کند. این سیستم به جای اضافه کردن یک علامت قابل مشاهده، به طور نامحسوس بر انتخاب کلمات تأثیر می‌گذارد. ویرایش سبک ممکن است علامت چاپی را حفظ کند، در حالی که یک بازنویسی کامل می‌تواند آن را حذف کند. آنتروپیک همچنین قصد دارد یک API ارائه دهد که قادر به تشخیص این سیگنال‌های علامت چاپی باشد.

چرا انویدیا ضمانت پیشنهادی خود را برای مرکز داده اوهایو OpenAI کاهش داد؟

طبق گزارش‌ها، انویدیا به دلیل نگرانی‌ها در مورد مواجهه بیش از حد با تأمین مالی، ضمانت مالی مورد بررسی را کاهش داده است. اکنون انتظار می‌رود که مبلغ پیشنهادی کمتر از ۱۲۰ میلیارد دلار باشد، نه ۲۵۰ میلیارد دلار که قبلاً مورد بحث قرار گرفته بود. طبق گزارش‌ها، OpenAI هنوز در حال بحث در مورد اجاره‌نامه‌ای الزام‌آور است که کل سایت مرکز داده ۱۰ گیگاواتی اوهایو را پوشش می‌دهد.

OpenAI Daybreak و GPT-5.6-Cyber ​​برای چه چیزی طراحی شده‌اند؟

برنامه امنیت سایبری Daybreak شرکت OpenAI سطوح مختلفی از دسترسی را برای تحقیقات امنیتی فراهم می‌کند. Daybreak Blue بر کارهای امنیتی دفاعی با استفاده از مدل‌های frontier تمرکز دارد، در حالی که Daybreak Red از تحقیقات فشرده‌تر با استفاده از GPT-5.6-Cyber ​​پشتیبانی می‌کند. این مدل تخصصی سایبری برای رسیدگی به درخواست‌های پیشرفته امنیت سایبری طراحی شده است و کنترل‌هایی مانند sandboxing را به ویژه هنگامی که به مدل‌ها قابلیت‌های گسترده‌تری داده می‌شود، مهم می‌کند.

چرا ارزیابی مهارها برای سیستم‌های هوش مصنوعی قابل اعتماد مهم هستند؟

ارزیابی، مدل‌های هوش مصنوعی را در برابر مثال‌های کنترل‌شده‌ای که پاسخ صحیح از قبل مشخص است، مهار می‌کند. این به تیم‌ها کمک می‌کند تا به جای قضاوت در مورد اینکه یک مدل چقدر دقیق یا مطمئن به نظر می‌رسد، اندازه‌گیری کنند که آیا پاسخ درست را شناسایی و رتبه‌بندی می‌کند یا خیر. آزمایش سازمانی که در مقاله شرح داده شده است، نشان داد که اعتماد به نفس به خودی خود شاخص قابل اعتمادی برای درستی در موارد دشوار نیست.

دادخواست گروک چه چیزی را در مورد حفاظت از تولید تصویر هوش مصنوعی نشان می‌دهد؟

این دادخواست نگرانی‌ها در مورد سوءاستفاده از سیستم‌های تصویرسازی مولد برای ایجاد تصاویر صریح توهین‌آمیز شامل افراد واقعی و خردسالان را برجسته می‌کند. زنی ادعا می‌کند که از گروک برای تبدیل عکس دوران کودکی او به هزاران تصویر صریح استفاده شده است. این پرونده اهمیت فزاینده‌ی تدابیر حفاظتی که سوءاستفاده را مورد توجه قرار می‌دهند، نه فقط بهبود در قابلیت مدل، را تقویت می‌کند.

اخبار دیروز هوش مصنوعی: ۱۴ آگوست ۲۰۲۶

جدیدترین هوش مصنوعی را در فروشگاه رسمی دستیار هوش مصنوعی پیدا کنید

درباره ما

آزمون خلاصه فناوری هوش مصنوعی
۱. اسپیس ایکس پیش از انعقاد قرارداد، چه ارزش‌گذاری اختیاری برای خرید کرسر انجام داده بود؟

۲. شرکت Anthropic Planning از چه روشی برای واترمارک گذاری متن نامرئی در Claude استفاده خواهد کرد؟

۳. طبق گزارش‌ها، چرا انویدیا بودجه‌ی پیشنهادی خود برای پروژه‌ی مرکز داده‌ی اوهایوی OpenAI را کاهش داده است؟

۴. طبق گفته OpenAI، مدل تخصصی GPT-5.6-Cyber ​​در طول تحقیقات امنیتی چه دستاوردی داشته است؟

۵. ارزیابی یک شرکت چه مشکل اساسی در مورد قابلیت اطمینان در مورد خروجی‌های هوش مصنوعی نشان داد؟


بازگشت به وبلاگ