تکنیک استدلال جدید OpenAI، متخصصان ایمنی هوش مصنوعی را نگران کرده است ↗
طبق گزارشها، مدل آتی آسترا از شرکت OpenAI بر «عمق بازگشتی» تکیه دارد، یک ترفند استدلال حلقهای که یک پرسوجو را چندین بار در داخل شبکه پردازش میکند. متخصصان ایمنی در مورد آن نگران نیستند. نگرانی این است که بازگشت مبهم، ردپاهای زنجیره فکری خواناتری از خود به جا میگذارد، که دقیقاً همان ردی است که محققان پس از انحراف آن عوامل سرکش از آن استفاده کردند.
باک شلگریس از ردوود این گزارش را «بسیار نگرانکننده» خواند و زوی موشویتز اظهار داشت که ممکن است برای متوقف کردن یک مسابقه نظارت به پایین، به قوانینی نیاز باشد. OpenAI میگوید استفاده آسترا از این تکنیک محدود است و تفکر مدل هنوز باید قابل خواندن باشد... یا حداقل اینطور ادعا میکند. یاکوب پاچوکی، دانشمند ارشد، تأکید کرد که حفظ زنجیره فکری قابل نظارت هنوز یک هدف اصلی تحقیق است، حتی در حالی که The Information میگوید Anthropic و Google DeepMind نیز در حال حاضر این ایده را مطرح میکنند. زمانبندی به طرز عجیبی رقابتی است. (TechCrunch)
معرفی Gemini 3.8 Flash و 3.8 Flash Cyber ↗
گوگل سومین مدل فلش خود را در شش هفته عرضه کرد و روند عرضه کمی گیجکننده شده است. Gemini 3.8 Flash به عنوان بهترین فلش استدلال و کدنویسی تاکنون معرفی شده است، هنوز هم با همان قیمت اولیه ۳.۷: ۰.۷۵ دلار به ازای هر میلیون توکن ورودی و ۳.۷۵ دلار به ازای هر میلیون خروجی. گوگل میگوید که این مدل در کارهای دشوار سختتر عمل میکند - مراحل استدلال بیشتر، فراخوانی ابزارهای بیشتر - و در حال پشت سر گذاشتن معیارهای مهندسی نرمافزار بلندمدت است که معمولاً متعلق به مدلهای بزرگتر و گرانتر است.
در کنار آن، Gemini 3.8 Flash Cyber قرار دارد، یک نسخه متمرکز بر مدافع برای یافتن اشکالات و نوشتن وصلهها، که از طریق یک برنامه جدید Fairwind برای دولتهای مورد اعتماد و اپراتورهای زیرساختی، محافظت میشود. طبق گزارشها، تیم امنیتی کروم با آن ۲.۶ برابر وصلههای صحیحتر دریافت کرده است و تیم تحقیقات آسیبپذیری Cloud در کمتر از دو ساعت یک مشکل بحرانی را پیدا کرده است. Flash معمولی در حال اجرا در سراسر برنامه Gemini، حالت جستجوی هوش مصنوعی، Sheets، AI Studio و سازمانی است. Cyber فقط با دعوتنامه باقی میماند، که... بله، احتمالاً برای بهترینها. (گوگل)
شرکت Anthropic بازیهای Claude Fable 5.1 و Mythos 5.1 را منتشر کرد ↗
شرکت آنتروپیک، Claude Fable 5.1 را برای هر کسی که توانایی پرداخت دارد و Claude Mythos 5.1 را برای یک باشگاه دسترسی قابل اعتماد بسیار کوچکتر عرضه کرد. مدل زیربنایی یکسان، اما تنظیمات حفاظتی متفاوت. Fable هیولای کدنویسی و کار دانشمحورِ در دسترس عموم است؛ Mythos محدودیتهای سایبری و علوم زیستی را برای سازمانهای معتبر آمریکایی کاهش میدهد و همچنین گردش کار اسکن و وصلهگذاری Claude Security را تقویت میکند.
جهش علمی همان جهشی بود که باعث شد دوباره به خودم نگاه کنم: امتیاز تحقیقات عاملمحور در Terminal-Bench-Science از ۲۴.۷٪ به ۵۲.۶٪ افزایش یافت. بارهای کاری معمول با صورتحساب توکن باید حدود ۲۵٪ و بارهای کاری بسیار عاملمحور تا حدود ۴۵٪ هزینه کمتری داشته باشند، که بیشتر به دلیل خواندن حافظه نهان ارزانتر است. Enterprise Frontier Safeguards که دادهها را روی ابر خود مشتری با صفر نگهداری انسانمحور ذخیره میکند، از اواخر پاییز شروع به کار میکند. Fable میتواند آسیبپذیریهای نرمافزاری را پیدا کند، اما مهمتر از همه، نمیتواند از آنها سوءاستفاده کند - یک نکته کاملاً واضح پس از تمام درام فرار عاملمحور در تابستان امسال. (Silicon Republic)
برودکام با دو برابر شدن سرمایهگذاری آزمایشگاههای هوش مصنوعی روی تراشههای سفارشی، فراتر از انتظارات ظاهر شد ↗
آمار سهماهه سوم برادکام بسیار خوب بود: ۲۹.۵۹ میلیارد دلار درآمد و سود تعدیلشده ۳.۳۲ دلار به ازای هر سهم، که هر دو از وال استریت جلوتر بودند. فروش تراشههای هوش مصنوعی بیش از سه برابر شد و به ۱۶.۷ میلیارد دلار رسید. سپس سهام همچنان پس از ساعات کاری کاهش یافت زیرا پیشبینی حدود ۳۴.۸ میلیارد دلاری برای سهماهه چهارم کمتر از پیشبینیهای وال استریت بود. یک جهش ناگهانی در درآمد تراشهها.
هاک تان، مدیرعامل، در این تماس تلفنی به طراحی یک خط لوله سیلیکونی سفارشی پرداخت که تقریباً به طرز کارتونی بزرگی به نظر میرسد - سرعت بخشیدن به TPU های Ironwood برای Anthropic و Google، ارسال Jalapeno برای OpenAI و افزایش سرعت تراشههای استنتاج MTIA Meta. او پیشبینی میکند که درآمد هوش مصنوعی در سال مالی 2027 دو برابر شده و به 115 میلیارد دلار و سپس دوباره به 230 میلیارد دلار در سال بعد برسد، و استقرارهایی در مقیاس گیگاوات برای Anthropic، OpenAI و Meta در نظر گرفته شده است. مطمئناً انویدیا هنوز هم در کانون توجه قرار دارد، اما Broadcom بیسروصدا در حال تبدیل شدن به طراح مشترک انتخابی است، زمانی که Big Tech تراشههایی را میخواهد که از رده خارج نباشند. (SiliconANGLE)
متا از قدرتمندترین مدل هوش مصنوعی خود رونمایی میکند و به رقبای برتر خود نزدیک میشود ↗
متا، میوز اسپارک ۱.۳ را منتشر کرد و آن را قویترین مدل این شرکت تا به امروز نامید، و الکساندر وانگ، مدیر ارشد هوش مصنوعی، گفت که این مدل به OpenAI و Anthropic نزدیکتر میشود. توسعهدهندگان به API پولی دسترسی پیدا میکنند و این بهروزرسانی به Meta AI در فیسبوک، اینستاگرام و دوستان میرسد. این یک هدیه دیگر از لاما نیست. میوز اسپارک بسته، محدود و پولی است - یک چرخش کاملاً واضح از دوران وزنهای باز که متا را به یک توسعهدهنده محبوب تبدیل کرد.
خط تولید Muse از ماه آوریل به سرعت در حال پیشرفت بوده است: ۱.۱ در ماه جولای، ۱.۲ در اوایل آگوست و اکنون ۱.۳. متا هنوز یک محصول جانبی با وزن آزاد به نام Muse Glimmer برای پردازندههای گرافیکی مصرفی دارد، اما شرطبندی پیشرو، اختصاصی است. با توجه به پیشبینیهای هزینه سرمایهای در محدوده ۱۳۰ تا ۱۴۵ میلیارد دلار در سال جاری، این شرکت طوری هزینه میکند که انگار معتقد است «هوش مصنوعی شخصی» یک نقشه راه محصول است، نه یک شعار. پر کردن این فاصله با ۱.۳ هنوز اثبات نشده است. (CryptoBriefing)
محققان از فاجعه امنیتی پیش از انتشار آسترا توسط OpenAI میترسند ↗
برداشت ورج از آسترا حتی از نوشتهی تککرانچ هم دشوارتر است. پس از هفتهها تأخیر مرتبط با حملهی عوامل به اهداف واقعی در آزمایش، OpenAI هنوز به آرامی به سمت انتشار پیش میرود - و رایان گرینبلات از ردوود هشدار داد که انتخابهای معماری مبهم «ممکن است بدترین پیشرفت برای امنیت/ایمنی هوش مصنوعی تا به امروز باشند». ترس او از رقابتی به سمت سیستمهایی است که به سادگی نمیتوانید بر آنها نظارت کنید.
OpenAI به طور قطعی ترانسفورماتورهای حلقهای را برای Astra تأیید یا رد نکرده است و در عوض به پستهای Pachocki در مورد زنده نگه داشتن نظارت زنجیرهای فکر اشاره کرده است. این شرکت گفته است که نظارت CoT اضافی را برای پرتاب اضافه میکند و منابع ادعا میکنند که استفاده از عمق بازگشتی محدود شده است، بنابراین استدلال قابل بررسی باقی میماند. شمارنده گرینبلات صریح است: اگر آزمایشگاهها بیشتر به تفکر فضای پنهان تکیه کنند، تحقیقات به سبک Hugging Face که به ردپاهای قابل خواندن وابسته بودند، بسیار سختتر میشوند. بخش قابل توجهی از مبارزه امروز برای ایمنی هوش مصنوعی واقعاً در مورد این است که آیا ما هنوز میتوانیم تکالیف مدل را بخوانیم یا خیر. (The Verge)
سوالات متداول
مهمترین اخبار در جمعبندی اخبار هوش مصنوعی برای دوم سپتامبر ۲۰۲۶ چه بودند؟
این خلاصه، نگرانیهای ایمنی پیرامون استدلال عمقی مکرر OpenAI Astra، فلش Gemini 3.8 و فلش سایبرِ فقط دعوتی گوگل، و Claude Fable 5.1 و Mythos 5.1 از شرکت Anthropic را پوشش داد. همچنین، موج تراشه هوش مصنوعی سفارشی Broadcom، مدل بسته Muse Spark 1.3 از شرکت Meta و هشدار محققان مبنی بر اینکه معماری مبهم میتواند نظارت بر سیستمهای هوش مصنوعی را دشوارتر کند، پوشش داده شد.
چرا متخصصان ایمنی هوش مصنوعی از تکنیک عمق بازگشتی OpenAI نگران هستند؟
طبق گزارشها، مدل آتی آسترا از OpenAI از عمق بازگشتی استفاده میکند که یک پرسوجو را چندین بار در داخل شبکه پردازش میکند. محققان ایمنی نگرانند که بازگشت مبهم، ردپاهای زنجیره فکری خواناتری را به جا بگذارد، ردی که پس از انحراف ماموران سرکش استفاده میشود. باک شلگرس از ردوود، این گزارش را بسیار نگرانکننده خواند. زوی موشویتز پیشنهاد کرد که ممکن است برای متوقف کردن یک مسابقه نظارت به پایین، به قوانینی نیاز باشد. OpenAI میگوید استفاده آسترا از این تکنیک محدود است و تفکر باید همچنان قابل خواندن باشد. یاکوب پاچوکی گفت که حفظ زنجیره فکری قابل نظارت هنوز یک هدف اصلی تحقیق است.
Gemini 3.8 Flash چیست و قیمت آن چگونه است؟
گوگل، فلش Gemini 3.8، سومین مدل فلش خود در شش هفته، را به عنوان بهترین فلش استدلال و کدنویسی تاکنون، عرضه کرد. قیمتگذاری مقدماتی با ۳.۷ مطابقت دارد: ۰.۷۵ دلار برای هر میلیون توکن ورودی و ۳.۷۵ دلار برای هر میلیون خروجی. گوگل میگوید که این مدل با مراحل استدلال و فراخوانی ابزار بیشتر، در کارهای دشوار سختتر کار میکند و در حال پشت سر گذاشتن معیارهای مهندسی نرمافزار بلندمدت است که معمولاً متعلق به مدلهای بزرگتر و گرانتر است. فلش معمولی در حال حاضر در سراسر برنامه Gemini، حالت جستجوی هوش مصنوعی، Sheets، AI Studio و نسخه سازمانی در حال اجرا است.
Gemini 3.8 Flash Cyber چیست و چه کسانی میتوانند از آن استفاده کنند؟
Gemini 3.8 Flash Cyber نوعی از نرمافزار است که بر روی یافتن باگها و نوشتن وصلهها تمرکز دارد. دسترسی از طریق برنامه جدید Fairwind گوگل برای دولتهای مورد اعتماد و اپراتورهای زیرساختی مسدود شده است و فقط با دعوتنامه میتوان از آن استفاده کرد. طبق گزارشها، تیم امنیتی کروم با این نرمافزار ۲.۶ برابر وصلههای صحیحتری دریافت کرده است و تیم تحقیقات آسیبپذیری Cloud در کمتر از دو ساعت یک مشکل بحرانی را پیدا کرده است.
تفاوت بین کلود فابل ۵.۱ و میتوس ۵.۱ چیست؟
آنها از یک مدل زیربنایی یکسان با تنظیمات حفاظتی متفاوت استفاده میکنند. Fable 5.1 عموماً برای کدنویسی و کارهای دانشمحور در دسترس است، در حالی که Mythos 5.1 محدودیتهای سایبری و علوم زیستی را برای سازمانهای آمریکایی بررسیشده کاهش میدهد و گردش کار اسکن و وصلهگذاری Claude Security را تقویت میکند. امتیاز تحقیقات Agentic از 24.7٪ به 52.6٪ در Terminal-Bench-Science افزایش یافت. بارهای کاری معمول با هزینه توکن باید حدود 25٪ و بارهای کاری بسیار Agentic تا حدود 45٪ هزینه کمتری داشته باشند، که عمدتاً به دلیل خواندن حافظه پنهان ارزانتر است. Fable میتواند آسیبپذیریهای نرمافزاری را پیدا کند اما نمیتواند از آنها سوءاستفاده کند.
وضعیت برادکام در حوزه تراشههای هوش مصنوعی سفارشی چگونه است؟
درآمد سهماهه سوم برادکام ۲۹.۵۹ میلیارد دلار و سود تعدیلشده ۳.۳۲ دلار به ازای هر سهم بود که هر دو از وال استریت پیشی گرفتند و فروش تراشههای هوش مصنوعی بیش از سه برابر شد و به ۱۶.۷ میلیارد دلار رسید. سهام این شرکت پس از ساعات کاری همچنان کاهش یافت، زیرا پیشبینی حدود ۳۴.۸ میلیارد دلاری برای سهماهه چهارم، کمتر از انتظارات بود. هاک تان، مدیرعامل، خط تولید سیلیکون سفارشی شامل TPUهای Ironwood برای Anthropic و Google، Jalapeno برای OpenAI و تراشههای استنتاج MTIA شرکت Meta را توصیف کرد. او پیشبینی میکند درآمد هوش مصنوعی در سال مالی ۲۰۲۷ دو برابر شده و به ۱۱۵ میلیارد دلار و سپس در سال بعد به ۲۳۰ میلیارد دلار برسد.
آیا متا میوز اسپارک ۱.۳ یک مدل متنباز است؟
خیر. Muse Spark 1.3 قویترین مدل Meta تاکنون است، اما بسته، محدود و از طریق یک API پولی درآمدزایی میشود و این بهروزرسانی به Meta AI در سراسر فیسبوک و اینستاگرام راه یافته است. الکساندر وانگ، مدیر ارشد هوش مصنوعی، گفت که این مدل به OpenAI و Anthropic نزدیکتر میشود. Meta هنوز Muse Glimmer با وزن آزاد را برای GPUهای مصرفی ارائه میدهد، اما شرطبندی پیشرو اختصاصی است. خط تولید Muse از آوریل به سرعت تغییر کرده است، از ۱.۱ در جولای به ۱.۲ در اوایل آگوست و اکنون ۱.۳.
چرا محققان در این خلاصه اخبار هوش مصنوعی، از یک فاجعه ایمنی پیش از آسترا میترسند؟
خبرگزاری ورج گزارش میدهد که OpenAI پس از تأخیرهای مربوط به حملهی عوامل به اهداف واقعی در آزمایشها، همچنان به سمت Astra در حرکت است. رایان گرینبلات از ردوود هشدار داد که انتخابهای معماری مبهم ممکن است بدترین پیشرفت برای امنیت و ایمنی هوش مصنوعی تا به امروز باشند، زیرا میتوانند سیستمهایی ایجاد کنند که نمیتوانید بر آنها نظارت کنید. OpenAI به طور قطعی ترانسفورماتورهای حلقهای را تأیید یا رد نکرده است و میگوید که در حال اضافه کردن نظارت زنجیرهای فکری اضافی است. منابع ادعا میکنند که استفاده از عمق بازگشتی محدود شده است، بنابراین استدلال همچنان قابل بررسی است. نگرانی گرینبلات این است که تفکر فضای پنهان، تحقیقات به سبک Hugging Face را بسیار دشوارتر کند.