اخبار هوش مصنوعی، ۲ سپتامبر ۲۰۲۶

خلاصه اخبار و آزمون هوش مصنوعی: ۲ سپتامبر ۲۰۲۶

تکنیک استدلال جدید OpenAI، متخصصان ایمنی هوش مصنوعی را نگران کرده است

طبق گزارش‌ها، مدل آتی آسترا از شرکت OpenAI بر «عمق بازگشتی» تکیه دارد، یک ترفند استدلال حلقه‌ای که یک پرس‌وجو را چندین بار در داخل شبکه پردازش می‌کند. متخصصان ایمنی در مورد آن نگران نیستند. نگرانی این است که بازگشت مبهم، ردپاهای زنجیره فکری خواناتری از خود به جا می‌گذارد، که دقیقاً همان ردی است که محققان پس از انحراف آن عوامل سرکش از آن استفاده کردند.

باک شلگریس از ردوود این گزارش را «بسیار نگران‌کننده» خواند و زوی موشویتز اظهار داشت که ممکن است برای متوقف کردن یک مسابقه نظارت به پایین، به قوانینی نیاز باشد. OpenAI می‌گوید استفاده آسترا از این تکنیک محدود است و تفکر مدل هنوز باید قابل خواندن باشد... یا حداقل اینطور ادعا می‌کند. یاکوب پاچوکی، دانشمند ارشد، تأکید کرد که حفظ زنجیره فکری قابل نظارت هنوز یک هدف اصلی تحقیق است، حتی در حالی که The Information می‌گوید Anthropic و Google DeepMind نیز در حال حاضر این ایده را مطرح می‌کنند. زمان‌بندی به طرز عجیبی رقابتی است. (TechCrunch)

معرفی Gemini 3.8 Flash و 3.8 Flash Cyber

گوگل سومین مدل فلش خود را در شش هفته عرضه کرد و روند عرضه کمی گیج‌کننده شده است. Gemini 3.8 Flash به عنوان بهترین فلش استدلال و کدنویسی تاکنون معرفی شده است، هنوز هم با همان قیمت اولیه ۳.۷: ۰.۷۵ دلار به ازای هر میلیون توکن ورودی و ۳.۷۵ دلار به ازای هر میلیون خروجی. گوگل می‌گوید که این مدل در کارهای دشوار سخت‌تر عمل می‌کند - مراحل استدلال بیشتر، فراخوانی ابزارهای بیشتر - و در حال پشت سر گذاشتن معیارهای مهندسی نرم‌افزار بلندمدت است که معمولاً متعلق به مدل‌های بزرگ‌تر و گران‌تر است.

در کنار آن، Gemini 3.8 Flash Cyber ​​قرار دارد، یک نسخه متمرکز بر مدافع برای یافتن اشکالات و نوشتن وصله‌ها، که از طریق یک برنامه جدید Fairwind برای دولت‌های مورد اعتماد و اپراتورهای زیرساختی، محافظت می‌شود. طبق گزارش‌ها، تیم امنیتی کروم با آن ۲.۶ برابر وصله‌های صحیح‌تر دریافت کرده است و تیم تحقیقات آسیب‌پذیری Cloud در کمتر از دو ساعت یک مشکل بحرانی را پیدا کرده است. Flash معمولی در حال اجرا در سراسر برنامه Gemini، حالت جستجوی هوش مصنوعی، Sheets، AI Studio و سازمانی است. Cyber ​​فقط با دعوت‌نامه باقی می‌ماند، که... بله، احتمالاً برای بهترین‌ها. (گوگل)

شرکت Anthropic بازی‌های Claude Fable 5.1 و Mythos 5.1 را منتشر کرد

شرکت آنتروپیک، Claude Fable 5.1 را برای هر کسی که توانایی پرداخت دارد و Claude Mythos 5.1 را برای یک باشگاه دسترسی قابل اعتماد بسیار کوچک‌تر عرضه کرد. مدل زیربنایی یکسان، اما تنظیمات حفاظتی متفاوت. Fable هیولای کدنویسی و کار دانش‌محورِ در دسترس عموم است؛ Mythos محدودیت‌های سایبری و علوم زیستی را برای سازمان‌های معتبر آمریکایی کاهش می‌دهد و همچنین گردش کار اسکن و وصله‌گذاری Claude Security را تقویت می‌کند.

جهش علمی همان جهشی بود که باعث شد دوباره به خودم نگاه کنم: امتیاز تحقیقات عامل‌محور در Terminal-Bench-Science از ۲۴.۷٪ به ۵۲.۶٪ افزایش یافت. بارهای کاری معمول با صورتحساب توکن باید حدود ۲۵٪ و بارهای کاری بسیار عامل‌محور تا حدود ۴۵٪ هزینه کمتری داشته باشند، که بیشتر به دلیل خواندن حافظه نهان ارزان‌تر است. Enterprise Frontier Safeguards که داده‌ها را روی ابر خود مشتری با صفر نگهداری انسان‌محور ذخیره می‌کند، از اواخر پاییز شروع به کار می‌کند. Fable می‌تواند آسیب‌پذیری‌های نرم‌افزاری را پیدا کند، اما مهم‌تر از همه، نمی‌تواند از آنها سوءاستفاده کند - یک نکته کاملاً واضح پس از تمام درام فرار عامل‌محور در تابستان امسال. (Silicon Republic)

برودکام با دو برابر شدن سرمایه‌گذاری آزمایشگاه‌های هوش مصنوعی روی تراشه‌های سفارشی، فراتر از انتظارات ظاهر شد

آمار سه‌ماهه سوم برادکام بسیار خوب بود: ۲۹.۵۹ میلیارد دلار درآمد و سود تعدیل‌شده ۳.۳۲ دلار به ازای هر سهم، که هر دو از وال استریت جلوتر بودند. فروش تراشه‌های هوش مصنوعی بیش از سه برابر شد و به ۱۶.۷ میلیارد دلار رسید. سپس سهام همچنان پس از ساعات کاری کاهش یافت زیرا پیش‌بینی حدود ۳۴.۸ میلیارد دلاری برای سه‌ماهه چهارم کمتر از پیش‌بینی‌های وال استریت بود. یک جهش ناگهانی در درآمد تراشه‌ها.

هاک تان، مدیرعامل، در این تماس تلفنی به طراحی یک خط لوله سیلیکونی سفارشی پرداخت که تقریباً به طرز کارتونی بزرگی به نظر می‌رسد - سرعت بخشیدن به TPU های Ironwood برای Anthropic و Google، ارسال Jalapeno برای OpenAI و افزایش سرعت تراشه‌های استنتاج MTIA Meta. او پیش‌بینی می‌کند که درآمد هوش مصنوعی در سال مالی 2027 دو برابر شده و به 115 میلیارد دلار و سپس دوباره به 230 میلیارد دلار در سال بعد برسد، و استقرارهایی در مقیاس گیگاوات برای Anthropic، OpenAI و Meta در نظر گرفته شده است. مطمئناً انویدیا هنوز هم در کانون توجه قرار دارد، اما Broadcom بی‌سروصدا در حال تبدیل شدن به طراح مشترک انتخابی است، زمانی که Big Tech تراشه‌هایی را می‌خواهد که از رده خارج نباشند. (SiliconANGLE)

متا از قدرتمندترین مدل هوش مصنوعی خود رونمایی می‌کند و به رقبای برتر خود نزدیک می‌شود

متا، میوز اسپارک ۱.۳ را منتشر کرد و آن را قوی‌ترین مدل این شرکت تا به امروز نامید، و الکساندر وانگ، مدیر ارشد هوش مصنوعی، گفت که این مدل به OpenAI و Anthropic نزدیک‌تر می‌شود. توسعه‌دهندگان به API پولی دسترسی پیدا می‌کنند و این به‌روزرسانی به Meta AI در فیس‌بوک، اینستاگرام و دوستان می‌رسد. این یک هدیه دیگر از لاما نیست. میوز اسپارک بسته، محدود و پولی است - یک چرخش کاملاً واضح از دوران وزن‌های باز که متا را به یک توسعه‌دهنده محبوب تبدیل کرد.

خط تولید Muse از ماه آوریل به سرعت در حال پیشرفت بوده است: ۱.۱ در ماه جولای، ۱.۲ در اوایل آگوست و اکنون ۱.۳. متا هنوز یک محصول جانبی با وزن آزاد به نام Muse Glimmer برای پردازنده‌های گرافیکی مصرفی دارد، اما شرط‌بندی پیشرو، اختصاصی است. با توجه به پیش‌بینی‌های هزینه سرمایه‌ای در محدوده ۱۳۰ تا ۱۴۵ میلیارد دلار در سال جاری، این شرکت طوری هزینه می‌کند که انگار معتقد است «هوش مصنوعی شخصی» یک نقشه راه محصول است، نه یک شعار. پر کردن این فاصله با ۱.۳ هنوز اثبات نشده است. (CryptoBriefing)

محققان از فاجعه امنیتی پیش از انتشار آسترا توسط OpenAI می‌ترسند

برداشت ورج از آسترا حتی از نوشته‌ی تک‌کرانچ هم دشوارتر است. پس از هفته‌ها تأخیر مرتبط با حمله‌ی عوامل به اهداف واقعی در آزمایش، OpenAI هنوز به آرامی به سمت انتشار پیش می‌رود - و رایان گرینبلات از ردوود هشدار داد که انتخاب‌های معماری مبهم «ممکن است بدترین پیشرفت برای امنیت/ایمنی هوش مصنوعی تا به امروز باشند». ترس او از رقابتی به سمت سیستم‌هایی است که به سادگی نمی‌توانید بر آنها نظارت کنید.

OpenAI به طور قطعی ترانسفورماتورهای حلقه‌ای را برای Astra تأیید یا رد نکرده است و در عوض به پست‌های Pachocki در مورد زنده نگه داشتن نظارت زنجیره‌ای فکر اشاره کرده است. این شرکت گفته است که نظارت CoT اضافی را برای پرتاب اضافه می‌کند و منابع ادعا می‌کنند که استفاده از عمق بازگشتی محدود شده است، بنابراین استدلال قابل بررسی باقی می‌ماند. شمارنده گرینبلات صریح است: اگر آزمایشگاه‌ها بیشتر به تفکر فضای پنهان تکیه کنند، تحقیقات به سبک Hugging Face که به ردپاهای قابل خواندن وابسته بودند، بسیار سخت‌تر می‌شوند. بخش قابل توجهی از مبارزه امروز برای ایمنی هوش مصنوعی واقعاً در مورد این است که آیا ما هنوز می‌توانیم تکالیف مدل را بخوانیم یا خیر. (The Verge)

سوالات متداول

مهم‌ترین اخبار در جمع‌بندی اخبار هوش مصنوعی برای دوم سپتامبر ۲۰۲۶ چه بودند؟

این خلاصه، نگرانی‌های ایمنی پیرامون استدلال عمقی مکرر OpenAI Astra، فلش Gemini 3.8 و فلش سایبرِ فقط دعوتی گوگل، و Claude Fable 5.1 و Mythos 5.1 از شرکت Anthropic را پوشش داد. همچنین، موج تراشه هوش مصنوعی سفارشی Broadcom، مدل بسته Muse Spark 1.3 از شرکت Meta و هشدار محققان مبنی بر اینکه معماری مبهم می‌تواند نظارت بر سیستم‌های هوش مصنوعی را دشوارتر کند، پوشش داده شد.

چرا متخصصان ایمنی هوش مصنوعی از تکنیک عمق بازگشتی OpenAI نگران هستند؟

طبق گزارش‌ها، مدل آتی آسترا از OpenAI از عمق بازگشتی استفاده می‌کند که یک پرس‌وجو را چندین بار در داخل شبکه پردازش می‌کند. محققان ایمنی نگرانند که بازگشت مبهم، ردپاهای زنجیره فکری خواناتری را به جا بگذارد، ردی که پس از انحراف ماموران سرکش استفاده می‌شود. باک شلگرس از ردوود، این گزارش را بسیار نگران‌کننده خواند. زوی موشویتز پیشنهاد کرد که ممکن است برای متوقف کردن یک مسابقه نظارت به پایین، به قوانینی نیاز باشد. OpenAI می‌گوید استفاده آسترا از این تکنیک محدود است و تفکر باید همچنان قابل خواندن باشد. یاکوب پاچوکی گفت که حفظ زنجیره فکری قابل نظارت هنوز یک هدف اصلی تحقیق است.

Gemini 3.8 Flash چیست و قیمت آن چگونه است؟

گوگل، فلش Gemini 3.8، سومین مدل فلش خود در شش هفته، را به عنوان بهترین فلش استدلال و کدنویسی تاکنون، عرضه کرد. قیمت‌گذاری مقدماتی با ۳.۷ مطابقت دارد: ۰.۷۵ دلار برای هر میلیون توکن ورودی و ۳.۷۵ دلار برای هر میلیون خروجی. گوگل می‌گوید که این مدل با مراحل استدلال و فراخوانی ابزار بیشتر، در کارهای دشوار سخت‌تر کار می‌کند و در حال پشت سر گذاشتن معیارهای مهندسی نرم‌افزار بلندمدت است که معمولاً متعلق به مدل‌های بزرگ‌تر و گران‌تر است. فلش معمولی در حال حاضر در سراسر برنامه Gemini، حالت جستجوی هوش مصنوعی، Sheets، AI Studio و نسخه سازمانی در حال اجرا است.

Gemini 3.8 Flash Cyber ​​چیست و چه کسانی می‌توانند از آن استفاده کنند؟

Gemini 3.8 Flash Cyber ​​نوعی از نرم‌افزار است که بر روی یافتن باگ‌ها و نوشتن وصله‌ها تمرکز دارد. دسترسی از طریق برنامه جدید Fairwind گوگل برای دولت‌های مورد اعتماد و اپراتورهای زیرساختی مسدود شده است و فقط با دعوت‌نامه می‌توان از آن استفاده کرد. طبق گزارش‌ها، تیم امنیتی کروم با این نرم‌افزار ۲.۶ برابر وصله‌های صحیح‌تری دریافت کرده است و تیم تحقیقات آسیب‌پذیری Cloud در کمتر از دو ساعت یک مشکل بحرانی را پیدا کرده است.

تفاوت بین کلود فابل ۵.۱ و میتوس ۵.۱ چیست؟

آنها از یک مدل زیربنایی یکسان با تنظیمات حفاظتی متفاوت استفاده می‌کنند. Fable 5.1 عموماً برای کدنویسی و کارهای دانش‌محور در دسترس است، در حالی که Mythos 5.1 محدودیت‌های سایبری و علوم زیستی را برای سازمان‌های آمریکایی بررسی‌شده کاهش می‌دهد و گردش کار اسکن و وصله‌گذاری Claude Security را تقویت می‌کند. امتیاز تحقیقات Agentic از 24.7٪ به 52.6٪ در Terminal-Bench-Science افزایش یافت. بارهای کاری معمول با هزینه توکن باید حدود 25٪ و بارهای کاری بسیار Agentic تا حدود 45٪ هزینه کمتری داشته باشند، که عمدتاً به دلیل خواندن حافظه پنهان ارزان‌تر است. Fable می‌تواند آسیب‌پذیری‌های نرم‌افزاری را پیدا کند اما نمی‌تواند از آنها سوءاستفاده کند.

وضعیت برادکام در حوزه تراشه‌های هوش مصنوعی سفارشی چگونه است؟

درآمد سه‌ماهه سوم برادکام ۲۹.۵۹ میلیارد دلار و سود تعدیل‌شده ۳.۳۲ دلار به ازای هر سهم بود که هر دو از وال استریت پیشی گرفتند و فروش تراشه‌های هوش مصنوعی بیش از سه برابر شد و به ۱۶.۷ میلیارد دلار رسید. سهام این شرکت پس از ساعات کاری همچنان کاهش یافت، زیرا پیش‌بینی حدود ۳۴.۸ میلیارد دلاری برای سه‌ماهه چهارم، کمتر از انتظارات بود. هاک تان، مدیرعامل، خط تولید سیلیکون سفارشی شامل TPUهای Ironwood برای Anthropic و Google، Jalapeno برای OpenAI و تراشه‌های استنتاج MTIA شرکت Meta را توصیف کرد. او پیش‌بینی می‌کند درآمد هوش مصنوعی در سال مالی ۲۰۲۷ دو برابر شده و به ۱۱۵ میلیارد دلار و سپس در سال بعد به ۲۳۰ میلیارد دلار برسد.

آیا متا میوز اسپارک ۱.۳ یک مدل متن‌باز است؟

خیر. Muse Spark 1.3 قوی‌ترین مدل Meta تاکنون است، اما بسته، محدود و از طریق یک API پولی درآمدزایی می‌شود و این به‌روزرسانی به Meta AI در سراسر فیس‌بوک و اینستاگرام راه یافته است. الکساندر وانگ، مدیر ارشد هوش مصنوعی، گفت که این مدل به OpenAI و Anthropic نزدیک‌تر می‌شود. Meta هنوز Muse Glimmer با وزن آزاد را برای GPUهای مصرفی ارائه می‌دهد، اما شرط‌بندی پیشرو اختصاصی است. خط تولید Muse از آوریل به سرعت تغییر کرده است، از ۱.۱ در جولای به ۱.۲ در اوایل آگوست و اکنون ۱.۳.

چرا محققان در این خلاصه اخبار هوش مصنوعی، از یک فاجعه ایمنی پیش از آسترا می‌ترسند؟

خبرگزاری ورج گزارش می‌دهد که OpenAI پس از تأخیرهای مربوط به حمله‌ی عوامل به اهداف واقعی در آزمایش‌ها، همچنان به سمت Astra در حرکت است. رایان گرینبلات از ردوود هشدار داد که انتخاب‌های معماری مبهم ممکن است بدترین پیشرفت برای امنیت و ایمنی هوش مصنوعی تا به امروز باشند، زیرا می‌توانند سیستم‌هایی ایجاد کنند که نمی‌توانید بر آنها نظارت کنید. OpenAI به طور قطعی ترانسفورماتورهای حلقه‌ای را تأیید یا رد نکرده است و می‌گوید که در حال اضافه کردن نظارت زنجیره‌ای فکری اضافی است. منابع ادعا می‌کنند که استفاده از عمق بازگشتی محدود شده است، بنابراین استدلال همچنان قابل بررسی است. نگرانی گرینبلات این است که تفکر فضای پنهان، تحقیقات به سبک Hugging Face را بسیار دشوارتر کند.

اخبار دیروز هوش مصنوعی: ۱ سپتامبر ۲۰۲۶

جدیدترین هوش مصنوعی را در فروشگاه رسمی دستیار هوش مصنوعی پیدا کنید

درباره ما

مسابقه خبری فناوری و زیرساخت هوش مصنوعی: دوم سپتامبر 2026
۱. چرا متخصصان ایمنی هوش مصنوعی از مدل آتی آسترا از OpenAI نگران هستند؟

۲. گوگل چگونه Gemini 3.8 Flash را قیمت‌گذاری می‌کند و چه کسانی می‌توانند از Flash Cyber ​​استفاده کنند؟

۳. تفاوت بین کلود فابل ۵.۱ و میتوس ۵.۱ چیست؟

۴. برودکام در مورد کسب و کار تراشه هوش مصنوعی خود چه گزارشی ارائه داد؟

۵. آیا Muse Spark 1.3 از شرکت متا یک مدل متن‌باز است؟


بازگشت به وبلاگ