
گوگل و OpenAI هر دو امروز یک پیام مشابه را منتقل کردند: هوش مصنوعی اکنون به اندازهای سریع شده که برای کسانی که از عاملهای هوش مصنوعی استفاده میکنند، چشمگیر به نظر برسد، و هر دو شرکت مدلهای فوقسریع را معرفی کردند.
این دو راهاندازی به روشهای متفاوتی ساخته شدهاند و تنها یکی از آنها امروز واقعاً در دسترس شماست.
گوگل Gemini 3.7 Flash را عرضه کرد، جدیدترین مدل خود که برای کدنویسی نرمافزار و جریانهای کاری تجاری خودکار تنظیم شده است. OpenAI پیشنمایش محدودی از GPT-5.6 Sol Ultrafast را آغاز کرد، یک سطح خدمات جدید که قدرتمندترین مدل آن را با سرعت حداکثر 750 توکن خروجی در ثانیه اجرا میکند.
Today we're introducing Gemini 3.7 Flash, our most intelligent workhorse model yet for coding and agents.
This model brings substantial gains across software engineering, web development, and complex knowledge work.
Now through the end of the year, Gemini 3.7 Flash is available… pic.twitter.com/RSCBDipjKn
— Google (@Google) August 13, 2026
Gemini 3.7 Flash یک مدل با دسترسی عمومی است. این مدل تا یک میلیون توکن ورودی (تقریباً 750,000 کلمه) را میپذیرد و 64,000 توکن را بازمیگرداند، که قادر به پردازش متن، تصاویر، ویدئو، صدا و PDFها است و میتواند ابزارها را فراخوانی کرده و یک کامپیوتر را کنترل کند. گوگل آن را به عنوان مغز ارزانقیمت برای سیستمهای خودکار معرفی میکند که وظایف را برنامهریزی کرده و کارهای چند مرحلهای را با کمک انسانی کمتر به اتمام میرسانند.
این مدل کیفیت را فدای سرعت نمیکند. هم توانمندتر و هم کارآمدتر است و میتواند وظیفه کدنویسی آزمایشی ما را در 2 دقیقه و 13 ثانیه به پایان برساند، در حالی که مدل Flash قبلی بیش از 5 دقیقه طول کشید. شکاف کیفی بین این دو نیز قابل توجه است.
Ultrafast شرکت OpenAI یک مدل جدید نیست. این همان GPT-5.6 Sol است – همان مدلی که OpenAI از یک تیم قرمز هوش مصنوعی برای مقاومسازی آن در برابر حملات تزریق پرامپت قبل از عرضه استفاده کرد – که روی یک مسیر سریعتر و با قدرت پردازنده Cerebras، تولیدکننده تراشه، اجرا میشود. سرعت آن حدود 14 برابر سریعتر از سرعت استاندارد GPT-5.6 Sol است.
Previewing Ultrafast mode: GPT-5.6 Sol at up to 14x the speed.
Launching first in the OpenAI API to a select group of customers with expanded access to more businesses as capacity grows. pic.twitter.com/a5dleofiDJ
— OpenAI (@OpenAI) August 13, 2026
تراشههای ویفر-اسکال Cerebras تا 750 توکن در ثانیه، حدود 560 کلمه، تولید میکنند؛ سرعتی که برای یک عامل صوتی کافی است تا در حین مکالمه فکر کند.
برگه بنچمارک گوگل Gemini 3.7 Flash را در 11 دسته از 18 دسته آزمایش شده، از جمله امتیاز 1,588 الو در Code Arena برای توسعه وب و 30.4٪ در AutomationBench برای جریانهای کاری سازمانی، بالاتر از Claude Sonnet 5، GPT-5.6 Terra و دیگران قرار میدهد. اینها همگی بر اساس روششناسی گوگل است، بنابراین این برتری را به عنوان ادعای شرکت در نظر بگیرید.
مانند هر Gemini Flash، این مدل نیز ارزان است. با 75 سنت برای هر میلیون توکن ورودی و 3.75 دلار برای هر میلیون توکن خروجی تا پایان سال، این نرخ نصف نرخ اصلی Gemini 3.6 Flash است. این قیمت اولیه در 31 دسامبر منقضی میشود، سپس به 1.50 دلار و 7.50 دلار دو برابر میشود که هنوز برای یک مدل گوگل ارزان است.
OpenAI تاکنون امتیازات مقایسهای برای Ultrafast فراتر از نقل قولهای مشتریان منتشر نکرده است. جان کرپزی، مهندس هوش مصنوعی در Jane Street، در اطلاعیه OpenAI گفت که سرعت Cerebras "راههای متفاوتی برای استفاده از مدلها را فراهم میکند." کورتلند لیکینز، مدیر محصول Podium، آن را "در پشته صوتی ما بیارزش" خواند و گفت که سرعت "تجربه تماس را به طور کامل تغییر میدهد." این سطح خدمات فعلاً فقط با دعوتنامه در دسترس است.
تمرکز بر سرعت در حالی صورت میگیرد که آزمایشگاهها از "چه کسی باهوشتر است" به "چه کسی برای عاملها به اندازه کافی سریع است" تغییر میکنند. زمانبندی گوگل دقیق است. Gemini 3.5 Pro پرچمدار آن هنوز در دسترس نیست و تاریخ عرضهای برای آن اعلام نشده است، سه هفته پس از 3.6 Flash و چند روز پس از تغییرات در رهبری DeepMind که دِمیس هاسابیس را کنار زد و کوری کاوکجوغلو، معاون او را جایگزین کرد. در همین حال، OpenAI به جای اینکه منتظر پشته خود بماند، سرعت Cerebras را اجاره میکند.
Gemini 3.7 Flash اکنون در بیش از 160 کشور در دسترس است؛ GPT-5.6 Sol Ultrafast هنوز فقط با دعوتنامه قابل استفاده است.