
老叶

Новини
Новини
Grok 4.6 теж тут!
Він був випущений майже одночасно з DeepSeek-V4-Pro-0813!
Чесно кажучи, дивлячись на характеристики grok 4.6, я дуже зрадів! Grok 4.5 вже є однією з моїх улюблених моделей для щоденного використання, бо він дуже швидкий і не має надто великих обмежень, що робить його ідеальним для щоденного використання.
Однак цього разу Grok 4.6 безпосередньо налаштований на параметри, дуже близькі до двох флагманських моделей двох провідних брендів, і має вищі швидкості, ніж вони.
Грок старої мами цього разу справді на порядку денному! Я думаю, що це справді може замінити Gemini як нового гравця «Великої трійки»!

Офіційно оголошено! DeepSeek-V4-Pro-0813 скоро вийде!
Щойно офіційний документ на сайті DeepSeek розкрив ідентифікатор моделі офіційної версії DeepSeek-V4-Pro. Виходячи з дати, дата виходу має бути 13 серпня.
Крім того, офіційна версія V4-Pro почала підтримувати API Responses, що дозволяло використовувати його безпосередньо в кодексі без жодної конверсії.

Вибух — OpenAI цього разу справді безжальний.
Пакет Pro x20 щойно скинув мій кредитний ліміт, і я був повністю приголомшений
Тижнева квота, здається, зменшена лише до третини попередньої суми.
Не маленька рубка, а прямий розріз у м'якоті.
За останні два дні відвідування моделей OpenAI постійно перевантажувалися, з частими затримками, обмеженнями пропускної здатності та чергами.
Отже, тепер є лише два варіанти:
або є баг у конфігурації квоти,
Або ж OpenAI просто не може втриматися і активно посилює квоту користувачів Pro.
Якщо друге, то пакет Pro x20 має перерахувати співвідношення вартості та продуктивності.
Не впевнений, чи це поодинокий випадок.
Брати з X20, перевірте свою квоту і подивіться, чи її теж скоротили.
Деякі користувачі запитували: чому б просто не використати прямий :model_provider = "OpenAI"
Таким чином, ви також можете створювати зображення та шукати інформацію.
Дозвольте пояснити чому, бо більшість переведень уникають model_providers. OpenAI переважно використовує віддалений компакт, оскільки це синхронний запит, і багато CF, що використовуються для реле, мають ризик перевищення 100 секунд тайм-аутів. Якщо ви використовуєте власний зворотний проксі і не застосовуєте CF, то можете скористатися цим методом без додаткового перегляду.
Після зворотної обробки я виявив, що окрім виявлення model_providers, він також визначає заголовок авторизації x-openai-actor-authorization.
Тому, згідно з моїм планом, можна уникнути віддаленого компактного режиму, водночас отримуючи RAW зображення та пошук.
По-друге, навіщо нам це змінювати? Тому що я з'ясував, що десктопна версія Codex визначає заголовок openai-actor-authorization, але настільна версія наразі не є відкритою.
Раптова поява! Новий клієнт Codex таємно «знижує IQ» сторонніх ретрансляторів.
11 липня я виявив, що нова версія Codex не може генерувати зображення, і одразу випустив повне рішення.
Я думав, що це просто обмеження функції RAW, але після подальшого зворотного аналізу зрозумів, що все набагато складніше.
Як тільки новий Кодекс виявляє, що ви користуєтеся стороннім провайдером, він безпосередньо обмежує дві ключові можливості:
1. Генерація зображень
2、Веб-пошук
Якщо обмежити RAW-фото, це легко помітити.
Але саме тихе закриття веб-пошуку — це те, де можливості моделі мають справжнє значення.
Багато людей можуть не усвідомлювати, наскільки важливий веб-пошук.
Внутрішні бази знань великих моделей мають дедлайни; вони не знають, що щойно сталося сьогодні, і не можуть отримати доступ до останніх документів, новин і технологічних змін з повітря.
Тому постачальники моделей надають плагінам онлайн-пошуку в реальному часі, тобто веб-пошук.
Це еквівалентно «очам» моделі.
Без веб-пошуку моделі можуть покладатися лише на застарілі знання для відповідей на запитання;
Завдяки веб-пошуку він може в режимі реального часу шукати інформацію по всьому інтернету, перевіряти факти та читати останні документи.
Але тепер, якщо ви використовуєте сторонню ретрансляційну станцію в новому Кодексі, навіть якщо бекенд підключений до тієї ж легітимної моделі, клієнт може безпосередньо блокувати можливості веб-пошуку.
Модель не змінилася.
API не змінився.
Якщо провайдер не є офіційним, клієнт автоматично припиняє цю можливість.
Це справжнє значення «зниження інтелекту з боку клієнта».
Добра новина в тому, що після зворотного аналізу я знайшов способи обійти обмеження, відновити відтворення зображень і використовувати веб-пошук.
Я вже опублікував детальний посібник з модифікцій у своєму попередньому твіті:
Якщо ви користуєтеся сторонньою ретрансляційною станцією Codex, рекомендується перевірити це негайно.
Ви думаєте, що використовуєте ту саму модель, але насправді клієнт міг уже таємно скоротити витрати.
Ви можете переглянути порівняння до і після модифікації на доданому зображенні:




Цілий день глибокого досвіду з GPT-5.6-sol.
Моє ставлення пройшло приблизно три етапи:
Захоплення → сумніви → розуміння та прийняття.
Спершу поговоримо про момент, який легко заплутати:
Найвищий рівень інференції GPT-5.6-sol фактично є xhigh. Max і Ultra, показані в інтерфейсі, більше стосуються режиму робочого процесу клієнта, а не лише для того, щоб зробити модель «розумнішою».
Найбільш критикованим аспектом Ultra сьогодні є те, що він любить автоматично розподіляти велику кількість субагентів.
Навіть просте завдання може миттєво зібрати багато проксі і витратити велику кількість токенів. Весь процес може здаватися грандіозним, але реальні переваги можуть не відповідати вартості.
Коли я вперше почав ним користуватися, я був трохи скептично налаштований:
Це просто робота, чи просто демонстрація жетонів?
Пізніше, зрозумівши його механіку, я знизив рівень мислення до High і знову виконав реальні завдання, що насправді значно покращило досвід.
Він швидший за GPT-5.5 xhigh, має значно потужніші можливості та стабільність, а споживання токенів не таке перебільшене, як у Ultra.
Принаймні, з мого сьогоднішнього досвіду:
GPT-5.6-sol + High може бути найкращою комбінацією для щоденного використання зараз.
Для складного рефакторингу, повного перегляду проєктів та великих завдань, що потребують паралельного дослідження, також можна розглянути Ultra.
Немає потреби одразу максимально виконувати звичайні завдання розробки.
Ця модель не є непридатною для використання, і її не потрібно бездумно ставити на найвищу передачу.
Справжня проблема в тому, що багато людей навіть не зрозуміли різницю між Max, Ultra та рівнями інференції, перш ніж вже використовують Ultra як режим за замовчуванням.
Якщо використовувати правильно, це точно набагато краще, ніж 5.5.
Якщо використовувати його неправильно, можна лише спостерігати, як токени витікають у поспіх.
Вибачте, я був дуже необережним, будь ласка, пробачте мене!
Після цілого дня використання мені здалося, що 5,6 соль — це занадто повільно, а по-друге, це було надто суперечливо. Невелика проблема, чим більше її виправляєш, тим більшим стає діапазон!
Вибач, Ультрамен, цього разу я справді не можу тобою похвалитися! Після стількох років розпалювання, чи це воно?
Коли я дізнався, що 5.6 насправді розробляється на основі 5.4, я зрозумів, що вона приречена!

