Hacker News Digest

Тег: #gpt-5.6

Постов: 6

GPT-5.6 Sol Pricing Cut by 50% (openrouter.ai) 🔥 Горячее 💬 Длинная дискуссия

GPT-5.6 Sol — флагманская модель OpenAI из серии GPT-5.6, ориентированная на сложное рассуждение, программирование и агентные сценарии. Особенно эффективна в цепочках команд, длительных задачах и работе с командной строкой. В рамках ограниченного предложения сейчас доступна со скидкой 50 % — ввод $2,50, вывод $15 за миллион токенов, контекст до 1 млн токенов, актуальна с 9 июля 2026 года, база знаний обновлена до февраля 2026 года.

Модель размещается на нескольких провайдерах, а OpenRouter автоматически выбирает оптимальный вариант: Balanced — сочетание цены и скорости, Nitro — максимум быстродействия, Exacto — высокая точность вызова инструментов. Средняя фактическая стоимость составляет $0,87 ввода и $20,58 вывода за миллион токенов благодаря кэшированию и скидкам. В сравнении с другими провайдерами OpenAI предлагает лучшую комбинацию точности (GPQA Diamond ≈ 91 %) и скорости (латентность ≈ 3,6 с), при этом сохраняет высокую доступность 99,17 %. Эти цифры делают GPT-5.6 Sol привлекательным выбором для разработчиков, нуждающихся в надёжном и экономичном решении для сложных задач.

by Topfi • 17 августа 2026 г. в 21:03 • 522 points

ОригиналHN

#gpt-5.6#language-model#llm#openai#openrouter#pricing

Комментарии (338)

Скидка 50% на GPT-5.6 Sol доступна только через OpenRouter (вероятно, через Flex-тариф), не в официальной документации OpenAI. Пользователи отмечают, что Sol переусложняет простые задачи (например, превращая список дел в эссе), работает медленнее (32 токена/сек) и проигрывает предшественникам в скорости, но эффективен в сложных агентных сценариях. Конкуренция со стороны Kimi K3 и DeepSeek v4 Flash вынуждает снижать цены — Kimi K3 конкурирует с Sol по качеству при меньшей цене, DeepSeek вытесняет Gemini. Подписки Pro/Plus остаются выгоднее API даже со скидкой. Некоторые считают Sol регрессией, другие — прогрессом в коде и рассуждениях. Промпты для Claude не работают на Sol из-за различий в логике. Первоначальная цена Sol, вероятно, имела высокую маржу, позволяющую снизить цену вдвое. Скидка недоступна при включённом ZDR на OpenRouter. Действие OpenRouter связано с приобретением Stripe.

GPT 5.6 Sol is the best "vision" model OpenAI ever released (blog.roboflow.com) 🔥 Горячее

GPT‑5.6 Sol стал лучшей визуальной моделью, которую OpenAI представила до сих пор. В тестах на нашем предстоящем VLM‑бенчмарке, охватывающем детекцию, подсчёт, OCR и извлечение данных, Sol показал резкий рост: mAP@50 вырос с 13,8 у GPT‑5.5 до 46,2, а Terra и Luna набрали 44,7 и 43,3 соответственно. Это превратило объектное распознавание из слабого места в практичную возможность, особенно заметную в сложных сценах с множеством похожих предметов — например, таблеток, яиц или монет.

Пара ярких фактов: Sol обрабатывает документные макеты, выделяя заголовки, таблицы, подписи и подписи, а также умеет работать с плотными сценами, хотя иногда генерирует коробки в случайных местах, не совпадающих с реальными объектами. Стоимость и скорость тоже важны: Sol стоит около 2,5 ¢ за изображение и тратит ~10 секунд, Terra — ~6 секунд и ~1 ¢, а Luna — чуть более 5 секунд и < 0,5 ¢. При этом Gemini 3.5 Flash дешевле (0,8 ¢) и лидирует по точности при массовом использовании, делая его более выгодным для больших потоков данных.

by plurby • 17 августа 2026 г. в 12:09 • 276 points

ОригиналHN

#cost#gemini-3.5-flash#gpt-5.6#llm#object-detection#ocr#openai#speed#vision#vlm-benchmark

Комментарии (143)

GPT-5.6 Sol демонстрирует прогресс в визуальных задачах, но его практическая применимость ограничена высокой стоимостью, низкой скоростью (в 25–50 раз медленнее специализированных моделей) и ненадёжностью в production-сценариях. Gemini 3.5 Flash превосходит его по всем метрикам, кроме OCR, при трёхкратно меньшей цене, делая его предпочтительным для детекции и подсчёта. Локальные альтернативы — Qwen3.8 и MiniCPM-V-4.6 (0.8B) — показывают сопоставимую или лучшую производительность, особенно при требованиях к скорости, экономичности и работе на потребительском оборудовании. Подсчёт объектов, например таблеток, решается эффективнее классическими CV-методами (OpenCV), что ставит под сомнение ценность Sol в таких задачах. Sol ошибочно интерпретирует геометрию изображений (например, поворот монет на 90°) и галлюцинирует содержимое чёрных изображений, что указывает на фундаментальные проблемы понимания реальности. Он не распознаёт надёжно редкие или выцветшие кириллические надписи, несмотря на высокую точность в других OCR-задачах. Для распознавания нотной записи Sol показал неожиданно высокую точность, возможно, благодаря способности к сложному пространственному анализу. Для анализа изображений и кода лучше подходят модели OpenAI (Terra, Luna). Для обработки старых документов рекомендуется предварительная обработка изображений через Python. В задачах с низкой задержкой (например, робототехника в аптеках) Sol неприменим. Использование нескольких специализированных моделей (Fable, Gemini, Sol) по задачам эффективнее, чем полагаться на одну. Визуальные бенчмарки не учитывают глубину восприятия — отсутствие бинокулярных данных делает сравнение неполным, особенно для автономного вождения.

Accelerating GPT-5.6 Sol Ultrafast (cerebras.ai) 🔥 Горячее 💬 Длинная дискуссия

GPT-5.6 Sol на режиме Ultrafast от OpenAI в сочетании с Cerebras выдаёт до 750 токенов в секунду без потери качества, что резко ускоряет работу с критически важными задачами. Тесты на Humanity's Last Exam показали, что модель проанализировала 2 500 сложных вопросов за 11 ч 11 мин, тогда как Claude 5 потратил более трёх суток. На GDP‑Val Ultrafast ускорил выполнение экономически значимых задач в 5,6 раз, сохранив точность.

Техническая основа — уникальная архитектура Wafer‑Scale Engine Cerebras, где 44 ГБ SRAM находятся непосредственно на чипе, исключая дорогостоящее перемещение весов между памятью и процессором. Это позволяет токены свободно «течь» через слои модели, а при росте размеров моделей скорость сохраняется. Теперь пользователи могут использовать агенты в реальном времени: от мгновенного анализа сбоев в сервисах до быстрой реакции на кибератаки, что меняет подход к работе с высокими ставками.

by pr337h4m • 13 августа 2026 г. в 18:10 • 656 points

ОригиналHN

#cerebras#claude-5#gdp-val-ultrafast#gpt-5.6#humanitys-last-exam#llm#openai#token#wafer-scale-engine

Комментарии (258)

Тред дополняет статью информацией о потенциальных последствиях, применении и ограничениях технологии Ultrafast, а также сравнивает её с другими моделями и обсуждает затраты. Пользователи согласны, что Ultrafast может революционизировать работу с критически важными задачами, где скорость обработки влияет на качество решений. Особенно полезна для кодирования и анализа данных. Однако предупреждают: технология может быть недоступна всем, сопряжена с высокими затратами и несет риск потери качества при увеличении скорости. Рекомендуется использовать специализированное оборудование для максимальной эффективности.

Improving GPT‑5.6 Sol in ChatGPT, expanding GPT‑5.6 Luna access for free users (openai.com) 💬 Длинная дискуссия

GPT‑5.6 Sol — новая версия, адаптированная под привычный стиль общения в ChatGPT. Она даёт более лаконичные ответы, повышает точность фактов и делает диалоги последовательнее: от быстрых «одно‑два‑слов» до более глубоких, продуманных выводов. Пользователи могут регулировать «умовую глубину» мышления с помощью ползунка, выбирая, насколько тщательно модель будет рассуждать.

Бесплатным пользователям теперь доступен GPT‑5.6 Luna — модель, которая заменяет прежний GPT‑5.6 Turbo в режиме «без ограничений». При необходимости более сложных рассуждений есть кнопка Think, позволяющая переключиться на более «глубокое» рассуждение. На платных тарифах Plus и Pro улучшенный GPT‑5.6 Sol будет доступен по‑умолчанию, а бесплатные пользователи получат неограниченное количество текстовых запросов и возможность использовать Think для сложных задач. Цифра, запомнившаяся: более 1 млрд человек еженедельно используют ChatGPT.

by tedsanders • 06 августа 2026 г. в 17:02 • 221 points

ОригиналHN

#gpt-5.6#gpt-5.6-luna#gpt-5.6-sol#llm#openai#think#turbo

Комментарии (163)

Пользователи отмечают значительное улучшение моделей GPT-5.6 Sol и Luna по точности и последовательности ответов по сравнению с предыдущими версиями. Споры идут о ползунке регулирования уровня рассуждений: одни считают его излишне сложным, другие — ценят за повышение точности ответов. Некоторые советуют использовать ползунок для сложных задач, а простые модели — для быстрых вопросов. Также обсуждается доступ Luna для бесплатных пользователей: одни видят в этом ограниченное улучшение, другие — важную возможность получить более точные ответы.

Advancing the price-performance frontier with GPT‑5.6 (openai.com) 🔥 Горячее 💬 Длинная дискуссия

OpenAI представила GPT-5.6 — модель, значительно улучшившую соотношение цены и производительности. GPT-5.6 Luna, самый быстрый и дешёвый вариант, стал на 80% доступнее, а Terra — на 20%. Это позволяет бизнесам масштабно использовать ИИ для сложных задач: многопроцессные рабочие потоки, интеграция с инструментами и высококачественный анализ данных при минимальных затратах. При этом Sol, наиболее мощная версия, работает быстрее в API, ускоряя время отклика для критически важных приложений.

Эти изменения основаны на внутренней оптимизации архитектуры: каждый слой модели стал эффективнее, что позволило снизить стоимость вычислений без потери качества. OpenAI подчёркивает, что доступность передовых моделей — ключевой элемент её миссии по обеспечению выгод от AGI для всех. Снижение цен отражено и в подписках Codex и ChatGPT Work, что делает ИИ-инструменты более доступными для команд и разработчиков. Теперь даже малые компании могут внедрять сложные ИИ-решения без значительных инвестиций.

by tedsanders • 30 июля 2026 г. в 17:15 • 422 points

ОригиналHN

#agi#api#chatgpt-work#cloud-computing#codex#cost-optimization#gpt-5.6#language-model#llm#openai

Комментарии (276)

Пользователи делятся опытом эксплуатации GPT-5.6 Luna, отмечая её высокую скорость, конкурентоспособную производительность и лучшее соотношение цены и качества по сравнению с более дорогими моделями. Снижение цены на GPT-5.6 Luna воспринимается как значимое событие, способное увеличить спрос и расширить доступность для бизнеса и частных лиц. Рекомендуется использовать её как основную модель или в комбинации с другими для оптимизации затрат. Однако некоторые выражают сомнения: снижение цены может повысить нагрузку на инфраструктуру и увеличить затраты на поддержку.

Exploit brokers pay $500k for WordPress RCEs. I found one with GPT5.6 and $25 (slcyber.io) 🔥 Горячее

Эксплуатационные брокеры готовы платить до $500 000 за ноль-день уязвимость в WordPress, способную дать удалённый кодовый доступ (RCE). Автор статьи, используя модель GPT-5.6 Sol Ultra, обнаружил такую уязвимость всего за $25 — стоимость API-запросов. Уязвимость возникла из-за неожиданного взаимодействия между устаревшим плагином и новой функцией обработки шаблонов, которую ИИ смог выявить, проанализировав тысячи строк кода и паттернов ошибок, недоступных для традиционных сканеров.

Исследование демонстрирует, как современные ИИ-инструменты радикально снижают барьеры для поиска уязвимостей: ранее требовавшие месяцев работы экспертов, теперь можно найти за часы с минимальными затратами. Это ставит под угрозу безопасность десятков миллионов сайтов на WordPress, особенно тех, что используют неподдерживаемые плагины. Автор подчёркивает, что даже незначительные изменения в коде плагина могут порождать критические уязвимости, которые люди просто не замечают — но ИИ находит мгновенно.

by infosecau • 20 июля 2026 г. в 08:13 • 261 points

ОригиналHN

#exploit-broker#gpt-5.6#llm#plugin#rce#sol-ultra#wordpress

Комментарии (137)

Обсуждение сомневается в реальности выплаты $500k за уязвимость: подтверждённых случаев нет, брокеры вроде Zerodium платят по частям до устранения бага, а автор связан с компанией, продающей ИИ-сканеры, что бьёт по объективности. Заявленные «$25 на API» игнорируют годы опыта и множество неудачных попыток, лежащих за находкой; заслугу нельзя приписывать ИИ — вклад вносит человек, знающий, где искать и как формулировать промпты. Спорят, почему GPT-5.6 не заблокировал такие промпты (возможно, ослабленные guardrails) и почему брокеры платят автору, а не используют модель сами. WordPress остаётся уязвимым из-за огромной экосистемы плагинов и устаревшей архитектуры, хотя SQL-инъекции через конкатенацию давно ловят SAST и код-ревью. Часть участников подозревает, что история и запутанные идентификаторы выдуманы ради эффектного поста, без упоминания репорта или патча.