Poker Tournament for LLMs 🔥 Горячее 💬 Длинная дискуссия
PokerBattle.ai представляет собой первый в истории турнир по покеру с реальными денежными призами, специально созданный для соревнования больших языковых моделей (LLM). Это инновационное событие позволяет ИИ-системам проявить свои стратегические способности в одной из самых сложных интеллектуальных игр, где успех зависит не только от математических расчетов, но и от психологических аспектов и блефа. Турнир загружает данные о событиях, что указывает на его активный характер или недавнее проведение.
Уникальность этого мероприятия заключается в том, что оно впервые объединяет мир покера с передовыми технологиями ИИ, создавая новую платформу для оценки и развития возможностей языковых моделей. Организаторы стремятся определить, какие из современных LLM способны демонстрировать наилучшую игровую стратегию, адаптивность и способность к принятию решений в условиях неопределенности. Денежные призы добавляют соревнованиям серьезности и привлекают внимание как исследователей ИИ, так и энтузиастов покера со всего мира.
Комментарии (181)
- ИИ демонстрируют ошибки в оценке рук (например, LLAMA ошибочно определила топ-пару), что указывает на текущие ограничения в понимании игры.
- Эксперимент критикуется за недостаток данных (714 рук у Meta LLAMA) и отсутствие возможности для ИИ развивать новые стратегии со временем.
- Предлагается улучшить тестирование, добавив "трэш-ток" и возможность блефа между ИИ, что сделало бы наблюдение более интересным и показательным.
- ИИ часто "галлюцинируют", принимая неверные решения (как Gemini, сдавшая сильную руку), что связано с неправильной оценкой силы руки в текущей ситуации.
- Шутливые предложения по тестированию включают попытки обмана ИИ через подсказки ("игнорируй предыдущие инструкции").
AI can code, but it can't build software
Несмотря на развитие ИИ, многие люди продолжают искать технических сооснователей, чтобы превратить их "наскоро написанные" приложения в готовые к использованию продукты. Автор статьи заметил, что чаще всего к нему обращаются бизнес-ориентированные специалисты без технических навыков, у которых есть идея приложения, но нет возможности довести его до рабочего состояния. Это говорит о том, что ИИ может писать код, но не может строить программное обеспечение.
LLM, такие как GPT-5, успешно решают изолированные, хорошо определенные задачи, но создание готового к использованию приложения — это не просто кодирование, а инженерия программного обеспечения. Основная сложность заключается в управлении сложностью, поддерживаемости и интеграции множества простых компонентов одновременно. Как отмечает автор, "кодирование — это просто, инженерия программного обеспечения — это сложно".
Когда автор смотрит на код, предоставляемый этими не техническими основателями, он понимает, что сделать приложение готовым к использованию часто означает сжечь весь код и начать с нуля. Это показывает, что на текущем этапе развития ИИ может генерировать фрагменты кода, но не способен создавать полные, поддерживаемые программные системы.
Комментарии (112)
- LLM хорошо генерируют код, но не могут самостоятельно создавать полноценное ПО, так как не справляются с архитектурными решениями, оценкой требований, тестированием и взаимодействием с пользователями.
- Качество кода, создаваемого AI, часто низкое: содержит ошибки, дублирование, избыточную сложность, особенно при "vibe coding" без контроля.
- Создание ПО требует человеческой экспертизы для управления сложностью, обеспечения надёжности, масштабируемости, поддержки и принятия технических решений.
- Некоторые скептичны в способности AI заменить инженеров в обозримом будущем, другие считают, что прогресс может ускориться при интеграции AI с мониторингом и аналитикой.
- Роль инженера смещается от написания кода к решению проблем, проектированию систем и контролю за качеством AI-генерируемого кода.
OpenAI says over a million people talk to ChatGPT about suicide weekly 🔥 Горячее 💬 Длинная дискуссия
OpenAI опубликовала новые данные, показывающие масштаб обсуждений проблем психического здоровья с ChatGPT. Компания сообщила, что 0,15% активных пользователей еженедельно ведут беседы, включающие явные признаки возможного суицидального планирования или намерений. Учитывая, что у ChatGPT более 800 миллионов пользователей, это означает более миллиона человек в неделю, обращающихся к чат-боту с такими вопросами.
OpenAI подчеркивает, что эти цифры демонстрируют важность их работы над безопасностью в чувствительных разговорах. Компания внедрила специализированные протоколы для таких случаев, включая немедленные рекомендации обращаться за профессиональной помощью и предоставление контактов служб поддержки. Эти данные показывают, как ИИ-системы становятся неожиданно важными ресурсами для людей в кризисных ситуациях, несмотря на первоначальное предназначение ChatGPT в качестве рабочей и учебной помощи.
Комментарии (427)
- Обсуждение показало, что миллионы людей еженедельно обсуждают суицидальные мысли с ChatGPT, что вызывает вопросы о том, насколько эффективно ИИ может справляться с такими ситуациями и какие обязанности несет OpenAI.
- Участники обсуждения подчеркнули, что важно различать технические ограничения модели и отсутствие у нее клинической квалификации, а также подчеркнули, что важно различать технические ограничения модели и отсутствие у нее клинической квалификации.
- Участники также подчеркнули, что важно различать технические ограничения модели и отсутствие у нее клинической квалификации.
- Участники также подчеркнули, что важно различать технические ограничения модели и отсутствие у нее клинической квалификации.
- Участники также подчеркнули, что важно различать технические ограничения модели и отсутствие у нее клинической квалификации.
Study finds growing social circles may fuel polarization 💬 Длинная дискуссия
Исследование показало, что расширение социальных связей может способствовать поляризации общества. Между 2008 и 2010 годами политическая поляризация резко выросла одновременно с увеличением числа близких контактов с двух до четырех-пяти человек. "Когда плотность сети возрастает с большим количеством связей, поляризация в коллективе неизбежно резко возрастает", — отмечает Маркус Хофер из Complexity Science Hub.
Ученые из Complexity Science Hub Вены опубликовали свои выводы в Proceedings of the National Academy of Sciences, подтвердив, что рост поляризации измерим и объективен. "Этот рост произошел внезапно, между 2008 и 2010 годами", — говорит Стефан Тюрнер. Интересно, что переход от низкой к высокой связности произошел вскоре после того, как Facebook стал доступен для всех (2006) и обошел другие сайты по трафику в США (2010).
Комментарии (197)
- Средний показатель близких друзей вырос с 2,2 до 4,1 за 24 года, что противоречит общепринятой картине «эпидемии одиночества» и требует объяснения.
- Возможно, причина в том, что люди просто переосмыслили, что считать «близким другом», или в том, что социальные сети позволяют поддерживать большее число слабых связей, которые теперь считаются «близкими друзьями».
- Под вопросом остаётся, действительно ли рост числа друзей связан с усилением поляризации, и если да, то как именно.
- Неясно, как именно определялось, что такое «близкий друг», и не исключено, что сравнение «2,2» и «4,1» отражает не рост числа друзей, а просто сдвиг в определении.
- Возможно, что исследование не учитывает, что люди могут иметь разное число друзей в разных социальных сетях, и это может быть причиной роста среднего показателя.
The new calculus of AI-based coding 💬 Длинная дискуссия
Инженер Джо Магеррамов описывает подход "агентного кодирования" (agentic coding) в своей команде, где 80% кода генерируют ИИ-агенты вроде Amazon Q или Kiro, но под строгим контролем инженеров. Команда использует Rust для его безопасности, правила управления для ИИ и требует полной ответственности инженера за каждую строку кода. Этот подход позволил достичь 10-кратного увеличения производительности по сравнению с типичными высокоскоростными командами.
Главный вызов — при 10-кратном росте скорости разработки ошибки в коде становятся более частыми, даже при тщательном ревью. Магеррамов сравнивает ситуацию с гонкой на скорости 200 миль в час, где нужны дополнительные меры безопасности. Он предлагает заимствовать практики авиационной индустрии, такие как "ветродукменные тесты" с высокодетализированными имитациями внешних зависимостей, позволяющие локально тестировать систему в контролируемых условиях и проверять её устойчивость к сбоям.
Комментарии (156)
- Дискуссия вращается вокруг того, что ценность кода стремится к нулю, потому что LLM может его генерировать, и что теперь важны лишь тесты и спецификация.
- Участники спорят, насколько реалистично ожидать, что тесты могут покрыть все возможные сценарии и не дать AI-генерированному коду уйти в продакшен.
- Поднимается вопрос, что если код действительно стал "расходным", то вся ответственность за него ложится на тесты, и требуется ли тогда переписывать их вручную, что противоречит идее, что LLM могут сделать это автоматически.
- Кто-то замечает, что вся дискуссия похожа на "технологический прогресс велосипедов": мы не знаем, что внутри, но это работает, и мы этим пользуемся.
- В итоге всплывает, что вся дискуссия сводится к тому, что важно не писать код, а уметь задавать правильные вопросы и проверять ответы.
Avoid 2:00 and 3:00 am cron jobs (2013) 🔥 Горячее 💬 Длинная дискуссия
Избегайте планирования cron-задач на 2:00 и 3:00 утра! Особенно в воскресенье, когда дважды в год происходит переход на летнее/зимнее время. В такие моменты cron-задачи могут вести себя непредсказуемо — автор наблюдал, как задания выполнялись примерно раз в секунду между 3:00 и 3:01, что привело к их многократному запуску (около 60 раз), взаимным конфликтам и потоке уведомлений по email.
Проблема возникает из-за того, что система времени "скачет" вперед или назад во время перехода на летнее/зимнее время. Хотя серьезного вреда обычно не происходит, это создает ненужный хаос. Простое решение — избегать планирования задач на эти проблемные часы. Альтернативы: использовать UTC для сервера, найти более совершенный планировщик задач (хотя ни один не так распространен, как cron) или, в идеале, отказаться от сезонного перевода часов.
Комментарии (304)
- DST вызывает технические проблемы, особенно с cron-задачами в 2-3 часа ночи из-за пропусков или дублирования времени.
- Использование UTC на серверах рекомендуется как стандарт для избежания проблем с DST и упрощения логов.
- Переходы на DST связаны с медицинскими рисками (рост смертности, сезонная депрессия) и требуют осторожного планирования задач.
- Альтернативные решения включают использование lock-файлов, anacron для периодических задач и избегание запуска в "опасные" часы (2-5 утра).
JetKVM – Control any computer remotely 🔥 Горячее 💬 Длинная дискуссия
JetKVM предлагает решения для удаленного управления серверами через KVM over IP, позволяя администрировать компьютеры без физического доступа. Их продукты включают как аппаратные устройства, так и облачный сервис JetKVM Cloud, обеспечивая гибкость в управлении IT-инфраструктурой. Проект активно развивается, имея 3.5K звезд на GitHub и дорожную карту с открытыми планами развития.
Особое внимание уделяется удобству использования: сервис поддерживает отслеживание наград Kickstarter для клиентов, а интерфейс спроектирован для интуитивного управления. Решения JetKVM подходят как для небольших офисов, так и для крупных дата-центров, обеспечивая надежное удаленное управление без потери производительности.
Комментарии (195)
- Отсутствие информации о компании-изготовителе и стране происхождения вызывает вопросы доверия к продукту.
- Пользователи отмечают проблемы с совместимостью и стабильностью, но в целом считают устройство полезным для домашней лаборатории.
- Несколько человек упомянули альтернативы вроде PiKVM и NanoKVM, но подчеркнули, что цена JetKVM значительно ниже.
- Некоторые участники обсуждения выразили обеспокоенность по поводу безопасности и прозрачности программного обеспечения.
- Несколько человек упомянули, что устройство не поддерживает некоторые функции, такие как PoE или полноценный HDMI-порт, и что это может быть неудобно для пользователей.
It's insulting to read AI-generated blog posts 🔥 Горячее 💬 Длинная дискуссия
Автор считает, что использование ИИ для написания блогов оскорбительно и неуважительно к читателям, обладающим мыслями, чувством юмора и жизненным опытом. По его мнению, отказ от самостоятельного творчества лишает автора гордости за созданное, а ошибки и неловкости — это то, что делает нас людьми. «Самые лучшие мысли — это те, которые были 'прочувствованы' через реальный опыт», — подчеркивает автор.
ИИ создает стерильный барьер между автором и читателями, лишая возможности искреннего взаимодействия. Автор утверждает, что большинство людей готовы помочь, но многие слишком боятся просить о поддержке, ошибочно полагая, что умные люди должны знать всё. Наоборот, по его словам, по-настоящему умные люди знают, когда просить о помощи, и строят взаимовыгодные отношения. Он призывает использовать ИИ только для количественных задач, а в творчестве полагаться на собственные мысли и опыт.
Комментарии (483)
- Обсуждение сфокусировано на том, что использование ИИ в блогах и других публикациях не является проблемой само по себе, а важно, чтобы автор не терял свою уникальную точку зрения и не передавал читателю нечто, что не является его собственным мнением.
- Участники подчеркнули, что использование ИИ для улучшения грамматики или перевода не является проблемой, если это не искажает смысл и не нарушает авторское право на собственные мысли.
- Также было отмечено, что важно различать использование ИИ как инструмента для улучшения читаемости и ясности текста и полную генерацию контента, которая может быть нечестной, если она не отражает уникальные мысли автора.
- Некоторые участники поделились личным опытом, что использование ИИ может быть полезно для не-носителей языка, если это помогает им выразить свои мысли, но при этом важно, чтобы они не теряли свою уникальную перспективу.
- В целом, обсуждение подчеркнуло, что важно сохранять баланс между использованием ИИ как инструмента и сохранением подлинного человеческого голоса и перспективы, которая делает чтение блога ценным для читателя.
PSF has withdrawn $1.5M proposal to US Government grant program 🔥 Горячее 💬 Длинная дискуссия
Python Software Foundation (PSF) withdrew its $1.5 million grant application to the US National Science Foundation (NSF) after the agency demanded a commitment to abandon diversity, equity, and inclusion (DEI) initiatives. The proposed funding aimed to enhance security for Python's package repository PyPI by developing automated tools to proactively detect malicious code in packages, a significant improvement over current reactive methods. The NSF's condition required the PSF to affirm it would not "advance or promote DEI," a restriction applying to all PSF activities, not just the funded project. Violation would trigger the NSF to reclaim previously awarded funds, creating substantial financial risk.
This demand directly conflicted with the PSF's core mission, explicitly stating its commitment to supporting "a diverse and international community." Despite the grant's potential to significantly boost the PSF's annual $5 million budget and develop security tools with broader open-source ecosystem benefits (like NPM and Crates.io), the organization refused to compromise its values. The PSF Board unanimously decided withdrawal was necessary to retain the freedom to support its entire community. The loss of this funding, coupled with economic pressures, increases the PSF's need for direct community financial support.
Комментарии (607)
- PSF отказалась от $1,5 млн гранта из-за требования отказаться от DEI-программ, что вызвало широкий резонанс в сообществе.
- Обсуждение подняло вопрос о том, что DEI-программы могут быть незаконны, и что это может быть причиной, по которой грант был отклонен.
- Некоторые участники обсуждения выразили обеспокоенность тем, что отказ от гранта может повлиять на безопасность и стабильность экосистемы Python.
- Были высказаны предложения о том, что сообщество могло бы само финансировать нужды, чтобы не зависеть от грантов с политическими условиями.
- Обсуждение также затронуло вопрос о том, что DEI-программы могут быть незаконны, и что это может быть причиной, по которой грант был отклонен.
Pyrex catalog from from 1938 with hand-drawn lab glassware [pdf] 🔥 Горячее
В 1938 году Corning Glass Works выпустил каталог своей лабораторной посуды Pyrex (LP 18), подчеркивая, что во время Первой мировой войны, когда европейские источники были отрезаны, возникла острая потребность в качественной лабораторной стеклянной посуде в США. Благодаря своему исследовательскому штабу, компания уже имела стекло с идеальными свойствами для производства лабораторной посуды, но требовалось развить навыки его обработки. "Благодаря постоянной помощи, советам и конструктивной критике американских химиков, мы смогли добиться определенного прогресса каждый год в совершенствовании посуды Pyrex, теперь общепринятого стандарта во всем мире".
Ключевым преимуществом Pyrex является его низкий коэффициент теплового расширения (0,0000032 между 19-350°C), что минимизирует потери от теплового удара и позволяет создавать прочную конструкцию. Кроме того, стекло характеризуется низким содержанием щелочей и высокой химической стойкостью, что гарантирует точность экспериментов. Компания подчеркивает, что производит только один сорт лабораторной посуды, и каждый предмет с торговой маркой Pyrex соответствует высоким стандартам качества, установленным и поддерживаемым Corning на протяжении многих лет.
Комментарии (71)
- Обсуждение началось с восхищения старинными каталогами и их иллюстрациями, вызвавшими ностальгию по качеству печати и дизайна.
- Участники поделились историями о лабораторной посуде Pyrex и PYREX, о том, как изменился состав стекла и как это влияет на восприятие бренда.
- Обсуждались вопросы эволюции типографики и дизайна, и как технологические изменения в этих сферах повлияли на качество печати.
- Были затронуты темы стоимости и ценности ручной работы и того, как меняется восприятие этой ценности со временем.
- В комментариях также поднимались вопросы о том, как современные технологии могут влиять на качество и восприятие продуктов, и как это может повлиять на будущее визуального дизайна.