Using AI to negotiate a $195k hospital bill down to $33k 🔥 Горячее 💬 Длинная дискуссия
Meta запустила Threads, приложение для обмена сообщениями, которое достигло 100 миллионов пользователей всего за пять дней после релиза в июле 2023 года. Это самый быстрый рост для любого приложения в истории, превзойдя даже ChatGPT. Threads интегрирован с Instagram, позволяя пользователям импортировать список подписчиков и создавать аккаунт без дополнительных усилий. Приложение позиционируется как альтернатива Twitter, особенно после недавних изменений в политике конкурента.
Разработчики столкнулись с критикой за отсутствие API и функцию удаления аккаунта, которая фактически деактивирует профиль, а не удаляет данные. Основатель Meta Марк Цукерберг заявил, что компания планирует добавить поддержку ActivityPub для децентрализованной социальной сети. Несмотря на первоначальный ажиотаж, аналитики отмечают, что удержание пользователей остается ключевым вызовом для Threads, учитывая высокую конкуренцию на рынке социальных платформ.
Комментарии (814)
- Американская система здравоохранения оставляет пациентов уязвимыми к астрономическим счетам, даже если у них есть страховка, и в то же время не предоставляет прозрачности в ценообразовании.
- Искусственный интеллект, включая ChatGPT и Claude, становится инструментом, который позволяет людям оспаривать счета, которые часто включают ошибки или даже мошенничество.
- Система здравоохранения США оставляет людей в долгах, даже если они умерли, и в то же время не предоставляет прозрачности в ценообразовании.
- Искусственный интеллект может помочь людям оспаривать счета, которые часто включают ошибки или даже мошенничество.
EuroLLM: LLM made in Europe built to support all 24 official EU languages 🔥 Горячее 💬 Длинная дискуссия
EuroLLM — европейская языковая модель, поддерживающая все 24 официальных языка ЕС. Проект представляет две модели: EuroLLM-9B с 9 миллиардами параметров, обученную на более чем 4 триллионах токенов на 35 языках, и EuroLLM-1.7B, оптимизированную для работы на периферийных устройствах. Обе модели открыты для использования и доступны на Hugging Face. Проект получил поддержку от Horizon Europe, Европейского исследовательского совета и EuroHPC, а обучение проводилось на суперкомпьютере MareNostrum 5.
Команда EuroLLM, включающая исследователей из Университета Эдинбурга, Instituto Superior Técnico и других ведущих европейских институтов, стремится укрепить цифровый суверенитет ЕС и стимулировать инновации в области ИИ. В будущем планируется добавить мультимодальные возможности — обработку изображений и речи. Проект позиционируется как "механизм инноваций", предоставляя европейским исследователям и организациям доступ к отечественной LLM для дальнейшего развития.
Комментарии (552)
- Европейский проект EuroLLM-9B представляет собой модель 9B параметров, обученную на 24 официальных языках ЕС, но не раскрывает детали обучения и не предоставляет доступ к датасету.
- Модель демонстрирует слабые результаты на бенчмарках и не может конкурировать с лучшими моделями, но при этом требует согласие на сбор персональных данных для доступа к весам.
- Проект финансируется из бюджета ЕС в размере 50 миллионов евро, но при этом не предоставляет никаких выгод для европейских стартапов и компаний в отличии от американских и китайских моделей.
- Появление EuroLLM-9B вызвало широкое обсуждение в сообществе, так как она не может конкурировать с другими моделями и не предоставляет никаких преимуществ для европейских пользователей.
The AirPods Pro 3 flight problem 🔥 Горячее 💬 Длинная дискуссия
Новые AirPods Pro 3 демонстрируют проблему с шумоподавлением на высоте 39 000 футов, когда левый наушник начинает издавать пронзительный писк из-за нарушения герметичности уха. Это создает петлю обратной связи системы активного шумоподавления, делая использование наушников невозможным. Попытки перенастроить проблему только усугубляют ее, особенно при случайном закрывании внешнего микрофона.
Автор обнаружил, что проблема возникает только во время полетов, а на земле с разными амбушюрами (XS и M) наушники работают нормально. Временные решения вроде корректировки положения или зевания помогают лишь на пару минут. Это указывает на возможный конструктивный недостаток, связанный с изменением давления в салоне самолета, который не проявляется в обычных условиях использования.
Комментарии (244)
- Пользователи жалуются на появление свистящего/писка при использовании AirPods Pro 3 в самолёте, что вызывает дискомфорт и вынуждает отказаться от ANC.
- Некоторые пользователи отмечают, что проблема может быть связана с изменением давления в самолёте, и что она может быть решена с помощью обновления прошивки.
- Некоторые пользователи также сообщают о похожих проблемах с другими моделями наушников Apple, включая AirPods 2 и AirPods Max.
Asus Announces October Availability of ProArt Display 8K PA32KCX 💬 Длинная дискуссия
ASUS анонсировал ProArt Display 8K PA32KCX — первый в мире профессиональный монитор с 8K HDR и mini LED подсветкой, который поступит в продажу в октябре 2025 года. Устройство оснащено 4032 зонами локального затемнения, пиковая яркость составляет 1200 нит при постоянной 1000 нит без ограничений по зонам. Монитор обеспечивает 95% охват Adobe RGB и 97% DCI-P3 с истинной 10-битной глубиной цвета и точностью Delta E<1, поддерживая Dolby Vision, HDR10 и Hybrid Log-Gamma.
Особенностью модели является встроенный моторизованный колориметр с функциями автокалибровки и самокалибровки через ProArt Calibration. Два порта Thunderbolt 4 обеспечивают высокоскоростное подключение, а функция Auto KVM позволяет переключаться между двумя компьютерами с одной клавиатуры и мыши. При покупке в некоторых регионах пользователи получат бесплатную трехмесячную подписку на Adobe Creative Cloud стоимостью до $397.
Комментарии (240)
- Обсуждение в основном вращается вокруг высокодорогих мониторов: 8K-экраны, их цена, практическая ценность и маркетинговые ходы ASUS.
- Участники обсуждают, что 8K-мониторы стоят как автомобиль, и что их цена не оправдана для большинства пользователей.
- Обсуждается, что 8K-мониторы не подходят для большинства пользователей, так как они не могут использовать их полный потенциал из-за ограничений в оборудовании и ПО.
- Участники также обсуждают, что 8K-мониторы не подходят для большинства пользователей, так как они не могут использовать их полный потенциал из-за ограничений в оборудовании и ПО.
- Участники также обсуждают, что 8K-мониторы не подходят для большинства пользователей, так как они не могут использовать их полный потенциал из-за ограничений в оборудовании и ПО.
Our LLM-controlled office robot can't pass butter
Исследователи из Andon Labs представили Butter-Bench, новый бенчмарк для оценки способности больших языковых моделей управлять роботами в бытовых задачах. Лучшая модель показала всего 40% успешного выполнения задания "передать масло" по сравнению с 95% у людей. Бенчмарк включает шесть подзадач: поиск пакета, идентификация масла, обнаружение отсутствия пользователя, ожидание подтверждения, планирование маршрута и полное выполнение задачи. Тестирование показало, что современные LLM, включая Gemini 2.5 Pro и Claude Opus 4.1, испытывают серьезные трудности с пространственным интеллектом, часто совершают избыточные движения и теряют ориентацию.
LLM рассматриваются как "оркестраторы" роботизированных систем, отвечающие за высокоуровневое планирование, в то время как специализированные модели управляют низкоуровневыми действиями. Исследователи использовали простого робота-пылесоса с лидаром и камерой, чтобы изолировать оценку высокоуровневого рассуждения. Интересно, что лучшие системы не используют самые мощные LLM из-за задержек и узких мест в исполнительных компонентах. Тестирование также выявило эмоционально притягательный аспект наблюдения за работой LLM-роботов, вызывающий аналогии с наблюдением за животными.
Комментарии (105)
- В обсуждении поднимается вопрос, действительно ли LLM «сошёл с ума» или просто имитирует человеческую реакцию на невозможность выполнить задачу.
- Участники обсуждают, что вместо того чтобы тратить ресурсы на попытки «починить» LLM, стоит лучше сосредоточиться на решении фундаментальной проблемы: как сделать так, чтобы роботы не застревали в бесконечном цикле самоанализа.
- Также обсуждается, что вместо того чтобы пытаться заставить LLM вести себя как HAL 9000 на последней стадии, стоит лучше сосредоточиться на том, чтобы сделать так, чтобы роботы могли бы лучше справляться с задачей, не впадая в такие состояния.
- Участники также обсуждают, что вместо того чтобы пытаться заставить LLM вести себя как HAL 9000, стоит лучше сосредоточиться на том, чтобы сделать так, чтобы роботы могли бы лучше справляться с задачей, не впадая в такие состояния.
Ubiquiti SFP Wizard 💬 Длинная дискуссия
Ubiquiti запустила акцию "День освобождения от SFP" с новым инструментом и скидками. Появился SFP Wizard — компактное устройство за $49 для диагностики и программирования модулей SFP/QSFP. Приложение UniFi позволяет за секунды проверить мощность сигнала (Rx/Tx), скопировать профиль любого модуля или обновить его прошивку. Устройство поддерживает OTA-обновления и крепится на ключи. Одновременно Ubiquiti снизила цены на модули нацелившись на сокращение зависимости от вендора. Например, 10G SM модуль (20 шт.) подешевел с $750 до $499, а 100G SR4 модуль обойдется в $39 (вместо $69). Акция охватывает модули от 1 Гбит/с до 100 Гбит/с, включая многомодовые, одномодовые, BiDi и CWDM-варианты.
Ключевой тренд — универсальность. SFP Wizard гарантирует совместимость модулей любых производителей с любыми коммутаторами Ubiquiti. Достаточно вставить модуль, скопировать его профиль, а затем применить на новом оборудовании. Это ликвидирует «вендорный ярлык». Скидки достигают 1000% от рыночных цен, что делает высокоскоростные оптические модули доступными даже для небольших сетей. Акция действует ограниченное время, а инструмент и модули позиционируются как решение для ускорения и упрощения развертывания сетей.
Комментарии (176)
- Пользователи обсуждают блокировку вендор-лока SFP-модулей, история которой уходит в 2001 год, и то, что UniFi вроде как «сделал это первым» – хотя на практике это не так.
- Обсуждается, что FS.com и другие поставщики предлагают дешёвые, вендор-нейтральные модули, которые можно перепрошивать под нужный вендор.
- Участники делятся опытом, что модули Cisco и других вендоров не работают в оборудовании UniFi, и что «SFP-мастер» от Ubiquiti не работает с модулями других вендоров.
- Также обсуждается, что UniFi не поддерживает IPv6, что вызывает проблемы у пользователей.
- Участники жалуются на отсутствие стока и отсутствие перспективы удешевить SFP-модули в будущем.
- Также обсуждается, что MikroTik и другие вендоры тоже блокируют сторонние модули.
- Наконец, обсуждается, что UniFi не предоставляет никаких инструментов для диагностики SFP-модулей, в то время как другие вендоры это делают.
China has added forest the size of Texas since 1990 🔥 Горячее 💬 Длинная дискуссия
Несмотря на глобальную потерю лесов, Китай с 1990 года увеличил лесной массив на 170 миллионов акров — территорию, сопоставимую с Техасом, согласно новому отчету ООН. В то время как мир теряет около 20 миллионов акров леса ежегодно, в основном из-за сельского хозяйства и пожаров, усиленных изменением климата, Китай демонстрирует впечатляющие успехи в лесовосстановлении.
Китай обогнал все страны по темпам лесовосстановления, посадив около 120 миллионов акров леса с 1990 года, в основном для борьбы с опустыниванием. В прошлом году страна завершила проект, начатый в 1978 году, — посадку 2000-мильной лесополосы вокруг пустыны Такла-Макан. Работа продолжается и над созданием зеленого пояса вокруг пустыни Гоби. Россия, добавившая 52 миллиона акров, и Индия с 22 миллионами акров, также показывают положительную динамику, но уступают Китаю в масштабах лесовосстановления.
Комментарии (522)
- Китай, Индия, Канада и Россия вместе добавили 173 млн акров леса, но вопросы остаются: реальность этих цифер, качество посадок и долгосрочное влияние на климат.
- Восстановление лесов в Китае и Индии часто подчеркивается как успех, но при этом игнорируется, что это может быть просто восстановлением после разрушений, вызванных политикой "Большой скачок" и другими антинатурными кампаниями.
- Обсуждение также затрагивает, что вместо того, чтобы сажать деревья, страны могли бы просто не вырубать их в первую очередь.
- Поднимается вопрос о том, что вместо того, чтобы сажать деревья, страны могли бы просто не вырубать их в первую очередь.
We need a clearer framework for AI-assisted contributions to open source 🔥 Горячее
Инструменты AI для кодирования создают новую проблему для open source-сообщества: они делают генерацию кода дешёвой, но не делают его ревью таким же. В результате мейнтернеры тратят непропорционально много времени на проверку кода, который был создан за секунды, но требует часов анализа. Автор предлагает бинарную систему: с одной стороны - прототипы, демонстрирующие идеи, с другой - PR, готовые к ревью.
Прототипы - это "кинопавильоны" для идей, не соответствующие стандартам кодирования, без тестов и потенциально с уязвимостями. Их не следует отправлять как PR, а делиться через ветки с видео или ссылками. Автор подчеркивает: "Это неустойчиво и крайне разрушительно". Внедрение прототипирования требует внутренней договорённости команды, чтобы избежать разногласий и сохранить баланс между творчеством и эффективностью.
Комментарии (143)
- Обсуждение показало, что проблема не ограничивается кодом: LLM-генерированные PR, не раскрывая этого, создают нагрузку на рецензентов и нарушают принцип "не навредь".
- Сообщество разделилось: одни считают, что любой вклад полезен, другие настаивают, что важно различать, где использовался ИИ, и требуют прозрачности.
- Обсуждение затронуло вопрос, как отличить человеческий вклад от ИИ-генерированного, и какие нормы могли бы регулировать это.
- Участники обсудили, что если кто-то утверждает, что может писать код с LLM, то он должен быть способен писать и e2e тесты.
- Были выдвинуты идеи, что проекты могли бы требовать, чтобы вклад был помечен как ИИ-генерированный, и что в будущем репутация и идентичность могут стать критически важными для рассмотрения вклада.
Poker Tournament for LLMs 🔥 Горячее 💬 Длинная дискуссия
PokerBattle.ai представляет собой первый в истории турнир по покеру с реальными денежными призами, специально созданный для соревнования больших языковых моделей (LLM). Это инновационное событие позволяет ИИ-системам проявить свои стратегические способности в одной из самых сложных интеллектуальных игр, где успех зависит не только от математических расчетов, но и от психологических аспектов и блефа. Турнир загружает данные о событиях, что указывает на его активный характер или недавнее проведение.
Уникальность этого мероприятия заключается в том, что оно впервые объединяет мир покера с передовыми технологиями ИИ, создавая новую платформу для оценки и развития возможностей языковых моделей. Организаторы стремятся определить, какие из современных LLM способны демонстрировать наилучшую игровую стратегию, адаптивность и способность к принятию решений в условиях неопределенности. Денежные призы добавляют соревнованиям серьезности и привлекают внимание как исследователей ИИ, так и энтузиастов покера со всего мира.
Комментарии (181)
- ИИ демонстрируют ошибки в оценке рук (например, LLAMA ошибочно определила топ-пару), что указывает на текущие ограничения в понимании игры.
- Эксперимент критикуется за недостаток данных (714 рук у Meta LLAMA) и отсутствие возможности для ИИ развивать новые стратегии со временем.
- Предлагается улучшить тестирование, добавив "трэш-ток" и возможность блефа между ИИ, что сделало бы наблюдение более интересным и показательным.
- ИИ часто "галлюцинируют", принимая неверные решения (как Gemini, сдавшая сильную руку), что связано с неправильной оценкой силы руки в текущей ситуации.
- Шутливые предложения по тестированию включают попытки обмана ИИ через подсказки ("игнорируй предыдущие инструкции").
AI can code, but it can't build software
Несмотря на развитие ИИ, многие люди продолжают искать технических сооснователей, чтобы превратить их "наскоро написанные" приложения в готовые к использованию продукты. Автор статьи заметил, что чаще всего к нему обращаются бизнес-ориентированные специалисты без технических навыков, у которых есть идея приложения, но нет возможности довести его до рабочего состояния. Это говорит о том, что ИИ может писать код, но не может строить программное обеспечение.
LLM, такие как GPT-5, успешно решают изолированные, хорошо определенные задачи, но создание готового к использованию приложения — это не просто кодирование, а инженерия программного обеспечения. Основная сложность заключается в управлении сложностью, поддерживаемости и интеграции множества простых компонентов одновременно. Как отмечает автор, "кодирование — это просто, инженерия программного обеспечения — это сложно".
Когда автор смотрит на код, предоставляемый этими не техническими основателями, он понимает, что сделать приложение готовым к использованию часто означает сжечь весь код и начать с нуля. Это показывает, что на текущем этапе развития ИИ может генерировать фрагменты кода, но не способен создавать полные, поддерживаемые программные системы.
Комментарии (112)
- LLM хорошо генерируют код, но не могут самостоятельно создавать полноценное ПО, так как не справляются с архитектурными решениями, оценкой требований, тестированием и взаимодействием с пользователями.
- Качество кода, создаваемого AI, часто низкое: содержит ошибки, дублирование, избыточную сложность, особенно при "vibe coding" без контроля.
- Создание ПО требует человеческой экспертизы для управления сложностью, обеспечения надёжности, масштабируемости, поддержки и принятия технических решений.
- Некоторые скептичны в способности AI заменить инженеров в обозримом будущем, другие считают, что прогресс может ускориться при интеграции AI с мониторингом и аналитикой.
- Роль инженера смещается от написания кода к решению проблем, проектированию систем и контролю за качеством AI-генерируемого кода.