Qwen 3.6 27B is the sweet spot for local development 🔥 Горячее 💬 Длинная дискуссия
Qwen 3.6 27B стал «точкой слияния» для локального развития: это первый локальный модель, который ощутимо приближается к всеобщей интеллектуальности, при этом обходит более крупные варианты в практических задачах. Автор отмечает, что 27‑битовая версия «ударяет сзади» — её называют «перепрыгивает выше веса», а в Hacker News её часто называют лучшим компромиссом между мощью и ресурсоёмкостью.
Тестовые сценарии подтверждают возможности: от «пингвинов на велосипеде» до восьмистрочного стихотворения о Зоуке и квантовой физике, от мгновенного создания hexagonal‑minesweeper в OpenCode до генерации полноценной landing‑page для онлайн‑магазина свечей. Запуск локальный прост: через llama.cpp берут 8‑битную квантованную модель (Q8_0), контекст расширяют до 64 k токенов, а flash‑attention и draft‑mtp ускоряют вывод. При работе модель нагревается до такой степени, что её можно отследить тепловизором. Ключевые цифры — 27 B против 35 B, 8‑битное сжатие экономит ~50 % памяти, а контекст до 64 k токенов открывает широкие возможности для локального кодинга и генерации контента.
Комментарии (758)
- Обсуждается, что 128 ГБ MacBook Pro стоит около $6700 и оправдан лишь для приватности, а не для локального запуска крупных моделей.
- Большинство участников считают, что запуск Qwen 3.6 35B и аналогичных моделей на ноутбуке с 128 ГБ ОЗУ неэффективен и невыгодно по цене.
- Существуют более дешевые варианты: облачные сервисы (OpenRouter, Frontier Labs) и видеокарты типа Intel Arc Pro или AMD AI HX 370, которые дают лучшее соотношение цена/производительность.
- Есть мнения, что для «реальной работы» (агентов, сложных задач) нужны более мощные решения, а локальные модели на Mac‑системах часто медленнее, чем ожидалось.
The CEO of Mullvad is the main financer of the Swedish Örebro party 🔥 Горячее 💬 Длинная дискуссия
That's absolutely sad to read." – this line appears in a post on a decentralized network, reflecting disappointment with recent statements by the head of the privacy‑focused VPN Mullvad. The leadership’s involvement in a controversy is seen as disheartening, especially given Mullvad’s reputation for strong anonymity and no‑logs policies. Viewing the conversation on the web version of Mastodon requires JavaScript, with a fallback to native apps for browsers without script support.
The controversy stems from a leaked internal memo where the CEO voiced support for a policy critics say erodes user privacy, sparking heated debate. At the same time, the technical note reminds users that the Mastodon web interface depends on JavaScript, and those unable to run it can use dedicated apps on Android, iOS or desktop. This mix of ethical concerns and platform constraints shows how even privacy‑oriented services face scrutiny and technical limits today. The situation underscores the broader tension between privacy advocacy and corporate governance in the fediverse.
Комментарии (1582)
- Обсуждается, что сооснователь Mullvad Даниэль Бернтссон финансирует экстремальную шведскую партию Örebropartiet, что вызвало споры о политике компании.
- Участники делятся мнениями: одни считают партию правым популистским движением, другие – левым популистским с радикальными взглядами на миграцию.
- Мнения разделяются: некоторые пользователи продолжат пользоваться Mullvad, другие отменяют подписку из-за политических возмущений.
- Есть запросы к альтернативным VPN‑провайдерам и обсуждение того, насколько политические убеждения должны влиять на выбор сервисов.
Pollen tried to remove my article and Google is assisting with it 🔥 Горячее
В 2022 году я написал о крахе компании Pollen, которая в 2021‑2022 годах собрала 150 млн $, выдержала пандемию, но в апреле 2022 года уволила около 200 человек, а через три недели объявила банкротство. Основатель Callum Negus‑Fancey лгал сотрудникам, не выплачивал зарплаты, пенсионные взносы и страховки, а CTO Bradley Wright вручную imposes $3,2 млн двойного списания с клиентов, которое так и не вернули. Документальный фильм BBC «Crashed: $800M Festival Fail» подробно описал эти нарушения. Это привело к массовым жалобам и скандалу, который привлек внимание медиа.
Через четыре года после публикации я узнал, что Google удалил мою статью из поиска после жалобы о нарушении авторских прав. Я единственный владелец прав, поэтому блокировка выглядит как попытка подавить материал. Это показывает, насколько легко подать ложный запрос и заставить поисковый гигант скрыть репортажи, даже основанные на фактах. Такая уязвимость онлайн‑контента позволяет корпоративным силам стирать нежелательные истории. Таким образом, контроль над информацией остаётся у тех, кто умеет правильно подать жалобу. Это подчёркивает, что даже правдивые расследования могут исчезнуть из публичного доступа.
Комментарии (127)
- Обсуждается, как злоупотребление DMCA‑запросами позволяет удалять статьи и сайты без проверки их достоверности.
- Указаны случаи фальшивых запросов от вымышленных лиц (например, «Ellie Piee» из Bouvet Island) и их влияние на репутацию.
- Участники отмечают отсутствие санкций за ложные жалобы и отсутствие обязательного подтверждения личности заявителя.
- Стресс‑эффект (Streisand effect) усиливает внимание к удаляемому материалу, делая такие случаи публичными.
Age verification is just a precursor to automated attribution of speech 🔥 Горячее 💬 Длинная дискуссия
В США, Европе и Австралии уже вводятся правила проверки возраста, которые официально позиционируются как защита детей, но на деле служат лишь первым шагом к привязке онлайн‑аккаунтов к реальным личностям. Государство получает возможность мгновенно узнать, кто стоит за каждым комментарием, и тем самым упрощает преследование реплик, которые могут быть «неудобными». Для правоохранительных органов важны два вопроса: что произошло и кто это сделал; проверка возраста автоматически отвечает на второй, позволяя сразу получать паспортные данные, номер социального страхования или другую идентификацию.
Эти законы уже используют реальные документы: в США — SSN, в ЕС — национальные идентификаторы, в Австралии — номер паспорта. Ирония в том, что «спасать детей» заявляют политики и корпорации, у которых часто свои юридические проблемы. При достаточном числе проверенных пользователей система будет автоматизирована: один нежелательный пост о политике или небольшое разногласие в чате могут привести к письму‑уведомлению или визиту полиции, как уже происходит с запросами провайдеров по нарушениям авторских прав. Поэтому стоит отказываться от верификации, использовать анонимные сервисы и, при необходимости, платить в криптовалютах, чтобы не отдавать государству возможность привязывать каждое слово к вашему имени.
Комментарии (632)
- Возрастная проверка превращается в систему идентификации пользователей, ставя под угрозу анонимность.
- Законы могут привести к массовой цензуре и контролю над онлайн‑пространством.
- Криптографические решения (ZKP, двойная анонимность) позволяют проверять возраст без раскрытия личных данных.
- Технологический суверенитет и децентрализация становятся ключевыми для защиты свободы слова.
- Противники опасаются, что такие меры будут использоваться для расширения контроля над контентом и Surveillance.
HackerRank open sourced its ATS. My resume scored 90/100. Oh wait 74. No – 88 🔥 Горячее 💬 Длинная дискуссия
The open‑source ATS from HackerRank grades resumes out of 100, but the same document can receive different scores — from 66 to 99 — depending on random LLM outputs. The author tested it repeatedly, saw an initial 90, then 74 after removing debug prints, and after 100 runs scores clustered between 78 and 88; a cutoff of 85 leads to a 65 % failure rate.
The evaluation breaks down into five weighted blocks — open‑source contributions (35 points), personal projects (30), work experience (25), technical skills (10) and up to 20 bonus points for startup experience, a portfolio site or technical blog. Technical skills show consistency (8/10 in 98 of 100 runs) because they are checklist items, while project and open‑source scores vary greatly, making the overall result feel like a luck filter. Experience scores cluster tightly around 22‑23, whereas projects and open‑source contributions swing widely. The default model is gemma3:4b at temperature 0.1, yet even temperature 0 does not eliminate the variance. Takeaway: hiring decisions based on such a stochastic score are a roll of the dice.
Комментарии (433)
- LLM‑оценка резюме часто неконсистентна: один и тот же документ может получить разные баллы при разных запусках.
- Оценка сильно зависит от мелочей (проектные вклады, открытый код) и может несправедливо исключать кандидатов.
- Системы часто нарушают анти‑дискриминационные нормы, отдавая предпочтение «AI‑дружелюбным» профилям.
- Большинство участников считают такие подходы неэффективными и ищут альтернативные способы найма.
30-year sentence for transporting zines is a five-alarm fire for free speech 🔥 Горячее 💬 Длинная дискуссия
В Техасе Даниэля «Деса» Санчеса Эстрады приговорили к 30 годам тюрьмы за перевозку коробки с анархическими журналами, которые он не писал и не создавал. Его арест произошёл во время массовой акции против иммиграционной политики в Форт‑Уорте, но он даже не стоял на баррикадах. Санчес стал одним из восьми подозреваемых, получивших в общей сложности 450 лет заключения по делам, оформленным под угрозой «домашнего терроризма» согласно указу NSPM‑7, изданному президентом Трампом. Это первый случай, когда участники движения, называемого «антифа», получили реальные сроки за простую передачу печатных материалов.
Суровый приговор стал новым факелом в атаке администрации Трампа на свободу слова и право граждан публиковать информацию. Юристы и защитники уже назвали решение «пять‑угольным» прецедентом, который может превратить любой акт распространения политической литературы в уголовное преступление. Уже сейчас сообщения о новых делах против активистов показывают, что подобные приговоры будут применяться системно, создавая климатический эффект страха в обществе. Показатели — 30 лет за транспорт, 450 лет суммарно — подчёркивают масштаб и скорость превращения правового инструмента в оружие против любой левой оппозиции.
Комментарии (488)
- Суд вынес 30‑летний срок за хранение и перемещение анархических зин, которые считались доказательствами преступления, хотя их содержание не связано с насилием.
- Участники протеста, включая тех, кто стрелял в агента, получили обвинения, но многие считают такие наказания излишне жестокими и политически мотивированными.
- Комментаторы указывают на системный предвзятый подход судебных органов, который используется для преследования оппонентов власти и подрывает доверие к правосудию.
- Обсуждение вызывает вопросы о границах свободы слова, прав на анонимность и возможных последствиях усиления репрессивных мер в США.
GLM 5.2 beats Claude in our benchmarks 🔥 Горячее 💬 Длинная дискуссия
Semgrep объявил Multimodal — платформу, объединяющую генеративный ИИ‑рассуждение с точными правилами обнаружения, что позволяет сканировать, триажировать и исправлять уязвимости в коде в одном рабочем процессе. Это часть новых решений в области защиты кода и цепочек поставок, интегрированных в их AppSec‑платформу и Workflows. Компания позиционирует сервис как способ, при котором злоумышленники «не могут захватить всё преимущество», подчёркивая, что комбинация машинного обучения и детерминированных правил повышает точность и скорость реагирования.
В рамках публичного теста на кибер‑бенчмарке Semgrep сравнил свой недавно выпущенный GLM 5.2 с Claude 3.5. По данным теста, GLM 5.2 набрал 84 % точности обнаружения, в то время как Claude 3.5 — лишь 71 %. Модель показала более высокий уровень обнаружения уязвимостей — около 15 % лучше, чем у Claude — и значительно снизила количество ложных срабатываний. Эти результаты подтверждают, что гибридный подход Semgrep позволяет достичь как высокой чувствительности, так и низкой ложной тревожности, что критично для практического внедрения в CI/CD пайплайны.
Комментарии (516)
- GLM‑5.2 показал сопоставимый или лучший результат в тестах по поиску уязвимостей, но преимущество связано с использованием специального харнеса, а не только с моделью.
- Стоимость использования GLM‑5.2 через API значительно ниже, чем у Claude Max/Codex, что делает её привлекательной для массового кодинга.
- Открытые модели, такие как GLM‑5.2, начинают конкурировать с закрытыми фронтендовыми системами, вызывая обеспокоенность у коммерческих провайдеров.
- Для получения надёжных сравнений необходимы одинаковые условия тестирования (один харнес для всех моделей) и контекстные ограничения, иначе выводы могут быть вводящими в заблуждение.
I used Claude Code to get a second opinion on my MRI 🔥 Горячее 💬 Длинная дискуссия
Я использовал Opus 4.8 через Claude Code, чтобы проверить результаты МРТ правого плеча, сделанные в клинике, где мне диагностировали «Grade III (более 50 % ширины) частичного разрыва сухожилия подлопаточной мышцы». При экспорте DICOM‑файлов (≈266 МБ) модель сначала выдала заключение, в котором сухожилие называется «целостным», в то время как врач отмечал тяжёлый разрыв. Кроме того, Opus указал два нарушения протокола: применение ударно‑волновой терапии без кальцификации и инъекцию Traumeel, зарегистрированную как гомеопатический препарат без показаний.
Сравнив два отчёта, я попросил Opus выполнить арбитражный анализ, используя дополнительные сведения о движениях и позициях, полученных от ChatGPT. После часа работы модель подготовила новый документ, где подтверждена несоответствие первоначального заключения и предложено уточнить диагноз, а также рекомендации по дальнейшим действиям. Этот случай показывает, как ИИ‑ассистент может быстро выявить несоответствия в медицинских выводах и предложить альтернативную оценку, хотя окончательное решение всё равно должно оставаться за врачом.
Комментарии (715)
- Дискуссия о том, насколько можно доверять ИИ в медицинской диагностике, особенно при работе с изображениями (рентген, МРТ).
- Примеры, когда ИИ дал неверные выводы или противоречивые рекомендации по травмам плеча и другим состояниям.
- Открытость пациентов к использованию ИИ для уточнения вопросов, но подчеркивание необходимости проверки результатов реальными врачами.
- Критика текущих возможностей ИИ в анализе медицинских изображений и предупреждения о рисках, если полагаться на такие системы без контроля специалистов.
EU to legislate about Chat Control behind closed doors 🔥 Горячее 💬 Длинная дискуссия
Европейские инициаторы предлагают сканировать приватные сообщения в мессенджерах под предлогом защиты детей, но за закрытыми дверями уже обсуждаются компромиссы, которые могут превратить эту меру в массовый контроль над личными коммуникациями. Внутренние переговоры с отраслевыми игроками приводят к готовящимся уступкам: вместо полного отказа от сканирования предлагается лишь ограниченный, но всё равно существующий доступ к содержимому чатов, что ставит под угрозу шифрование и анонимность миллионов пользователей.
В ответ на эти «двойные угрозы» активисты возобновили работу над fightchatcontrol.eu, разместив новые материалы и призывая к массовому сопротивлению. Они заявляют, что демократические процедуры игнорируются, а решения принимаются в интересах корпораций, а не граждан. «Мы не позволим, чтобы частные разговоры стали инструментом массовой слежки», — заявляют авторы кампании, подчёркивая, что только публичное давление может остановить нелегативные соглашения.
Комментарии (435)
- Критика того, что инициатива «чат‑контроль» противоречит принципам открытого интернета и массовой шифровки, а реальное влияние ограничено несколькими крупными провайдерами.
- Выражены опасения, что законопроект будет повторно внесён в повестку, несмотря на предыдущие отказы, и что за ним стоит скрытая лоббистская поддержка.
- Упоминаются четыре страны (Чехия, Италия, Нидерланды, Польша), которые выступают против проекта, и призыв к более прозрачному анализу механизмов его продвижения.
- Общая тревога по поводу роста слежки, угрозы конфиденциальности и роста анти‑ЕС настроений среди граждан.
The KIDS Act would require age checks to get online 🔥 Горячее 💬 Длинная дискуссия
Новый законопроект, известный как KIDS Act, требует от всех онлайн‑ресурсов проверять возраст пользователей перед предоставлением доступа к интернету. Для входа в соцсети, стриминговые сервисы и даже обычные веб‑сайты потребуется ввод официального документа, подтверждающего, что пользователь старше установленного порога (обычно 13‑16 лет). Законодательство охватывает практически любой ресурс, доступный через браузер, и обязывает провайдеров внедрять системы проверки, которые могут включать загрузку паспорта или запрос данных из государственных баз. За каждое нарушение предусмотрен штраф до $2 млн, а платформы несут ответственность за контент, который может увидеть несовершеннолетний.
Критики указывают, что такие меры ставят под угрозу анонимность и конфиденциальность, а также создадут дорогостоящие барьеры для малых сервисов. По результатам опроса, 78 % родителей поддерживают возрастную проверку, однако организации защиты прав в интернете предупреждают, что закон может привести к цензуре законных высказываний и затруднить доступ к информации для жителей стран с ограниченной свободой слова. Технологические компании заявляют, что внедрение системы проверки потребует значительных ресурсов и нарушит международные стандарты защиты данных. Они предлагают альтернативные подходы, основанные на образовательных программах и фильтрах, вместо обязательных идентификаций.
Комментарии (566)
- Критики видят в законопроекте попытку ввести всеобщую идентификацию пользователей, что приведёт к массовой слежке и потере анонимности.
- Участники обсуждают, что реальная проблема — алгоритмы вовлечения в соцсетях, а не сама платформа, и предлагают альтернативные решения без ID‑проверок.
- Мнения разделяются: одни считают, что возрастные проверки неизбежны и должны быть реализованы через родительский контроль, другие называют их «мыльным» способом усилить контроль над данными.
- Призывы к действию: писать своим представителям, а также развивать собственные приватные сервисы и технологии, которые не требуют обязательной идентификации.