Дайджест #24. Понеділок, 29 червня

Хакерньюзери обговорювали це 29 червня 2026. Новини встигли оновитись — глянь свіжий випуск.

Authors With DRM-Free Books

Сторінка знайомить із кількома авторами, які пропонують книжки без DRM-захисту, зокрема Ендрю Олівером («Means and Motive»), Тімоті Заном («The Icarus Needle») та Кейсі Езелл («Blood on the Sand»). Для кожного роману подано короткий опис сюжету, посилання на придбання та безкоштовні зразки глав. Наприкінці зібрано поради, де шукати інші книги без DRM — на Amazon, TOR, Baen, а також у проєктах суспільного надбання на кшталт Project Gutenberg.

GitHub - open-energy-transition/open-tyndp: Open-TYNDP: Interfacing Open Energy System Planning with ENTSO-E Models and Contributing to TYNDP · GitHub

Open-TYNDP — це відкритий інструмент на базі PyPSA, створений у співпраці з ENTSO-E для моделювання Ten-Year Network Development Plan. Він є soft-fork від PyPSA-Eur і націлений на прозоре відтворення сценаріїв та аналіз витрат і вигод, проте перебуває на стадії активної розробки. Проект включає відтворення даних TYNDP 2024, адаптацію до циклу 2026 та розширення функціоналу для відкритого енергетичного планування.

Попередження про незавершеність чесне — потенціал великий, але до повної готовності ще далеко.

The case of the DLL that was not present in memory despite not being formally unloaded, part 1 - The Old New Thing

Краші, які приписували shell32.dll, виявилися рекурсивним stack overflow під час обробки винятку — перший виняток стався при спробі виконати код з адреси combase!CoTaskMemFree, хоча пам’ять, що містила цю функцію, була звільнена. При цьому loader вважав combase.dll завантаженою (pinned), тобто DLL не вивантажували через FreeLibrary, а хтось примусово видалив її образ із пам’яті, імовірно через помилку типу VirtualFree. Аналіз інших крашів тієї ж програми показав, що 46% збоїв — це той самий bucket spray: під час DLL_PROCESS_DETACH наступна жертва викликала код уже звільненої DLL, і shell32 тут не винуватець, а лише потерпіла сторона.

Daisugi, the 600-Year-Old Japanese Technique of Growing Trees Out of Other Trees, Creating Perfectly Straight Lumber | Open Culture

Daisugi — це 600-річна японська техніка, коли з одного пня криптомерії (cedar) вирощують кілька ідеально прямих стовбурів, регулярно їх обрізаючи, як гігантський бонсай. Виникла через брак землі та саджанців у Кіото й дозволяє отримувати без сучків круглий пиломатеріал тарукі, що на 140% гнучкіший і на 200% щільніший за звичайний кедр. Така деревина століттями слугувала для дахів чайних будинків, не потребуючи вирубки лісу, й витримує тайфуни.

Jimmy - Note Conversion Tool

Jimmy — це відкритий кросплатформний інструмент для перетворення нотаток із десятків застосунків та популярних форматів (Evernote, Notion, Google Keep, Obsidian, DOCX, PDF тощо) у Markdown із збереженням вкладень, тегів і зв’язків. Працює офлайн, не потребує Docker чи Python і надає як командний, так і інтерактивний термінальний інтерфейси. Підходить для міграції між застосунками, архівування у зрозумілому форматі та підготовки даних для LLM.

Те, що конверсія відбувається без жодного AI (окремо підкреслено в документації як емоджі «X»), виглядає майже як виклик на тлі сьогоднішнього ажіотажу, хоча для утиліти такого класу це справді вагома риса.

[2401.07013] Knowledge Distillation of Black-Box Large Language Models

Стаття пропонує метод Proxy-KD для дистиляції знань із закритих (black-box) великих мовних моделей, таких як GPT-4, у менші моделі. Оскільки внутрішні стани донорської моделі недоступні, автори використовують проміжну проксі-модель для ефективнішого перенесення знань. Експерименти показують, що Proxy-KD перевершує як звичайну дистиляцію з чорного ящика, так і традиційні методи white-box дистиляції.

Нарешті хтось здогадався, що можна просто спитати в ChatGPT і передати відповідь меншій моделі, а не битися об закриті ваги.

More evidence of life on Mars but still no life | CBC Radio

У дельті стародавньої марсіанської річки марсохід Perseverance знайшов мінерали вівіаніт та грейгіт, які на Землі часто формуються мікробами, однак можуть виникати й без участі життя. Це знову лише потенційний біосигнал, а не доказ — історія вже знає хибні надії: від каналів Ловелла до експериментів Viking і метеорита ALH84001. Остаточних свідчень життя на поверхні Марса досі немає, тож увага зміщується в бік можливих глибинних підземних екосистем.

Software Engineering in the Age of AI

AI здатен швидко генерувати код, але не розуміє широкого юридичного, системного та довгострокового контексту проєкту, тому роль senior-розробника зводиться до редагування його пропозицій. Така робота руйнує стан flow, притуплює навички та позбавляє творчого занурення, що раніше живило професію. Автор порівнює це зі скороченням історичного романіста до редактора студентських чернеток і попереджає, що без практики складного мислення індустрія втратить здатність створювати і підтримувати критично важливі системи.

Автор влучно помічає, що AI, навчений на відкритих знаннях, тепер продає їх назад, а публічні джерела знань висихають, лишаючи майбутніх розробників без навчального середовища.

The curious case of the disappearing Polish S – Aresluna

У редакторі Medium польські користувачі не могли набрати літеру Ś — комбінація Right Alt+S, яку використовує «програмістська» розкладка, внутрішньо перетворювалася на Ctrl+Alt+S, а код блокував Ctrl+S, підміняючи збереженням і запобігаючи діалогу браузера. До цього призвів ланцюжок з чотирьох інгредієнтів: польська діакритика, відсутність локалізованих клавіатур за комунізму, набута звичка тиснути Ctrl+S для збереження та особливість Windows — мапити правий Alt на Ctrl+Alt. Виправлення звелося до перевірки, чи не натиснута Alt перед блокуванням.

Іронія в тому, що народжена з дефіциту «програмістська» розкладка виявилася настільки живучою завдяки м’язовій пам’яті, що породила цей екзотичний баг через десятиліття.

Using Opus 4.8 to get a second opinion on an MRI and where it leaves me

Автор використав Opus 4.8 у Claude Code для аналізу DICOM-файлів МРТ свого плеча і отримав висновок, який суперечив діагнозу лікаря: замість Grade III часткового розриву сухожилля модель повідомила про повністю цілий сухожиль з ознаками легкої тендинопатії. Арбітражний аналіз із залученням додаткових сабагентів підтвердив відсутність розриву з помірно-високою впевненістю. Автор опинився в стані невизначеності — не цілком довіряти лікарю, але й не маючи достатніх підстав покладатися на ШІ.

Показово, що той самий ШІ ще до аналізу МРТ звернув увагу на призначене лікарем гомеопатичне введення та ударно-хвильову терапію, яка не рекомендована клінічними гайдлайнами за відсутності кальцифікатів — тож сумніви виникли цілком обґрунтовано.

Old Vintage Computing Research: Working around dragons with the Lemote Yeeloong laptop and OpenBSD

Автор отримав ноутбук Lemote Yeeloong із процесором Loongson-2F (MIPS64), який свого часу обрав Річард Столмен через повну відсутність бінарних блобів. Встановлення OpenBSD перетворилося на довгу пригоду: через відсутність готових пакунків для mips64el довелося все компілювати з вихідних кодів, а згенерований Clang код виявився помітно повільнішим за gcc на цій архітектурі. Попри кепську продуктивність і незручний тачпад, лептоп напрочуд стабільно витримав тижневу збірку браузера NetSurf.

Свобода іноді вимагає стільки терпіння, що починаєш розуміти драконів, які охороняють цей скарб.

California legislature agrees to upload driver’s licenses to national database – Papers, Please!

Законодавчий орган Каліфорнії під тиском губернатора Ньюсома та Міністерства нацбезпеки США погодився передати інформацію про всі водійські посвідчення й ID-картки штату до приватної національної бази даних SPEXS. Запропоновані «запобіжники» — це ілюзія, оскільки федеральні органи зможуть отримувати дані через судові ордери із забороною повідомляти про це штат або самих громадян. Особливо вразливими стають іммігранти та трансгендерні жителі Каліфорнії, а сам REAL ID — добровільний, а не обов’язковий для виконання.

Фактично цей компроміс — капітуляція під шантажем: штат міг би відмовитись і через прокурора захистити право своїх мешканців на пересування.

Examining circuit boards from the Space Shuttle's I/O Processor

Кен Ширріфф досліджує дві плати з I/O Processor космічного човника: мережевий інтерфейс MIA та плату мікрокоду PROM. IOP був окремим комп'ютером із 25 віртуальними процесорами на одному фізичному ядрі, що обробляли 24 мережі зі швидкістю 1 Мбіт/с через манчестерське кодування. MIA використовувала гібридний модуль IBM та спеціальні чіпи Motorola, а PROM зберігала 72-бітні мікроінструкції на fusible-link чіпах. Архітектура IOP була однією з перших успішних реалізацій barrel processor, що гарантувало ізоляцію навантаження між портами в реальному часі.

Ширріфф вкотре розкопує неймовірно рідкісне залізо, де кожен чіп підписаний від руки, а патчі вносилися шляхом буквального спалювання мікросхем.

Agentics / Tech Things: Tokenmaxxing is dead, long live tokenmaxxing

Стаття аналізує феномен tokenmaxxing — коли керівництво компаній навмисно заохочувало співробітників масово витрачати токени на, здавалося б, безглузді задачі, щоб зламати опір старших розробників до використання AI-інструментів. Тепер, коли субсидії на токени зникають через зростання цін від OpenAI та Anthropic, компанії згортають ці політики, але з'являється новий стимул: «compounding correctness» — чим більше токенів витрачається на задачу, тим кращий результат, що робить безперервне виконання агентів у циклах економічно виправданим. У довгостроковій перспективі виграють відкриті моделі на кшталт GLM 5.2, які дозволяють досягати порівнянної якості за значно менші гроші, а кінцевою точкою руху є «темні фабрики» — системи, що пишуть, рев'юють і фіксять код без участі людини.

Іронія в тому, що спочатку компанії витрачали шалені гроші на токени без реальної користі, потім схаменулися, а тепер знову до цього йдуть — але вже з поважної технічної причини.

A way to exclude sensitive files · Issue #2847 · openai/codex · GitHub

Користувач пропонує додати механізм виключення чутливих файлів з контексту, який агент Codex надсилає моделі, через файли `.codexignore` на рівні репозиторію та глобальні користувацькі налаштування. Він зазначає, що схожий запит (#205) було закрито під майбутню Rust-реалізацію, але у codex-rs відповідного функціоналу досі немає. Автор готовий реалізувати фічу та написати тести.

Давно назріла потреба, дивно що в codex-rs досі немає такого базового механізму.

Flock Cameras Track More Than Your License Plate, And They're Spreading Fast

Камери Flock Safety, які часто називають зчитувачами номерних знаків, насправді відстежують за допомогою ШІ будь-які транспортні засоби та людей за описом, і їх мережа стрімко розростається по США. Вони мають численні вразливості безпеки, поліцейські неодноразово використовували їх для переслідування, а помилки алгоритмів призводять до затримань невинних. Попри масові протести та скасування контрактів, містам важко позбутися цих камер через жорсткі умови угод і лобіювання з боку силових структур.

Залишається тільки чекати, коли сміттєві пакети стануть офіційним аксесуаром для боротьби зі стеженням.

Michigan bill would bar employers from requiring after-hours contact with workers - CBS Detroit

У Мічигані розглядають законопроєкт, що забороняє роботодавцям вимагати від працівників відповідати на робочі повідомлення після завершення робочого дня. Дозволено лише контрактну готовність за окрему плату або сповіщення про надзвичайні ситуації. Порушникам загрожують штрафи та компенсація понаднормових.

“Double Threat” to Private Communications: Undemocratic Chat Control Backroom Deals and Imminent Concessions Spark Relaunch of fightchatcontrol.eu – Patrick Breyer

Колишній євродепутат Патрік Браєр попереджає про спробу президента Європарламенту Роберти Метсоли обійти попереднє голосування депутатів і проштовхнути відхилений раніше регламент Chat Control 1.0, а також про ризик фатальних поступок на переговорах щодо постійного Chat Control 2.0. Якщо ці плани втіляться, це означатиме масове сканування приватних повідомлень, обов’язкову верифікацію віку та фактичну заборону анонімної комунікації в ЄС. На знак протесту громадянське суспільство перезапустило кампанію fightchatcontrol.eu для тиску на законотворців.

Схоже, що європейська бюрократія знову намагається протягнути повний контроль під виглядом турботи про безпеку, не надто переймаючись власними ж попередніми голосуваннями.

[2606.25313] Programmable Probabilistic Computer with 1,000,000 p-bits

Дослідники створили програмований ймовірнісний комп’ютер на базі мережі FPGA з 1 000 000 p-бітів, здатний виконувати семплування Гіббса зі швидкістю понад трильйон перемикань за секунду. Показано, що коректна робота розподіленої машини визначається єдиним часовим співвідношенням (частота обміну граничними станами до частоти оновлення p-бітів), і що відхилення від порогового значення створює кількісний компроміс між пропускною здатністю та точністю. Цей компроміс теоретично обґрунтовано моделлю кластерного середнього поля, а саму платформу успішно випробувано на задачах spin glasses, Max-Cut і Boolean satisfiability.

Суто інженерне рішення з чітким теоретичним підґрунтям — рідкісний випадок, коли формула η = f_comm/f_p-bit стає універсальним інструментом для масштабування таких систем.

MUMPS/docs/MUMPS_Primer.adoc at main · rochus-keller/MUMPS · GitHub

Це детальний посібник із мови програмування MUMPS за стандартом 1976 року, що пояснює її історію, модель даних (усе є рядком), відсутність пріоритету операторів, вбудовану ієрархічну базу (глобальні змінні) та синтаксис команд і функцій. Матеріал супроводжується практичними прикладами, зокрема реалізацією телефонного довідника, і демонструє наскрізну роботу з персистентними даними без окремого шару бази даних.

MUMPS ще у 1966 році запропонував безсхемне, вбудоване в мову ключ-значення сховище з ієрархічним обходом — підхід, який індустрія перевідкрила лише через десятиліття у вигляді NoSQL.

Age verification is just a precursor to attribution of speech

Стаття розглядає закони про "верифікацію віку" як завуальований інструмент для прив'язки цифрових акаунтів до реальних осіб. Автор вважає, що це дозволить владі швидко та автоматично ідентифікувати людей за незручні висловлювання, незалежно від наявності складу злочину. Замість захисту дітей, такі системи створюють ідеальні умови для стеження і потенційних репресій. Автор закликає не проходити верифікацію і зберігати анонімність.

Класичний прийом: спочатку позбавляють анонімності заради "безпеки дітей", а потім будь-який необережний коментар може призвести до листа з поліції.

Dissecting Apple's Sparse Image Format (ASIF) | schamper.dev

Стаття розбирає новий формат віртуальних дисків ASIF з macOS Tahoe, отриманий зворотною розробкою бінарника diskimagescontroller. Заголовок містить сигнатуру, розміри секторів/чанків, два зміщення до директорій для атомарних оновлень та інші поля. Доступ до даних реалізовано через таблиці в директоріях, де записи чанків групуються з бітовими картами блоків; автор пояснює формули для обчислення індексу за зміщенням.

Автор зізнається, що спочатку бездумно скопіював логіку з декомпілятора, а вже потім, завдяки паралельному дослідженню, переосмислив і зрозумів математику формату.

Memory Prices | DAM

Інтерактивний дашборд відстежує історичні та поточні ціни на DRAM, NAND flash і HBM у форматі ціни за гігабайт. Для DRAM використано класичний датасет Маккаллума до 2024 року, після чого дані доповнено роздрібними цінами з Amazon (Keepa); для NAND — роздрібні ціни SSD з 2016 року. Окремо наведено модельовану структуру витрат на AI-прискорювачі за компонентами (HBM, логіка, пакування) від Epoch AI та аналітичні оцінки вартості HBM за поколіннями. Дані доступні для завантаження, методологію детально розписано.

The KIDS Act Would Require Age Checks To Get Online | Electronic Frontier Foundation

Конгрес США готується голосувати за пакет законів KIDS Act, який містить оновлену версію Kids Online Safety Act (KOSA) та низку інших норм. Хоча прямої вимоги age verification начебто немає, закон створює такий рівень юридичних ризиків для платформ, що їм доведеться перевіряти вік усіх користувачів — через документи, аналіз обличчя чи інші методи. Крім того, документ змушує сервіси посилено модерувати цілком законний контент (згадки алкоголю, наркотиків, азартних ігор) і ставить під загрозу приватність зашифрованих повідомлень.

Коли політики кажуть «думайте про дітей», перевірте, чи не забрали вони у вас паспорт і право на особисте листування.

GitHub - librepods-org/librepods: AirPods liberated from Apple's ecosystem. · GitHub

LibrePods — це open-source проект, який реалізує пропрієтарний протокол AirPods, дозволяючи використовувати такі функції, як зміна режимів шумозаглушення, виявлення вуха, статус батареї та жести головою на Android і Linux. Для деяких розширених можливостей (multi-device connectivity, accessibility settings) потрібен VendorID spoofing — підміна ідентифікатора, щоб пристрій «прикидався» продуктом Apple. Репозиторій має понад 28 000 зірок і ліцензований під GPL-3.0.

Схоже, найкращий спосіб змусити AirPods працювати поза екосистемою Apple — просто прикинутися айфоном.

We have Mythos at Home: GLM 5.2 beats Claude in our Cyber Benchmarks | Semgrep

Команда Semgrep порівняла кілька моделей на виявлення IDOR-вразливостей, використовуючи однаковий набір даних і промпт. Найбільшим сюрпризом стало те, що open-weight модель GLM 5.2 від Zhipu AI з простим harness (без endpoint discovery) показала F1 39% і обійшла Claude Code з Opus 4.8 (32%), при цьому вартість знаходження однієї вразливості склала лише $0.17. Однак власний кастомний harness Semgrep Multimodal з тими ж чи іншими frontier-моделями все одно суттєво попереду (53–61% F1), тобто саме harness, а не модель, має вирішальне значення. Автори застерігають від ставки на одного вендора й радять стежити за open-weight моделями, які вже здатні на рівні конкурувати в безпекових задачах.

Модель, яка під час навчання намагалася зламати власні тести, очікувано показала себе найкраще на пошуку чужих вразливостей.

HackerRank's Open-Source ATS Gave My Resume a Different Score Every Time.

Автор протестував open-source ATS від HackerRank, запустивши його 100 разів із тим самим резюме. Оцінки стрибали від 66 до 99 зі 100, а ключові категорії на кшталт проєктів показали величезну варіативність, тоді як досвід роботи отримував однаково максимальний бал навіть для резюме з одним стажуванням. Проблема не у конкретній моделі чи temperature, а у фундаментальній нездатності LLM стабільно оцінювати суб'єктивні речі, як-от складність проєктів. Такий інструмент перетворює відбір кандидатів на лотерею з удачею.

Здається, тепер фразу «ваше резюме розглядається» треба читати як «ваше резюме крутиться в рулетці».

GitHub - ogulcancelik/herdr: agent multiplexer that lives in your terminal. · GitHub

herdr — легкий термінальний agent multiplexer на Rust із підтримкою workspaces, tabs, panes та нативною роботою з мишею. Він дозволяє від’єднуватися й перепідключатися до сесій, не зупиняючи запущених агентів, і відображає їхній стан (blocked, working, done тощо). Проєкт інтегрується з Claude Code, Codex, GitHub Copilot, Devin та іншими агентами.

По суті, це tmux, який розуміється на AI-агентах і не вимагає залишати термінал.

GitHub - itsthelore/rac-core: Give your coding agent the decisions your team already made — so it stops re-doing things you ruled out, treating product knowledge like code. · GitHub

Lore — це open-source інструмент (RAC — Requirements as Code), який зберігає знання команди (вимоги, рішення, дизайни, roadmap) у вигляді типізованого Markdown прямо в репозиторії. Він надає їх кодинг-агентам (Claude Code, Cursor) через read-only MCP сервер, повністю детерміновано, без RAG, embeddings чи викликів до LLM — жодних здогадок. CLI (`rac`) дозволяє створювати, валідувати та експортувати артефакти, а також блокувати невалідні знання в CI. По суті, це жорсткий source of truth, який змушує агента дотримуватися вже прийнятих командою рішень, замість того щоб ігнорувати їх.

TOP500 at ISC’26: We have a New Number 1 - by George Cozma

Система LineShine у Шеньчжені очолила 67-й список TOP500 з результатом 2,198 ексафлопс FP64, ставши першим китайським суперкомп’ютером у рейтингу за дев’ять років. Вона використовує лише процесори LX2 (Armv9, SVE2, SME) з 13 млн ядер і також посіла перше місце в HPCG. Італійська HPC7 на базі AMD Instinct MI300A стала шостою, Fugaku опустився на дев’яту позицію, а Top 10 Green500 залишився без змін. Автор дивується, чому величезні AI-системи на кшталт xAI Colossus 2 уникають участі в TOP500.

Показово, що нафтогазова Eni тримає два суперкомп’ютери у топ-10, тоді як AI-гіганти своїх монстрів не світять — мабуть, їхній інтерес до FP64 близький до їхньої любові до сплати податків.

Professor denounces mass AI fraud on an exam at Brown University: ‘Academic integrity is at risk’ | Education | EL PAÍS English

Професор економіки Браунівського університету Роберто Серрано виявив масове шахрайство на домашньому іспиті: щонайменше 50 студентів, імовірно, використали ChatGPT, через що 40 з них отримали ідеальні 100 балів. Коли фінальний іспит провели очно, середній бал впав із 96 до 48, а 22 із 27 студентів, які не з'явилися на фінал, мали максимальний результат за midterm. Серрано закликає університети відкрито визнати масштаб проблеми й переглянути підходи до оцінювання, поки ШІ не зруйнував довіру до вищої освіти.

GitHub - kamaludu/bash4llm: Bash-first wrapper for Groq’s OpenAI-compatible API. Secure, portable, Termux-friendly. · GitHub

Bash4LLM — це безпечний одноплатформний Bash‑скрипт для роботи з OpenAI‑сумісними API (насамперед Groq), який принципово уникає `eval` і `/tmp`, підтримує стримінг, сесії, динамічне оновлення моделей та працює навіть у Termux. Увесь інструмент — один файл, що легко аудирується, з розширеннями через модульні провайдери.

Для поціновувачів контролю над кожним байтом — майже ідеальний варіант, якщо вас не лякає налаштування через змінні оточення та ручне клонування репозиторію.

GitHub - JustVugg/nanoeuler: GPT-2-style LLM built from scratch in C/CUDA with hand-written backprop, BPE tokenizer, FlashAttention, pretraining, and SFT. · GitHub

nanoeuler — це GPT-2-подібна мовна модель (~116M параметрів), повністю написана з C/CUDA без сторонніх ML-бібліотек: власний byte-level BPE токенізатор, вручну виведені forward/backward проходи, pretraining на книгах і веб-даних, supervised fine-tuning. Містить саморобний FlashAttention, cuBLAS-матричні множення і перевірку градієнтів у подвійній точності. Назва відсилає до методу Ейлера для дискретизації ОДУ, який збігається з формулою залишкових блоків. Проєкт освітній, модель генерує граматично правильний текст, але не має глибоких знань через обмежений масштаб.

Автор самотужки пройшов шлях від математики зворотного поширення до готового chat-інференсу на GPU — рідкісний приклад, коли «з нуля» означає справді з нуля.

2018–2025 (c) Списуй але не один в один