Дайджест #29. Субота, 4 липня

Цей випуск вийшов 4 липня 2026. Устигло вийти щось новіше — подивись.

GitHub - jamesob/local-llm: Everything I know about running LLMs locally · GitHub

Автор ділиться досвідом створення локальної системи для запуску сучасних LLM. Розглянуто бюджети $2k (48GB VRAM) та $40k (384GB VRAM), збірку на вживаних серверних компонентах та нестандартному PCIe4 switch для прямого peer-to-peer зв’язку GPU. Детально описано налаштування BIOS, kernel parameters, ACS disable та обмеження потужності, а також надано готові Docker-конфігурації для моделей на кшталт GLM-5.2-594B і whisper-large-v3.

Практичний гайд для тих, хто готовий витратити час і гроші на незалежність від хмарних API.

Synthesis is harder than analysis – Surfing Complexity

Автор використовує аналогію з диференціальним та інтегральним численням: похідну легко обчислити, бо це локальна операція, тоді як інтеграл — глобальна й часто не має простого розв’язку. Цей принцип переноситься на розробку ПЗ: аналіз (розбиття системи на компоненти) дається легше, а синтез (розуміння взаємодії частин) потребує значно більше зусиль. Для SRE синтез критичний під час розслідування інцидентів, але галузь досі не визнає його пріоритетом, і автор закликає вчитися глибше опановувати операційні деталі систем.

LOAD "PL/CBMBASIC",8,1: Commodore 64 BASIC for PostgreSQL

PL/CBMBASIC — це розширення для PostgreSQL, що запускає оригінальний інтерпретатор Commodore 64 BASIC V2 всередині процесу бази даних: кожен виклик функції обнуляє 64 KB емульованої памʼяті та перезавантажує віртуальний C64 за 15–20 мікросекунд. Розширення валідує код на етапі створення функції, виловлюючи класичні проблеми C64 (наприклад, змінна TOTAL неможлива, бо містить ключове слово TO), і перетворює device 8 на SQL-запити — OPEN, INPUT#, PRINT# працюють з таблицями через SPI. Продуктивність приблизно в 6–19 разів нижча за PL/Python, але мільйон BASIC-інструкцій на секунду всередині PostgreSQL — цілком достатньо для ностальгійного продакшену.

Якщо ваш код раптом напише `10 GOTO 10`, statement_timeout чемно прибʼє процес — на відміну від справжнього C64, де довелося б смикати RUN/STOP.

FIDE Ethics & Disciplinary Commission issues a decision in case involving GM Vladimir Kramnik – International Chess Federation

Комісія з етики та дисципліни FIDE визнала ГМ Володимира Крамника винним за низкою порушень — зокрема булінг, кібербулінг та неправдиві публічні звинувачення — через його заяви щодо ГМ Давіда Навари, покійного ГМ Данила Народицького та інших гравців. Крамнику призначено дворічну заборону на участь у змаганнях FIDE та офіційних шахових функціях, з яких один рік — активне відсторонення, а другий — умовно з випробувальним терміном у три роки, а також 12 місяців неоплачуваної роботи на користь шахової спільноти. Комісія підкреслила, що боротьба з читерством має відбуватися через закриті процедури FIDE, а публічне пов’язування гравців із підозрами без належної інституційної перевірки завдає невиправданої репутаційної та психологічної шкоди.

PostgreSQL and the OOM Killer: Why We Use Strict Memory Overcommit

Ubicloud використовує strict memory overcommit (vm.overcommit_memory=2) для PostgreSQL, щоб замість катастрофічного вбивства процесу OOM killer'ом і зупинки всіх з'єднань, отримувати передбачувану помилку ENOMEM, яку окремий backend обробляє без наслідків для решти системи. Через однобуквену помилку в Linux 6.5 лічильник Committed_AS витікав, що створювало 648 ГБ «фантомної» пам’яті та ламало роботу strict overcommit, але після виправлення в 6.8 режим знову став безпечним. Для commit limit команда застосовує формулу: 80% від фізичної пам’яті плюс 2 ГБ резерву на sidecar-процеси (Go-програми), враховуючи також необліковані ядерні структури та page cache.

Цікаво, наскільки сильно ця проблема залежала від специфіки їхнього навантаження і чи виявляв баг себе на інших дистрибутивах з тим самим ядром.

The Fall and Rise of Screwworm - by Brian Potter

М'ясоїдний черв'як screwworm, якого повністю винищили в США та Центральній Америці завдяки десятиліттям скидання стерильних самців, близько 2023 року прорвав бар'єр у Дар'єнському розриві й дістався Техасу. Програма ослабла через пандемію, нелегальне перевезення худоби, вирубку лісів та скорочення виробництва стерильних мух до мінімального рівня підтримки. USDA екстрено нарощує потужності, але на повторне викорінення знадобиться до десяти років — класичний випадок, коли успіх приспав пильність, і проблему доводиться вирішувати заново.

Інфраструктура безпеки завжди здається надмірною, доки не виявиться, що її якраз і не вистачало.

Best Simple System for Now | Dan North & Associates Limited

Стаття пропонує концепцію "Best Simple System for Now" (BSSN) — шлях між перфекціонізмом і прагматизмом у розробці, який дозволяє писати код, що є найпростішим для поточних потреб, але має достатню якість. Головний принцип — не передбачати майбутнє, а створювати систему, з якої прибрано все зайве, що не потрібно саме зараз, водночас не жертвуючи надійністю. Це зменшує вартість затримки, ризик технічного боргу від передчасних узагальнень і дозволяє легко адаптувати код під реальні зміни вимог.

Схоже на радикальний YAGNI з мантрою якості: легко декларувати, але складно втримати рівновагу між "просто" і "найкраще", коли "зараз" постійно зсувається.

The Anti-Amazon - Benjamin Y. Fong

Стаття порівнює бізнес-моделі Amazon та Costco, називаючи останню "анти-Amazon". Costco досягає успіху завдяки обмеженому асортименту (близько 4000 SKU), низьким накладним витратам, високим зарплатам і мінімальній плинності кадрів, тоді як Amazon робить ставку на нескінченний вибір і швидку доставку, що веде до величезних логістичних витрат. Автор стверджує, що модель Costco є більш соціально бажаною та логістично ефективною, особливо для щоденного споживання, і пропонує використовувати її принципи для створення публічних продуктових магазинів у Нью-Йорку.

$2.12 за халяльний wraps у державному магазині — це, мабуть, найамбітніша обіцянка від мерії з часів безкоштовного сиру.

What a Forgotten 100-Year-Old Government Report Says About Who We Are

Стаття досліджує майже забутий урядовий звіт 1929 року "Recent Social Trends", який детально описував життя в США 1926 року, і проводить паралелі з сьогоденням. Автор зазначає, що тодішні тривоги через технологічне безробіття (через механізацію), імміграцію, зміну ролі жінок та вплив нових медіа (радіо) напрочуд схожі на сучасні дебати про ШІ, соцмережі та демографічні зрушення. Водночас наголошується на колосальному прогресі — у 1926 році половина американців жила без водогону й електрики, а дитяча праця була нормою. Головний висновок: попри зміну декорацій, глибинні людські страхи перед майбутнім залишаються незмінними, хоча якість життя стала незрівнянно вищою.

Цікавий парадокс: життя стає об'єктивно кращим, але людська здатність панікувати через зміни, схоже, лишається незмінною константою.

GitHub - teamchong/pxpipe: cut Fable 5 token usage by rendering text context as images · GitHub

pxpipe — це локальний проксі для Claude Code, який зменшує витрати вхідних токенів, перетворюючи об'ємний контекст (системні промпти, документацію інструментів, стару історію) на компактні PNG-зображення. Оскільки вартість зображення в токенах фіксована розмірами в пікселях, а не обсягом тексту, на щільному контенті досягається ~3.1 символів на токен проти ~1 символа у звичайному тексті. У тестах на моделі Fable 5 це дає зниження загального рахунку на 59–70%, але метод втратний — точне відтворення критичних рядків (хеші, ID) із зображень не гарантоване, тому їх слід залишати текстом.

Схоже, що замість оптимізації кожного токена в тексті, автор просто «фотографує» контекст і змушує модель читати з картинки — геніальний трюк, який працює через особливості ціноутворення vision-токенів.

US residents angry at datacenters ‘being shoved down our throats’ are recalling officials | Datacenters | The Guardian

У США дедалі більше громад виступають проти будівництва датацентрів через шум, загрозу водним ресурсам, навантаження на електромережі та таємність угод із забудовниками. Мешканці різних штатів, від Каліфорнії до Міссурі, ініціюють кампанії з відкликання місцевих посадовців, які схвалюють такі проекти без належної прозорості. Протести об’єднали демократів і республіканців, а деякі лобістські сайти на підтримку датацентрів виявилися справою політтехнологів, а не реальних девелоперів.

Рідкісний випадок, коли обурення з приводу конкретного сусідського питання долає партійну поляризацію.

[2602.20415] Markets are competitive if and only if P != NP

Автор доводить, що конкурентні ринки можливі лише за умови, що P ≠ NP. Якщо P = NP, фірми можуть ефективно розв’язувати задачу виявлення змови, що робить змову стійкою рівновагою. Разом із попереднім результатом про те, що ринкова ефективність потребує P = NP, це означає, що ринки не можуть бути одночасно інформаційно ефективними й конкурентними. Штучний інтелект, розширюючи обчислювальні можливості, штовхає ринки від конкуренції до алгоритмічної змови.

Отже, або ринки ефективні, але картелізовані, або конкурентні, але неефективні — схоже, ідеальних ринків не існує в жодному класі складності.

» The Life and Times of Maxis, Part 1: SimEverything The Digital Antiquarian

Після несподіваного мейнстримного успіху SimCity, Maxis під керівництвом Вілла Райта спробувала перетворити симуляції складних систем на окремий жанр, випустивши серію амбітних, але дедалі більш нішевих "software toys": SimEarth (симуляція планети за гіпотезою Геї), SimAnt (колонія мурах), SimLife (цифрове життя та клітинні автомати) та SimFarm (ферма). Усі вони, попри серйозний науковий бекграунд, продавалися на порядок гірше за SimCity, оскільки виявилися надто абстрактними, повільними або відірваними від реальності для широкої публіки. Компанія виживала майже виключно за рахунок постійних перевидань і портування SimCity, включно з версією для SNES, яку просував Сігеру Міямото. Зрештою під тиском бізнес-партнера Джеффа Брауна та інвесторів Вілл Райт неохоче розробив SimCity 2000 — технічно та візуально оновлене, комерційно безпечне продовження, що знову стало бестселером і дало студії фінансовий ресурс для подальших езотеричних експериментів.

Схоже, що в історії Maxis сиквел, який Райт робив "у режимі менеджменту" без великого ентузіазму, виявився єдиною надійною бізнес-моделлю — решта Sim-весевіту була радше дорогим науково-популярним хобі за гроші SimCity.

Factories are just rooms (Interconnected)

Автор розповів семирічним дітям про процес створення свого AI-годинника: від прототипування та дизайну до лиття пластику й пакування. Його головна мета — не викликати захват масштабами, а показати, що виробництво це просто процес у звичайних кімнатах, який можуть опанувати звичайні люди. Він закликає батьків ходити в школи й ділитися досвідом створення речей, щоб діти змалку засвоїли: вони теж можуть бути тими, хто вигадує й виготовляє світ навколо.

Діти в 7 років уже знають слово «прототипування», а дехто на редіті й досі думає, що це коли дизайнер малює одразу фінальний макет.

Valve open source the Steam Machine e-ink screen so you can make your own | GamingOnLinux

Valve опублікувала у відкритому доступі дизайн та інструкції для e-ink дисплея на корпусі Steam Machine — проєкт назвали “Inkterface” і виклали на GitLab під ліцензією MIT. Скласти власний екран можна з компонентів Adafruit (ESP32 Feather, e-ink панель 5.83") та кількох гвинтів і магнітів. Valve не продаватиме готовий аксесуар, але JSAUX уже підтвердила, що працює над власними версіями “Ink & Pixel”.

Give Smart People The Tools To Do Smart Things | SuperUserDone

Стаття стверджує, що гучні заяви AI-компаній про швидку заміну людей — це маркетинговий хайп, розрахований на залучення інвестицій, поки міхур не луснув. Автор нагадує: компілятори не замінили програмістів, а електронні таблиці — бухгалтерів, бо суть роботи не в артефакті, а в розумінні, архітектурі та відповідальності за рішення. Справжня цінність AI — не в заміні експертів "бездушними роботами", а в створенні інструментів, які підсилюють фахівців, даючи їм змогу робити складніші та якісніші речі.

Дивно чути про "непотрібність компіляторів" від людини, чий автопілот досі плутає місяць із жовтим світлофором.

Persistent Memory for AI Agents: Why You Need Zep, Mem0, and ContextNest

Для production AI-агентів потрібна трирівнева архітектура пам'яті: Zep зберігає сесійні історії, Mem0 — профілі користувачів, а ContextNest надає детермінований, версіонований корпоративний контекст (ціни, політики, SOP) через Markdown-сховища з Git та SHA-256. Семантичні підходи Zep і Mem0 ймовірнісні та не гарантують актуальності фактів, тоді як ContextNest фізично виключає застарілі файли з активного вікна, запобігаючи галюцинаціям. Усі три рівні разом не лише структурують дані, а й оптимізують контекстне вікно, знижуючи витрати токенів.

Якби просто кидати все в один векторний індекс, агенти і далі плутали б старі API з новими — добре, що зʼявився явний governance tier.

[2607.02512] Program-as-Weights: A Programming Paradigm for Fuzzy Functions

Запропоновано парадигму програмування для «нечітких» функцій — задач, які погано формалізуються правилами. Її реалізація, Program-as-Weights (PAW), використовує велику модель-компілятор (4B параметрів), що за один прохід перетворює специфікацію природною мовою на компактний адаптер для замороженого легкого інтерпретатора (0.6B). Отриманий артефакт виконується локально, споживаючи приблизно у 50 разів менше пам’яті для інференсу, і при цьому досягає якості прямого prompting 32B-моделі.

Ідея використовувати велику модель не як разового вирішувача, а як фабрику дешевих багаторазових інструментів, що працюють офлайн, виглядає набагато практичнішою за безкінечні виклики API.

Agentics: Memorizing Session Transcripts Isn't Useful

Агенти, що пишуть код, не отримують жодної користі від пошуку в історії своїх сесій — навіть навпаки, це часто погіршує результат. Причина в тому, що агенти не здатні відфільтровувати або видаляти застарілий чи нерелевантний контекст і сприймають будь-які дані у вікні як істину, що веде до накопичення сміття та «дрейфу намірів». Натомість набагато ефективніше інвестувати в якісні артефакти коду (PR, коміт-повідомлення, документацію), які створюються або рецензуються людиною. Автор навіть переосмислив свій власний продукт, визнавши, що автоматичне збереження транскриптів — це радше шум, ніж «нова нафта».

Це один з тих рідкісних випадків, коли «просто додати ще пам'яті» не лише не працює, а й шкодить — схоже, ChatGPT із його вічною амнезією раптом виявився ідеальною архітектурою.

Half-Baked Product | Weli's blog

Засновник стартапу Ovens Inc. зібрав гроші на "ідеальну" розумну піч, але MVP ледве працює — алгоритм випікання хліба, тортів і піци помиляється у третині випадків. Великий контракт із Pepepizza змушує команду кинутися реалізовувати специфічні вимоги (обертова база, нестандартні розміри), ігноруючи ключову проблему. Відділ продажів натомість починає безконтрольно обіцяти функції на кшталт "кнопки для свічок", через що якість продукту остаточно розвалюється. Історія закінчується втратою клієнта, вигоранням інженерів та циклічним повторенням тих самих помилок із новим найманим розробником.

Залізний закон стартапів: якщо твій продукт горить, рано чи пізно ти почнеш продавати свічки, а потім — вибачатися за пожежу.

GitHub - FossPrime/Steam-Controller-Auto-Charge: Slam the controller into the magnetic puck until it charges · GitHub

Steam Controller Auto-Charge — це веб-додаток, який за допомогою overhead-камери та OpenCV.js (Lucas-Kanade optical flow) автоматично спрямовує контролер Steam до магнітної зарядної станції. Через WebHID він надсилає асиметричні гаптичні імпульси на часто 70 Гц на внутрішні лінійні резонансні актуатори, керуючи рухом, а при відстані менше 150 пікселів зменшує частоту вдвічі для м’якого стикування. Також відстежує рівень заряду та напругу батареї через специфічні звіти, а для обробки зображень використовується Rust/WASM.

З таким підходом незабаром гаджети навчаться самостійно підповзати до розеток, поки ми спимо.

GitHub - searxng/searxng: SearXNG is a free internet metasearch engine which aggregates results from various search services and databases. Users are neither tracked nor profiled. · GitHub

SearXNG — вільний метапошуковий двигун, що агрегує результати з різних пошукових сервісів, не відстежуючи та не профілюючи користувачів. Проєкт ліцензований під AGPL-3.0, має докладну документацію зі встановлення та конфігурації, а також активну спільноту в Matrix.

How Amsterdam invented the fire department - Works in Progress Magazine

У 17 столітті брати Ян і Ніколас ван дер Гейдени винайшли пожежну машину з гнучкими шлангами та повітряною камерою, що дозволяла подавати воду під тиском прямо в осередок полум’я. Вони також розробили систему сповіщення, правил і грошових винагород для пожежних, замінивши хаотичні старі методи. Після впровадження цих змін у 1682 році Амстердам зменшив збитки від пожеж більш ніж на 99% за перші п’ять років.

Це вражаючий приклад, коли бюрократія не заважала прогресу, а навпаки — міська влада охоче платила за «корисні» винаходи, що сьогодні виглядає майже як наукова фантастика.

Applied Category Theory Course

Це онлайн-курс з прикладної теорії категорій, який читає Джон Баез на основі книги «Seven Sketches in Compositionality». Курс містить 77 лекцій, згрупованих у чотири розділи: Ordered Sets, Resource Theories, Databases та Collaborative Design. Матеріал поступово знайомить із базовими поняттями (preorder, Galois connections) і доходить до складніших тем, як-от Kan extensions та enriched profunctors.

Disclosed CVEs: 3.5× Spike After Claude Mythos | Epoch AI

У червні 2026 року 21 велика технологічна компанія оприлюднила близько 1500 CVE високого та критичного рівня — це у 3.5 рази більше за будь-який попередній місячний рекорд. Стрибок збігся з анонсом Anthropic про Claude Mythos Preview, модель здатну автономно знаходити вразливості, та з запуском Project Glasswing, який, за заявами, виявив понад 10 000 таких уразливостей. OpenAI реалізує схожий підхід у продукті Daybreak.

Частину зростання можна пояснити не тільки можливостями ШІ, а й хвилею ажіотажу, що підштовхнула дослідників активніше публікувати знахідки.

Espionage Against the European Parliament: Member of Committee Investigating Spyware Hacked with Pegasus - The Citizen Lab

Колишнього євродепутата Стеліоса Кулоглу, члена комітету PEGA з розслідування зловживань spyware, двічі заразили Pegasus під час ключових етапів роботи комітету — у жовтні 2022 та березні 2023 року. Це дало зловмисникам потенційний доступ до конфіденційних документів і внутрішніх дискусій про порушення, які сам комітет намагався викрити. Citizen Lab не встановила конкретного замовника, але виявила збіг із кампанією проти російських та білоруських журналістів у Європі, що вказує на оператора з ліцензією на дії в кількох країнах ЄС.

Комітет, який розслідував spyware, сам опинився під ковпаком — іронія, гідна антиутопії.

Leanstral 1.5: Proof Abundance for All

Leanstral 1.5 — відкрита модель (Apache-2.0) на 6B активних параметрів для формальної верифікації в Lean 4. Вона досягла 100% на miniF2F, вирішила 587 із 672 задач PutnamBench (приблизно $4 за задачу) і встановила новий SOTA на FATE‑H (87%) та FATE‑X (34%). Модель тренували через mid‑training, SFT та RL з CISPO у двох середовищах: мультитурне доведення теорем та агентне редагування коду з доступом до Lean LSP. Leanstral 1.5 також продемонструвала практичну користь, автоматично виявивши 5 нових багів у 57 опенсорсних репозиторіях, включно з переповненням у zigzag-декодуванні. Продуктивність моделі стабільно зростає зі збільшенням бюджету токенів, показуючи сильне test‑time scaling.

MSI Center - How to gain SYSTEM privileges in seconds! | MrBruh's Epic Blog

У MSI Center виявлено вразливість у службі Notebook Foundation: через іменований канал будь-який автентифікований користувач може виконати код із правами SYSTEM, використовуючи команду REXE та слабке шифрування 3DES. MSI випустила патч за два дні, але поштова скринька для звітів про вразливості була переповнена, через що повідомлення могло загубитися.

Переповнена поштова скринька для баг-репортів — мабуть, найщиріший security disclosure policy, який тільки можна уявити.

Soatok’s Informal Guide to Threat Models - Dhole Moments

Стаття пропонує неформальний посібник із моделювання загроз: відповісти на 7 ключових запитань (що захищаємо, від кого, як, які припущення, що свідомо ігноруємо) та будувати граф зв’язків активів. Як приклад поганої моделі автор наводить Matrix — просто перелік атак без активів чи припущень, який не оновлювався роками попри відомі криптографічні проблеми. У практичній частині показано, як threat modeling допомагає обґрунтувати відмову від паролів на користь passkeys і викриває слабкість аргументів проти non-hybrid ML-KEM.

Показово, що більшість критиків non-hybrid ML-KEM не пропонують PQ+PQ-гібридів — єдиного раціонального хеджу на постквантову еру, а замість цього чіпляються за ECDH, який після Q-Day не дасть жодного захисту.

Performance per dollar is getting faster and cheaper | Wafer

Wafer запустила GLM-5.2 на AMD MI355X, досягнувши 2626 tok/s/node на агрегованому навантаженні та 213 tok/s на одному потоці — більш ніж удвічі дешевше, ніж на NVIDIA Blackwell. Інженери використали lossless-квантування MXFP4 через AMD Quark, inference-фреймворк sglang та speculative decoding, виправивши кілька дрібних багів (ROCm-сумісність, префікс шляхів для MTP). З оптимізацією MoE-ядер на рівні конфігурацій, без написання кастомних kernel’ів, вдалося значно скоротити відставання в prefill-продуктивності.

Схоже, AMD нарешті перестає бути вічним наздоганяючим у AI-інференсі — для бюджетних розгортань це справді хороша новина.

Maybe you should learn something | marginalia.nu

Навчання нового робить життя багатшим, але починати завжди важко: мозок і м’язи швидко втомлюються, а покращення приходять лише після нічного відпочинку. Автор радить практикуватися 30–45 хвилин на день, зосередившись на основах і припиняючи, коли помилок стає забагато. Більшість застрягає на цьому етапі, але ті, хто витримують, отримують навички, які залишаються на все життя.

Dispersion loss (LM-Dispersion)

Дослідження показує, що в малих мовних моделях векторні представлення токенів у глибоких шарах сходяться до вузького конуса — феномен “embedding condensation”. Автори пропонують dispersion loss, який розштовхує embeddings на гіперсфері, покращуючи узагальнення малих моделей. Ефект скромний, але статистично значущий, і автори закликають до подальших досліджень причин та архітектурних рішень.

Дисперсійне регуляризування витончене, але, як зізнаються самі автори, виграші скромні — мабуть, великі моделі не тільки краще розкидають embeddings, а й просто більше “думають”.

2018–2025 (c) Списуй але не один в один