Дайджест #19. Середа, 24 червня

Це підбірка за 24 червня 2026. Поки ти тут, вийшов свіжий випуск — не пропусти.

treedocs

treedocs — CLI-інструмент, який генерує візуально зручне дерево файлів з короткими описами, допомагаючи швидше орієнтуватися в будь-якій кодовій базі. Він синхронізує YAML-файл із реальною файловою системою, позначає застарілі чи відсутні шляхи, підтримує Git-хуки та валідацію за JSON Schema. Описи можна заповнювати вручну або доручати AI-агентам, що знижує витрати токенів і спрощує рев’ю та онбординг.

Проста ідея, яка реально зменшує хаос у великих репозиторіях, особливо якщо довірити рутинне описування агентам.

The worthlessness of vitamin D is mildly exaggerated

Рандомізовані дослідження спростували міф про чудодійність вітаміну D, але не довели його повної марності — мета-аналізи показують слабкий позитивний ефект, особливо для ракової смертності при щоденному прийомі. Навіть невелике зниження ризику (на кшталт HR 0.96) означало б додаткові пів року життя, що значно перевищує вартість добавок. Біологія та еволюція (бліда шкіра, високі рівні у традиційних популяціях) вказують на те, що помірно підвищені рівні вітаміну D є радше корисними, ніж шкідливими.

Спроба переконати читачів у потенційній користі за допомогою таблиць і симуляцій виглядає як чесне зважування слабких доказів, хоча авторська одержимість біологічними шляхами робить текст схожим на допитливе самокопання.

The Teensy Executable Revisited

Автор повертається до мінімального ELF-виконуваного файлу, щоб створити версію, яка жорстко відповідає специфікації ELF, і шляхом перекриття заголовків, використання невизначеного поля p_paddr для коду та хитрих переходів скорочує її з 91 до 76 байтів. Однак прямий системний виклик для виходу не є частиною задокументованого ABI, тому для повної коректності довелося б додати динамічне зв’язування з функцією _exit із libc, що залишено для наступного есе.

Don't verify email addresses by sending spam to them

Деякі сервіси для «валідації» email-адрес використовують парадоксальний підхід: вони відправляють на вказану адресу спам, вважаючи її валідною, якщо лист не повернувся. На прикладі форми реєстрації Pangram видно, що після введення email надходить фейковий інформаційний лист з одного з багатьох спам-доменів, причому система агресивно ретраїть надсилання з різних IP у разі блокування.

Іронія в тому, що такий метод або доставляє спам (не валідуючи нічого), або провалюється через спам-фільтри, а вся інфраструктура виглядає так, ніби хтось задіяв недоробленого ШІ-агента.

Vulnerability Reports Are Not Special Anymore

Filippo Valsorda стверджує, що з поширенням LLM звіти про вразливості втратили свій особливий статус: знаходити потенційні проблеми тепер можуть і самі супроводжувачі, і атакуючі, а дефіцитним ресурсом стало не виявлення, а тріаж знахідок. Конфіденційність та ембарго більше не дають суттєвої переваги, оскільки зловмисники так само здатні генерувати кандидатів у вразливості. Натомість головними стають швидке виправлення, запобігання та автоматичний аналіз коду в CI.

Тепер справжнє мистецтво — не подякувати за звіт, а відцідити справжню загрозу з-поміж потоку LLM-галюцинацій.

The Map — Jerry's Map

Джеррі Ґретцінґер малює мапу вигаданого міста з 1963 року, і тепер це понад 4000 панелей, що формують приблизне коло. Увесь процес керується інструкціями з саморобної колоди карт — вони підказують, які дії виконати, від нанесення фарби до колажів чи створення нових аркушів. Мапа розвивається шарами (базовий, Порожнеча, Червоний вимір, Чорнота, Зикурат, Потоп, Переродження), які циклічно змінюють один одного, поєднуючи чіткі правила з випадковістю.

Шістдесят років ручного генеративного мистецтва — картковий рушій для всесвіту, який досі уникає комп’ютера.

[2606.24597] Qwen-AgentWorld: Language World Models for General Agents

Qwen-AgentWorld — це перші мовні моделі світу, здатні симулювати динаміку середовищ для загальних агентів у семи доменах, використовуючи довгі ланцюжки міркувань. Моделі (35B-A3B та 397B-A17B) тренувалися у три етапи — CPT, SFT та RL із гібридними винагородами — на понад 10 мільйонах траєкторій. Вони значно перевершують frontier-моделі на новому бенчмарку AgentWorldBench і можуть працювати як окремий симулятор для agentic RL, що дає приріст навіть більший за тренування лише на реальних даних, або як warm-up для покращення downstream-показників на семи агентних бенчмарках.

FUTO Swipe

FUTO представила відкриту систему свайп-вводу, що працює повністю на пристрої, без потреби в інтернеті. В основі три моделі — layout-agnostic Encoder, маленький ContextLM для фільтрації незв’язних слів та layout-specific Decoder — які разом досягають топ-4 fail rate близько 4% на тестовому наборі. Загальний розмір моделей менше 2.5 млн параметрів, тому вони легко запускаються навіть на слабких телефонах. Також опубліковано MIT-ліцензований датасет із мільйона свайпів та C++ бібліотеку для інференсу.

Нарешті хтось зробив нормальний свайп, який не зливає ваші жести у хмару.

In memory of the man who put red and green squiggles under words - The Old New Thing

Тоні Крюґер, який працював над багатьма версіями Microsoft Word, нещодавно помер. Саме він зробив перевірку правопису фоновою й додав червоні та зелені хвилясті підкреслення для помилок — рішення, яке не блокувало роботу користувача й стало всюдисущим стандартом.

Ці хвильки такі звичні, що ми сприймаємо їх як належне, а за ними стоїть конкретна людина — дякуємо, Тоні.

Unlag Neo: Macbook Neo Cursor lag "fix" · GitHub

Unlag Neo — це обхідне рішення для лагу курсора на Macbook Neo (macOS Tahoe), яке змушує систему постійно використовувати програмний рендеринг курсора. Для цього додаток у фоновому режимі записує 1 піксель екрану раз на 10 секунд (фактично в /dev/null), що майже не навантажує процесор. Додаток генерується простим shell-скриптом без потреби в Xcode чи платному акаунті розробника.

Схоже, навіть у 26-й версії macOS доводиться вмикати запис екрана, щоб курсор не заїкався — маленький крок для користувача, великий крок для баг-репорту.

GitHub - End2End-Diffusion/diffusion-bench: Towards Holistic evaluation of Generative Diffusion Transformers! · GitHub

DiffusionBench — уніфікований фреймворк для тренування та оцінювання генеративних дифузійних моделей. Підтримує широкий спектр латентних просторів (VAE, RAE, Pixel space), варіанти output prediction (x-prediction, v-prediction), flow matching, архитектури (LightningDiT, JiT, DDT) і задачі (ImageNet, T2I) у межах одного інтерфейсу. Кодова база дозволяє відтворювано навчати та порівнювати моделі за єдиними метриками, а також сумісна з coding agents для автоматизації експериментів.

Схоже на спробу навести лад у зоопарку дифузійних бенчмарків — тепер можна не збирати оцінки з десятка різних репозиторіїв.

Meta Pauses Employee-Tracking Program Following Internal Data Leak | WIRED

Meta призупинила програму Model Compatibility Initiative (MCI), яка записувала натискання клавіш, рухи миші та вміст екранів співробітників для навчання AI. Рішення ухвалили після того, як через внутрішню помилку безпеки бази з цими даними виявилися відкритими для всіх працівників компанії. Інструмент і раніше викликав протести через проблеми приватності, а тепер його відновлять лише після посилення контролю захисту.

Компанія, яка знає про кожен ваш лайк і коментар, не змогла сховати від власних співробітників логи їхніх клавіатур — це майже поезія корпоративної безпеки.

Justin Poehnelt on X: "Two months ago I was fired by Google for creating the Google Workspace CLI. It went viral, hit #1 on Hacker News, gained thousands of GitHub stars and many thousands of actual users in just a couple days. It was an incredible, confusing journey, from directors and leaders asking https://t.co/VprDW9DO9y" / X

Джастін Понельт створив Google Workspace CLI, який став вірусним, очолив Hacker News і зібрав тисячі зірок на GitHub та користувачів, за що через два місяці його звільнили з Google. Причиною, ймовірно, був страх керівництва перед тим, як агенти можуть порушити роботу Workspace, хоча за два дні до звільнення на Google Cloud Next анонсували офіційний CLI.

Іронія в тому, що компанія спершу звільнила інженера за те, що незабаром вирішила зробити сама.

GitHub - context-labs/HALO: Hierarchal Agent Loop Optimizer · GitHub

HALO — це методологія та інструмент для рекурсивного самовдосконалення агентних harness: він збирає execution traces через OpenTelemetry, пропускає їх через RLM‑двигун, а той виділяє системні патерни збоїв і генерує звіт. Потім звичайний coding agent (наприклад, Cursor чи Claude Code) вносить зміни в harness, і цикл повторюється. Репозиторій містить desktop‑застосунок, Python‑пакет (halo‑engine) та бенчмарки, зокрема відчутний приріст на AppWorld для Gemini 3 Flash і Sonnet 4.6.

Фактично це спроба автоматизувати те, чим і без того займається кожен, хто намагався зрозуміти, чому його агент вкотре вперто ходить по колу.

US AI stock sell-off shakes markets from Wall Street to Asia | Stock markets | The Guardian

Масштабний розпродаж акцій компаній, пов’язаних зі штучним інтелектом, спричинив падіння фондових ринків від США до Азії. Інвестори засумнівалися в завищених оцінках AI-сектору та надмірних витратах на інфраструктуру, зокрема на тлі сигналів ФРС про можливе підвищення ставок. Значних втрат зазнали Alphabet (через відхід ключових дослідників) та SpaceX (після новини про залучення $20 млрд через bond sale). Економісти попереджають про схожість із бульбашкою доткомів, коли лише сім техногігантів формують 30% вартості S&P 500.

Боргове фінансування AI-амбіцій дедалі більше нагадує колективну гру в гарячу картоплю.

GitHub - y-times-y/y: A malleable coding agent app. Use Claude Code and Codex to build your projects and reshape y itself live. · GitHub

y — це десктопний застосунок для macOS, який надає чат-орієнтоване середовище для локальної роботи з агентами кодування Claude Code та OpenAI Codex. Головна особливість — можливість змінювати власний інтерфейс через Modify: агент редагує UI, зміни проходять diff-рев’ю, і їх можна прийняти або відкотити. Архітектура розділена на захищене ядро (Kernel) та змінний користувацький шар (Userland), щоб убезпечити критичні функції. Застосунок підтримує ізольовані робочі простори для паралельної роботи агентів без конфліктів.

Самомодифікація інтерфейсу через агента — потужна ідея, хоча на практиці може породжувати несподівані стани UI, якщо diff-рев’ю недостатньо суворе.

Introducing Claude Tag \ Anthropic

Claude Tag — це новий командний інструмент, який додає Claude до Slack-каналів як повноцінного учасника. Його можна викликати через @Claude, делегуючи завдання, а модель сама планує кроки, запам’ятовує контекст каналу, працює асинхронно та може проявляти ініціативу. В Anthropic уже 65% коду продуктової команди створює внутрішня версія Claude Tag. Інструмент доступний у бета-версії для клієнтів Claude Enterprise та Team.

GitHub - future-file-format/F3: [SIGMOD 2026] F3: The Open-Source Data File Format for the Future · GitHub

F3 — дослідницький колонковий формат даних, який виправляє недоліки старих форматів (Parquet, ORC) і робить ставку на розширюваність через вбудовування Wasm-декодерів прямо у файл. Репозиторій містить Rust-код прототипу, бенчмарки та скрипти для відтворення експериментів із наукової статті (SIGMOD 2026). Автори наголошують, що проєкт не призначений для виробничого використання, і поширюють його під ліцензією MIT.

Ідея пакувати Wasm у кожен файл, щоб гарантувати сумісність на будь-якій платформі без рідних декодерів, звучить цікаво — хоча поки що це радше академічний експеримент.

San Diego Photologs from the 1970s

Виявлено архів високоякісних сканів фотологів Сан-Дієго 1970-х — аналогового попередника Google Street View. Кадри з 35-мм плівки зафіксували вулиці, де домінують пастельні авто, неонові вивіски з ручною типографікою, тематичні ресторани та випадкові перехожі. Автор порівнює той барвистий візуальний хаос із сучасним сірим мінімалізмом та констатує зникнення капризу через стандартизовані комп’ютерні макети.

Сьогодні єдине, що обертається на узбіччі — це спінери на вінілових банерах, а не цілий арсенал гіпносексизму з живим неоном.

GitHub - baidu/Unlimited-OCR: Unlimited OCR Works: Welcome the Era of One-shot Long-horizon Parsing. · GitHub

Компанія Baidu представила Unlimited-OCR — модель для одноетапного (one-shot) розбору документів із довгим горизонтом (long-horizon parsing). Вона підтримує обробку окремих зображень, багатосторінкових файлів та PDF через інтерфейси transformers або SGLang, використовуючи no-repeat n-gram logit processor для запобігання повторенням. Модель доступна на Hugging Face і ModelScope, а технічний опис опубліковано на arXiv.

The truth about being a manager | sofiakodar.github.io

Стати менеджером означає відчути самотність і дистанцію від колишньої команди, адже динаміка стосунків змінюється після перших складних рішень чи зарплатних переговорів. Доводиться постійно фільтрувати свої слова, приховувати власні емоції та «продавати» команді непопулярні рішення, водночас не маючи змоги вилити розчарування підлеглим. Більшість менеджерів не отримують належного навчання й мусять самостійно освоювати зворотний зв’язок, управління вгору та налагодження зв’язків з іншими відділами, що часто залишає відчуття безсилля та браку прогресу. Попри це, ви отримуєте змогу бачити цілісну картину бізнесу, розв’язувати системні проблеми й відчувати гордість, коли ваша команда досягає успіху або ваші підопічні професійно зростають.

GitHub - ilbertt/bun-sqlgen: Types generator for your Bun.sql queries · GitHub

bun-sqlgen — генератор типів для SQL-запитів у Bun, який дає змогу писати звичайні шаблонні рядки через `Bun.sql`, позначаючи їх власними іменами (наприклад, `sql.GetUser`). Інструмент виконує кодогенерацію з файлів міграцій, перевіряючи кожен запит проти реальної схеми Postgres чи SQLite, тому невідповідність колонок або null-безпеку видно ще на етапі компіляції. Жодного ORM — лише нативний рантайм Bun і типізовані рядки з автоматичним виведенням типів.

Замість ORM — кодогенерація просто з міграцій: менше абстракцій і повний контроль над SQL без ворожіння на типах.

Madison Square Garden Made Dossier on Activists Who Opposed Facial Recognition

Madison Square Garden зібрала досьє на активістів, які публічно критикували використання систем розпізнавання облич у закладі. Документ під назвою «Facial Recognition Activists.docx» містив їхні твіти та коментарі, і був доступний співробітникам компанії. Це виявили після витоку 45 ГБ даних, викрадених хакерами.

Схоже, MSG не лише сканує обличчя, а й колекціонує обличчя незгодних.

The Low-Tech AI Of Elden Ring - NEGA.TV

ШІ ворогів у серії Soulsborne реалізовано на стеку цілей (pushdown automaton) у скриптах Havok Script (Lua). Найвища ціль виконується щокадру, додаючи підцілі, а спеціальна система переривань дає змогу миттєво реагувати на події, як‑от використання предметів чи підпалення. У порівнянні зі скінченними автоматами, деревами поведінки чи GOAP цей підхід компактніший, гнучкіший для дизайнерів і вимагає менше ресурсів, хоча логіка зосереджена в імперативному коді всередині станів. Успіх ігор FromSoft показує, що проста стекова модель здатна створювати надзвичайно різноманітну та жорстоку поведінку без громіздких архітектур.

80386 Early Start Memory Access - Small Things Retro

У ядро z386 на FPGA додано механізм Early Start, який у 80386 прискорював доступ до пам’яті приблизно на 9% — він починає обчислення адреси наступної інструкції ще до завершення попередньої й використовує forwarding для коректної роботи з регістрами. Разом із прискоренням шини пам’яті, раннім перенаправленням гілок, ширшим декодером і розділеним кешем це дало ~39% приросту продуктивності без підвищення тактової частоти (85 МГц), і z386 тепер обходить ao486 за FPS у Doom. Ядро відтворює оригінальний мікрокод 386, але оптимізоване під FPGA й не претендує на покадрову точність.

Неконвеєрний x86 переганяє конвеєрний без збільшення частоти — конвеєр, виходить, не панацея.

Lossless GIF recompression via exhaustive search | Arusekk blog

GIF використовує стиснення LZW, яке не є надто ефективним; flexiGIF покращує його гнучким парсингом із випередженням на один крок, але може давати гірший результат через марнування словникового запису. Автор написав ZGIF для вичерпного перебору всіх допустимих LZW-потоків — програма знаходить оптимальне стиснення, проте надзвичайно повільна (4 хв для зображення 16×16 у Python). Обмеження пошуку одним кроком випередження скоротило час до 4 секунд, усе одно перевершуючи flexiGIF.

Фактично, це академічна вправа для абсолютної сумісності з браузерами 90-х, де кожен байт на рахунку.

Lift4D: Harmonizing Single-View 3D Estimation for 4D Reconstruction In-the-Wild

Lift4D — це фреймворк оптимізації на етапі тестування, який з одного монокулярного відео реконструює повну геометрію, вигляд і деформацію динамічних об’єктів, зокрема й невидимі камерою ділянки. Для ініціалізації деформовного 3D Gaussian Splatting метод використовує причинно-зумовлену пропагацію латентів між кадрами, що забезпечує часову узгодженість, а потім уточнює модель через occlusion-aware loss та дифузійний novel-view prior, який агрегує видимі деталі й «додумує» закриті регіони. Lift4D помітно перевершує попередні підходи на складних відео з великими деформаціями та оклюзіями.

75% More Pedestrians Have Been Killed Since 2009. Giant Trucks and SUVs Are Why

Згідно з новим дослідженням NYT та IIHS, з 2009 року кількість загиблих пішоходів у США зросла на 75%, і головною причиною є поширення великих пікапів та позашляховиків. Аналіз показав, що якби машини не стали суттєво вищими й важчими за останні чверть століття, щороку вдавалося б уникнути 200–400 смертей. Збільшення розмірів, спровоковане, зокрема, змінами в нормах викидів, погіршило оглядовість і змінило механіку наїзду: через високу передню частину пішохода частіше затягує під колеса.

І знову регуляції, що мали дбати про екологію, побічно збільшили смертність на дорогах — класика ненавмисних наслідків.

The Coming Loop | Armin Ronacher's Thoughts and Writings

Armin Ronacher аналізує зростаючу практику використання зовнішніх циклів (harness loops), які керують роботою coding agents поза межами звичайного agent loop. Для довготривалого коду такий підхід поки викликає застереження через надто захисний, локальний і переускладнений код, тоді як для портування, бенчмаркінгу, безпекового сканування та прототипування без вимоги довгої підтримки — він працює дуже добре. Автор розглядає майбутнє, де софт стає «організмом», який ми моніторимо та лікуємо замість того, щоб глибоко розуміти. Повністю відмовитися від такої моделі неможливо через тиск змагальності та безпеки, тож постає питання, як утримати людський контроль і здорові інженерні стандарти у світі, де циркулюючі машини дедалі більше домінують.

Mistral OCR 4 : SOTA OCR for Document Intelligence

Mistral представила OCR 4 — модель для витягання та структурування інформації з документів, яка повертає не лише текст, а й bounding boxes, типи блоків і поелементні оцінки впевненості. Вона підтримує 170 мов, розгортається в одному контейнері для самокерованого використання та інтегрується з Mistral Search Toolkit для побудови RAG- і enterprise-пошукових пайплайнів. У порівняльних тестах і людських оцінках модель випереджає популярні OCR-системи, хоча автори визнають обмеження автоматичних бенчмарків. Ціна — $4 за 1000 сторінок через API, $2 у batch-режимі.

Digital euro clears key hurdle as EU seeks to break free from U.S. credit cards

Європейський центральний банк отримав ключову підтримку парламенту для запуску цифрового євро — електронного гаманця, що має зменшити залежність єврозони від американських платіжних систем Visa та Mastercard на тлі торгових суперечок із США. Проєкт передбачає ліміти на володіння та заборону відсотків, аби захистити банківські депозити; пілот заплановано на другу половину 2027 року, повноцінний запуск — на 2029. Залишаються відкритими питання компенсації витрат (4–6 млрд євро за чотири роки) та конкуренції з приватними сервісами на кшталт Wero.

Попри обмеження, симуляції ЄЦБ показують потенційний відтік депозитів до 699 млрд євро, що особливо небезпечно для дрібних банків.

Pluralistic: Spying on kids to save kids from spying is very, very stupid (23 Jun 2026) – Pluralistic: Daily links from Cory Doctorow

Вікова верифікація в інтернеті — це не захист дітей, а примусове масове стеження за всіма, що робить уникнення трекінгу незаконним. Химерна коаліція противників Big Tech і правих активістів штовхає закони про мінімальний вік, але насправді це вигідно рекламно-шпигунській індустрії, яка мріє про світ без приватності. Шкода, якої платформи завдають дітям, починається саме зі стеження, тому рятувати від нього треба через посилення приватності, а не через тотальну слідку. Автор наголошує: не можна захистити дітей від онлайн-стеження, шпигуючи за ними.

2018–2025 (c) Списуй але не один в один