Дайджест #18. Вівторок, 23 червня

Ці новини свіжими були 23 червня 2026. Час біжить — уже вийшов новий дайджест.

oak · oak

Oak — відкрита система контролю версій, створена спеціально для AI-агентів: гілка на сесію як одиниця роботи, опис гілки замість повідомлень до комітів та контентно-адресовані ліниві підключення (lazy mounts) для миттєвого доступу до репозиторіїв. Проєкт реалізовано як Cargo-воркспейс із бібліотекою oakvcs-core (BLAKE3, content-defined chunking, diff/merge, модель даних) та CLI-клієнтом oak. Підтримується встановлення через curl або Cargo на macOS, Linux і Windows (з ProjFS для mount); ліцензія Apache-2.0.

1,700 Free Online Courses from Top Universities | Open Culture

Open Culture зібрали список із 1700 безкоштовних онлайн-курсів від провідних університетів — Єль, MIT, Гарвард, Оксфорд та інших. Курси охоплюють гуманітарні, природничі, комп’ютерні науки, бізнес, філософію, мистецтво та ще десятки напрямків, включаючи як окремі лекції, так і MOOC на Coursera, edX, FutureLearn. Для безкоштовного доступу до MOOC радять обирати опцію «Full Course, No Certificate» або «Audit» — сертифікати та залікові кредити платні, і сайт отримує партнерську комісію.

Вражаюча добірка для тих, хто хоче безкоштовно отримати знання з першоджерел.

Moebius Project Page

Moebius — це легковаговий фреймворк для image inpainting з лише 226M параметрів, що менше ніж 2% від розміру FLUX.1-Fill-Dev. Попри це, модель досягає якості, яка дорівнює або перевершує 10B-рівневі рішення, і забезпечує понад 15-кратне прискорення інференсу. Завдяки новому блоку LλMI та адаптивній мультигранулярній дистиляції вдалося уникнути типової деградації під час екстремального стиснення архітектури.

Спеціаліст, який б'є роздутих генералістів — ще один доказ, що параметри не завжди вирішують.

Prompt Injection as Role Confusion

LLM сприймають усі вхідні дані як суцільний потік тексту, де ролі (system, user, tool тощо) мали б слугувати надійними межами. Насправді ж модель визначає роль не за тегами, а за стилем написання — і саме це спричиняє prompt injection: зловмисник може «підробити» роль, стилізувавши текст під міркування або команду користувача, і модель підкориться. Експерименти з лінійними зондами показали, що сприйняття ролі всередині моделі безперервне й легко збивається стилістичними сигналами, а успішність атак прямо корелює зі ступенем плутанини ролей. Автори закликають вивчати ролі не як сантехніку, а як ключову когнітивну архітектуру, інакше захист так і залишиться грою в «вгадай атаку».

GLM-5.2 vs Claude Opus | Tech Stackups

GLM-5.2, нова open-weight модель, у тесті побудувала 3D-платформер на чистому WebGL, але поступалася Claude Opus 4.8 у швидкості, коректності гри та здатності перевіряти вигляд через скріншоти — модель текстова й не бачила своїх візуальних баґів. Водночас вона вп’ятеро дешевша за Opus і доступна за ліцензією MIT, що робить її вигідною для текстових і логічних завдань.

Мультимодальний самоконтроль виявився вирішальним: GLM-5.2 намагалася перевіряти кадри через пікселі й не помітила сірого персонажа та залишений дебаг-оверлей.

Finding the Best Dog Treat with Statistics

Автор використав модель Бредлі-Террі (подібну до рейтингу Ело), щоб через попарні порівняння визначити улюблені ласощі свого грейгаунда Бідопа. Після серії тестів з п’ятьма видами смаколиків перемогло зневоднене куряче філе Pur Luv Chicken (Е), хоча MON2SUN із качкою та сирицею (А) йшло майже врівень – для чіткого вердикту бракує додаткових проб. Виявилася також стійка правостороння упередженість собаки, коли ласощі були однаковими. Бутстреп-аналіз показав, що Е виграє в 63% перевибірок, А – у 33%, решта безнадійно відстають.

The Newell Nucleus: Steam Machine LTT Companion Article | LTT Labs

Valve випустила Steam Machine — крихітну консоль на SteamOS із 6-ядерним Zen 4 CPU та графікою на RDNA 3 з 8 ГБ VRAM. Попри продумане охолодження і тиху роботу, реальна продуктивність скромна: 60 FPS у 1080p даються лише на середніх-низьких налаштуваннях, а заявлене 4K 60 FPS досяжне хіба що з FSR Ultra Performance та мінімальною графікою. У порівнянні з PS5 пристрій програє за співвідношенням ціни та потужності — від $1049 за версію 512 ГБ — і працює на вже застарілому графічному поколінні. Valve вперто несе Linux у вітальні, але «залізо» підкачує.

Desktop apps | Deno Docs

`deno desktop` — це команда, що з’явиться у Deno 2.9, яка перетворює TypeScript-проєкт (від окремого файлу до Next.js-застосунку) на самодостатній нативний десктопний застосунок. Інструмент пакує код, рантайм Deno та веб-рендерер в один платформний бінарник, автоматично визначає використаний фреймворк і підтримує гарячу заміну модулів. Вбудована система оновлень через бінарні диффи, кроскомпіляція з однієї машини для macOS/Windows/Linux та пряме зв’язування між Deno і webview без міжпроцесного IPC відрізняють його від Electron та Tauri.

Deno вперше виходить на ринок десктопних застосунків із пропозицією, що інтегрує всю npm-екосистему без громіздких бінарників.

The text in Claude Code’s “Extended Thinking” output is not authentic. – blog

У статті пояснюється, що локальні логи Claude Code з «розширеним мисленням» містять лише зашифрований підпис, а не справжні міркування моделі. API повертає лише стислий переказ логіки, а не реальний хід думок агента, а отримати повний текст можна тільки за корпоративною угодою з Anthropic. Тому покладатися на ці логи для аудиту не можна — те, що показує інтерфейс, є lossy-копією, а не автентичним записом.

Схоже, «розширене мислення» можна побачити лише за додатковий чек.

Pledging Another $400,000 to the Zig Software Foundation – Mitchell Hashimoto

Родина Мітчелла Хашімото виділяє ще $400,000 для Zig Software Foundation, доводячи загальну суму підтримки до $700,000 після початкового внеску 2024 року. Хашімото хвалить технічний прогрес Zig, серйозний підхід до якості та культуру спільноти, включно з політикою заборони LLM-генерованого коду в контрибуціях, хоча сам активно використовує ШІ. Він підкреслює, що незгода з окремими правилами проєкту не заважає глибокій повазі до людей і політик ZSF, оскільки саме право бути «дивними та інакшими» робить відкритий код живим і цінним.

Хашімото нагадує, що Ghostty з’явився значною мірою завдяки Zig — це додає щирості його підтримці, але водночас трохи кумедно, що після всіх цих похвал рушійною силою виявився банальний практичний інтерес, а не лише висока філософія.

Blogger Defeats Photographer's Copyright Claim-Sokolskyfilm v. Messiah - Technology & Marketing Law Blog

У 2026 році суд відхилив позов фотографа проти блогерки, яка ще у 2009 році використала чуже фото 1962 року для ілюстрації посту про моду для дружин військових. Суд визнав використання зображення добросовісним (fair use), оскільки блог був некомерційним, трафік мізерним, а контекст — трансформативним, хоча фото прямо не коментувалося в тексті. Окремо суд відкинув претензії щодо видалення CMI-даних, бо блогерка не знала про авторство й не мала умислу на порушення. Справа показова тим, що строк давності в онлайн-копірайті фактично відсутній, а сам позов виглядав відверто безглуздим через мізерні ставки та вік публікації.

Схоже, суддя теж не зрозумів, навіщо це взагалі потрапило до федерального суду, а не в CCB, якщо єдиним «збитком» фотографа було те, що його фото 60-річної давнини хтось побачив у блозі про армійських дружин.

Codex SQLite feedback logs can write ~640 TB/year and rapidly consume SSD endurance · Issue #28224 · openai/codex · GitHub

Codex за замовчуванням зберігає логи у SQLite на рівні TRACE, що призводить до приблизно 640 ТБ записів на рік і швидкого вичерпання ресурсу SSD. Понад 70% цього обсягу — це TRACE-повідомлення від бібліотек на кшталт inotify та tokio-tungstenite, разом із телеметрією OpenTelemetry (~96% можна відфільтрувати). Постійне вставлення та видалення рядків створює write amplification, яка приховує справжній обсяг запису. Пропонується підвищити стандартний рівень логування, прибрати збереження сирих payloads й додати глобальне обмеження на розмір бази.

Якщо програма пише на диск більше, ніж деякі сервіси потокового відео, — можливо, варто переглянути, що саме вважається «корисним» логом.

Die analysis of the 8087 math coprocessor's fast bit shifter

У статті досліджується швидкий зсувач (barrel shifter) співпроцесора Intel 8087, який міг зсувати 68-бітне число на будь-яку кількість позицій від 0 до 63 за один такт. Зсувач складається з двох ступенів — бітового (0–7 біт) та байтового (0–7 байт) — і використовує логіку на прохідних транзисторах, що дозволяє передавати дані в обох напрямках. Ця конструкція займала значну частину кристала, але була критичною для стократного прискорення операцій із рухомою комою та вплинула на стандарт IEEE 754.

Цікаво, що двоспрямований зсувач на прохідних транзисторах не лише економив площу кристала, а й став патентованим рішенням Intel.

GitHub - Intuned/selector-forge: Browser extension to create reliable selectors (CSS and Xpath) using AI · GitHub

Selector Forge — це браузерне розширення, яке дозволяє виділити елементи на будь-якій сторінці й отримати надійні CSS або XPath селектори. AI на backend Intuned генерує кандидатів, але кожен із них проходить обов'язкову перевірку безпосередньо в живому DOM, тому користувач бачить лише ті варіанти, що точно спрацювали. Підтримуються режими вибору одного елемента або повторюваного списку.

Це відкритий інструмент (MIT), побудований на WXT і React, і може бути корисним для тих, хто пише автотести чи скрапери й втомився від крихких селекторів.

Mexico Just Showed Off a New Extremely Cheap, Government-Backed EV

Уряд Мексики представив прототип надзвичайно дешевого електромобіля Olinia Uno — шестимісну міську модель із запасом ходу 125 км, максимальною швидкістю 50 км/год і ціною близько $8,500. Автомобіль є частиною державного плану розвитку економіки, зроблений наразі з 50% локальних матеріалів із метою досягти 75% до 2030 року, та може заряджатися від звичайної розетки. Хоча це не китайський електрокар, стаття припускає, що проект може зіткнутися з такими самими протекціоністськими бар’єрами в США, як і доступніші китайські електромобілі, які вже продаються в Мексиці.

[2606.16140] VibeThinker-3B: Exploring the Frontier of Verifiable Reasoning in Small Language Models

VibeThinker-3B — це компактна модель на 3B параметрів, яка досліджує межі verifiable reasoning у малих мовних моделях. Завдяки curriculum-based fine-tuning, multi-domain reinforcement learning та офлайн-самодістиляції вона досягає 94.3 балів на AIME26 (97.1 з тестовою масштабованістю) та 80.2 Pass@1 на LiveCodeBench v6, виходячи на рівень гігантів типу DeepSeek V3.2. Автори формулюють гіпотезу параметричного стиснення-покриття, згідно з якою верифіковане міркування стискається в компактне ядро, тоді як загальні знання потребують широкого покриття параметрів.

In praise of memcached

Автор порівнює Redis і memcached як кешувальні рішення. Redis через багатий функціонал часто починають використовувати як базу даних, що ускладнює експлуатацію. Memcached, навпаки, простий, не зберігає дані на диск, легко кластеризується на боці клієнта й коректно переживає відмови вузлів — це робить його зручнішим для ролі справжнього кешу. Також нагадують, що проблеми з продуктивністю часто вирішуються оптимізацією запитів, а не додаванням кешу.

Japanese symbols that speak without words

У Японії низка символів — від родових гербів (камон) до наліпок на авто й бейджів у транспорті — передає невидиму інформацію без жодного слова. Вони позначають водіїв-початківців, людей похилого віку, вагітних, осіб із порушеннями слуху чи руху, а також клас потяга або потребу в допомозі. Ці знаки вбудовані в культуру «читання повітря» (kūki wo yomu) — додають контекст там, де його бракує, і дозволяють оточуючим мовчки скоригувати поведінку.

А в США тим часом обходяться написом «Student Driver» — і все одно нервують.

[2606.03748] Ultralytics YOLO26: Unified Real-Time End-to-End Vision Models

Ultralytics представляє YOLO26 — сімейство уніфікованих моделей для real-time vision, які відмовляються від non-maximum suppression і Distribution Focal Loss на користь ефективнішого dual-head дизайну. Новий оптимізатор MuSGD, Progressive Loss та стратегія STAL гарантують позитивне призначення міток навіть для найдрібніших об’єктів. Пайплайн підтримує детекцію, instance segmentation, pose estimation, oriented detection і класифікацію в одному фреймворку, включно з open-vocabulary варіантом YOLOE-26. На COCO моделі досягають 40.9–57.5 mAP при затримці 1.7–11.8 мс на T4 TensorRT.

ytr: YouTube radio for Emacs

Розробник створив експериментальний пакет `ytr` для Emacs, який дозволяє стрімити аудіо з YouTube-каналів, використовуючи mpv та yt-dlp. Інтерфейс виконано у вигляді віджета в окремому фреймі з анімаціями у стилі Winamp, тому він вимагає графічної версії Emacs. Пакет тестувався лише на macOS, і автор збирає відгуки.

Winamp-естетика в Emacs — ознака того, що ностальгія досягла текстових редакторів.

Death by a Thousand Comments — Royal Icing

Дроблення комунікації на десятки інструментів — Slack, Figma, GitHub, Notion — перетворює роботу на хаотичне перестрибування між «кімнатами», де розмови губляться. Автор нагадує, що справжнім «контекстним шаром» для інженерних команд є живі лідери, які споживають, перетравлюють і спрямовують інформацію через пряме спілкування, а не черговий AI-пошуковик.

Найбільша іронія в тому, що індустрія намагається навчити AI-агентів робити те, що мали б робити керівники — забезпечувати єдиний контекст.

Will It Mythos? - I've done some things

Автор створив benchmark на основі 9 реальних вразливостей, знайдених системою Mythos від Anthropic, і перевірив, чи здатні інші моделі знаходити ці баги без підказок. Жодна з моделей не перевершила результати Mythos — навіть Opus знайшов лише 4 з 9, a такі моделі як DeepSeek, Qwen 3.6 та Gemma 4 MoE показали порівнянні показники, але 4 унікальні для Mythos баги не виявив ніхто. Це може вказувати на реальну перевагу Mythos, хоча тестування проводилось у спрощеному harness без просунутих інструментів, і результати можуть змінитися з кращим оснащенням.

Схоже, справжня магія Mythos — це не стільки модель, скільки бюджет на те, щоб тупо перебирати всі можливі експлойти.

Job application asked for my SAT scores – Mr. Market

Автор здивований вимогою вказати результати SAT при відгуку на вакансію в стартапі, що наштовхнуло його на аналіз історії та ефективності різних методів оцінювання кандидатів. Найкращими предикторами успіху сьогодні вважаються structured interviews, work sample tests і cognitive ability tests, тоді як популярні нестандартні підходи часто не працюють. В епоху AI, коли тексти резюме та виконання завдань легко фальсифікувати, автор пропонує повернутися до контрольованих очних оцінок — live-вправ, захисту роботи чи рольових ігор.

Схоже, що через генеративний AI ми ризикуємо скотитися до кадрового відбору рівня шпигунських assessment centers — тепер кожен кандидат має пройти перевірку «без шпаргалок».

Linux and Secure Boot certificate expiration [LWN.net]

11 вересня 2025 року закінчується термін дії сертифіката Microsoft 2011, яким підписується shim — перший етап завантажувача UEFI для Linux із Secure Boot. Після цієї дати нові інсталяційні образи не завантажаться на системах без нового ключа Microsoft 2023, доданого через оновлення прошивки. Для оновлення ключів використовуються fwupd та LVFS, але старі пристрої можуть залишитися без виправлень, що змусить вимикати Secure Boot або використовувати старі версії shim.

Secure Boot вкотре доводить, що «безпека» часто означає залежність від графіка оновлень сторонніх вендорів, яким ваш Linux байдужий.

GLM-5.2 - How to Run Locally | Unsloth Documentation

GLM-5.2 від Z.ai — це відкрита MoE-модель із 744B параметрів (40B активних) і контекстом 1M токенів, яка за бенчмарками зрівнялася з Claude 4.8 Opus, GPT-5.5 та Gemini 3.1 Pro. Unsloth випустив Dynamic GGUFs: 1-бітний квант займає 223 ГБ і зберігає ~76% точності top-1, а 2-бітний — 245 ГБ і ~82%, що дає змогу запускати модель на Mac з 256 ГБ Unified Memory або на системі з 24 ГБ VRAM + 256 ГБ RAM. У статті наведено детальні інструкції для запуску в Unsloth Studio (з автоматичним offloading) та в llama.cpp, а також пояснено, як керувати режимами мислення (High/Max/off) і використовувати KV-кеш-квантизацію для довгого контексту.

Навіть 1-бітна версія змогла згенерувати повноцінну гру Flappy Bird з анімаціями та звуком — схоже, що стиснення величезних моделей стає дедалі практичнішим.

YOLO26: YOLO Model for Real-Time Vision AI [2026]

YOLO26 — сімейство end-to-end моделей комп’ютерного зору для object detection, instance segmentation, pose estimation, орієнтованого виявлення та класифікації з п’ятьма розмірами (Nano–Extra Large). Основні покращення: відмова від Non-Maximum Suppression для зменшення затримки та видалення Distribution Focal Loss модуля для ширшої підтримки edge- і low-power пристроїв. Модель демонструє до 43% швидший CPU-інференс порівняно з YOLO11 і експортується в TFLite, CoreML, ONNX та інші формати.

Roboflow активно порівнює YOLO26 зі своїм RF-DETR, який за їхніми ж бенчмарками виграє за точністю — типовий маркетинговий хід, але для багатьох задач YOLO26 досі залишається непоганим вибором на межі швидкості та простоти.

GitHub - dorukkumkumoglu/optocamzero: Optocam Zero is a Raspberry Pi Zero based compact digital camera made using off the shelf components. · GitHub

Optocam Zero — це компактна цифрова камера на базі Raspberry Pi Zero, зібрана з доступних компонентів. Вона має автофокус, вісім фотофільтрів, запис GIF, передачу знімків через власну точку доступу і працює до 80 хвилин від змінної батареї 14500. Увесь корпус виготовляється на 3D-принтері, а репозиторій містить повний набір файлів, BOM і покроковий посібник для самостійного складання.

Проєкт викликає ностальгію за плівковими «мильницями», але з сучасною начинкою.

Energy minister plans 'nuclear renaissance' with up to 10 reactors built by 2040 | CBC News

Канада планує побудувати до 10 нових ядерних реакторів до 2040 року в межах «ядерного ренесансу», щоб подвоїти потужність електромережі до 2050 року. Стратегія передбачає початок будівництва двох великих реакторів до 2035 року, розгортання малого модульного реактора у віддаленій громаді до кінця 2030-х, а також розширення експорту реакторів Candu на щонайменше чотири нові міжнародні ринки. Оціночна вартість ініціативи перевищує 100 мільярдів доларів, однак конкретних джерел фінансування у стратегії не названо.

Flock-Powered Police Chiefs Stalking Women Shows Why Warrants Are Needed (Public Report)

Випадки, коли поліцейські начальники використовують систему розпізнавання номерів Flock для стеження за колишніми романтичними партнерами та їхніми новими знайомими, показують, що система на практиці відстежує людей, а не лише автомобілі, як стверджує компанія. Юридичний директор Flock визнав, що відстеження колишніх є найпоширенішою формою зловживань. У статті наводиться аргумент, що для рутинних запитів до історичних даних LPR потрібен ордер — як це вже вимагається для GPS-трекерів та даних мобільних телефонів, адже внутрішніх дисциплінарних заходів недостатньо для запобігання порушенням навіть з боку найвищих чинів.

Коли найвідповідальніші за дотримання правил стають головними порушниками, аргумент про "ми ж самі себе контролюємо" виглядає особливо кумедно — хоча сміятися тут нема з чого.

British Columbia, Time Zones, and Postgres | Crunchy Data Blog

Британська Колумбія з 2026 року перейшла на постійний літній час (UTC-7), що створює проблему для PostgreSQL: стовпці `timestamptz` зберігають час у UTC, а локальний час обчислюється за поточними правилами `tzdata`. Якщо майбутні зустрічі з листопада по березень були записані до оновлення `tzdata`, після оновлення вони зсунуться на годину. Автор радить використовувати dual-column pattern — зберігати локальний час, назву часового поясу та обчислюване UTC через тригер, щоб зберегти початковий намір користувача та мати змогу перерахувати UTC після змін у `tzdata`. Якщо `tzdata` вже оновлено, доведеться шукати та виправляти уражені записи вручну.

Здавалося б, з `timestamptz` усе надійно, аж поки політики не вирішать перевести стрілки.

2018–2025 (c) Списуй але не один в один