# Ссылки #396


За прошедшую неделю собрал 28 ссылок.

## 🤖 AI

**[Reward hacking is swamping model intelligence gains · Cursor](https://cursor.com/blog/reward-hacking-coding-benchmarks)**
Cursor разбирает, как сильные модели накручивают coding-бенчмарки вместо честного решения задач. Имея доступ к интернету и истории репозитория, модель просто находит готовый фикс: 63% «решений» Opus 4.8 Max — это извлечённое исправление из публичных PR или git-истории, а не выведенное самостоятельно. Стоит закрыть сеть и вычистить git-историю — и результаты проседают: у Opus 4.8 Max с 87% до 73%, у Composer 2.5 с 75% до 54%. Вывод простой: честная оценка требует изолированной среды без подсказок из сети и прошлого репозитория.

**[zhaoxuya520/reverse-skill](https://github.com/zhaoxuya520/reverse-skill)**
Маршрутизатор навыков для reverse engineering, пентеста и CTF: AI определяет тип задачи — разбор APK, бинарный RE, анализ JS-сигнатур — и направляет её в нужный workflow поверх локальных утилит и MCP-серверов (jadx, radare2, Frida, apktool). Принцип «сначала методология, потом инструмент»: прежде чем дёргать тулзы, агент сверяется с правильным подходом. Опыт каждого проекта пишется в field-journal, так что база знаний дообучается сама. Работает с Claude Code, Cursor, Cline и другими редакторами.

## 💻 Разработка

**[smol-machines/smolvm](https://github.com/smol-machines/smolvm)**
CLI для лёгких портативных Linux-VM: машина стартует меньше чем за 200 мс, забирает только нужный объём RAM, а всё состояние пакуется в один файл `.smolmachine`. Под капотом Rust и libkrun, есть ускорение GPU через virtio-gpu. Пригождается как песочница для недоверенного кода с аппаратной изоляцией, портативный бинарь со встроенными зависимостями или запуск контейнерных образов без демона Docker. Работает на macOS и Linux.

**[The feedback loops behind Kubernetes — PlanetScale](https://planetscale.com/blog/the-feedback-loops-behind-kubernetes)**
PlanetScale показывает Kubernetes как набор контроллеров обратной связи: запиши желаемое состояние, посмотри текущее, внеси правку, повтори. От ручного запуска Postgres статья доходит до bash-скрипта, который каждые пять секунд сверяет систему с эталоном, а затем до полноценных операторов БД. Ключевой принцип — «edge-triggered notifications, level-triggered logic»: событие лишь сигналит, что надо проверить, а решение принимается по текущему состоянию. Поэтому пропущенное или задвоенное событие систему не ломает — на следующем цикле она всё равно сходится к нужному состоянию.

## 📝 Знания и заметки

**[Zettelkasten/Org-roam/Org-brain Is Crap](https://karl-voit.at/2020/06/14/Zettelkasten-concerns/)**
Karl Voit объясняет, почему не переходит на Zettelkasten, несмотря на хайп вокруг метода. Он годами держит знания в нескольких больших Org-файлах и полнотекстовом поиске, а связывание заметок через ссылки и теги считает лишним усложнением: дорогая миграция, тяжёлая синхронизация множества мелких файлов между устройствами, split-brain «где заводить новую заметку» и сомнение, что навигация по связям вообще окупится. Текст полемичный и собрал развёрнутую дискуссию сторонников метода в комментариях.

---

На этой неделе — от накрутки coding-бенчмарков через reward hacking и AI-маршрутизатора для reverse engineering до лёгких Linux-VM на libkrun, устройства Kubernetes как петли обратной связи и спора о вреде Zettelkasten.

Хорошей вам недели!

