Поляков считает: AI, код и кейсы
@countwithsasha
Книги для агентов (опять он про скиллы): серая зона и новый рынок
Раньше я покупал книги O’Reilly, чтобы развиваться как программист.
Теперь в проекте всё чаще программирует агент. Ему тоже нужны книги: только не PDF на 500 страниц, а навык, который можно вызвать во время работы.
На днях увидел на GitHub репозиторий book-to-skill: он превращает техническую книгу в Claude Code skill.
Идея отличная. Реализация мне не зашла:
Я переиздал эту идею в более аккуратный компилятор: artwist-polyakov/knowledge-compiler.
🧩 Что делает мой вариант
Цель — собрать рабочую карту знаний для агента. В результат идут понятия, решающие правила, сценарии применения, анти-паттерны, словарь и карта источников.
Из технического:
🔸 запуск через
🔸 EPUB-оглавление берётся из
🔸 если оглавление не очевидно, сначала делается компактная разведка структуры;
🔸 у тезисов есть
🔸 есть проверка длинных дословных совпадений через n-граммы, чтобы навык случайно не стал копипастой книги. Как будто надо префиксные хеши считать.
⚖️ Где начинается серая зона
Я не юрист, поэтому моя рабочая граница такая.
Личный навык для агента из легально купленной книги выглядит как нормальный частный сценарий: я не публикую артефакт, не продаю его, не обхожу ограничения и не выкладываю текст книги.
А вот публичный навык по чужой коммерческой книге уже пахнет производным произведением. Особенно если там есть пересказ по главам, длинные цитаты, таблицы, листинги или схемы. Авторы «Пиши, сокращай» отсудили 9 млн у ребят, которые сделали пересказ.
С OpenAI и Anthropic история тоже не волшебная. Провайдер не выдаёт лицензию на чужую книгу просто потому, что вы загрузили её в модель.
У OpenAI пользователь отвечает за входные и выходные данные и должен иметь права на то, что передаёт в сервис. У Anthropic прямо написано, что Claude не должен использоваться для воспроизведения уже существующих материалов, а нарушения прав могут привести к предупреждению или блокировке.
Как будто создавать такие скиллы надо на локальном железе или арендовать железо у Валеры (надо смотреть лицензию): https://hub.neuraldeep.ru
📚 Что могли бы делать издательства
Мне кажется, здесь не только риск, но и новый товар.
Условная «Альпина» может продавать не просто книгу, а комплект:
— EPUB или PDF;
— официальный навык для Codex, Claude Code или другого агента;
— обновления к новым изданиям;
— лицензию для личного или корпоративного контура.
Для технических книг это особенно логично: книга остаётся источником, а навык становится рабочим интерфейсом к ней.
🔐 Что я уже добавил для защиты прав
В компиляторе сейчас такие правила:
— личный контур по умолчанию;
— не обходить платный доступ и технические ограничения;
— не копировать длинные цитаты, таблицы, код и схемы;
— хранить карту источников и манифест происхождения;
— проверять дословные совпадения с исходником;
— публичную публикацию чужих коммерческих источников считать отдельным режимом.
Что бы вы ещё добавили: лимит цитат, проверку смысловой близости, ручной чеклист перед публикацией?
И главный вопрос: вы бы покупали официальные навыки к книгам?
----
Поляков считает — AI, код и кейсы
Раньше я покупал книги O’Reilly, чтобы развиваться как программист.
Теперь в проекте всё чаще программирует агент. Ему тоже нужны книги: только не PDF на 500 страниц, а навык, который можно вызвать во время работы.
На днях увидел на GitHub репозиторий book-to-skill: он превращает техническую книгу в Claude Code skill.
Идея отличная. Реализация мне не зашла:
🤔 Там запуск через Python-окружение, а оглавление ищется хрупко: по английским подстрокам вроде `Chapter` и `PART`. Но если модель уже видит текст, почему бы не попросить её понять структуру? Заодно решается русский, японский и любое другое оглавление.
Я переиздал эту идею в более аккуратный компилятор: artwist-polyakov/knowledge-compiler.
🧩 Что делает мой вариант
Цель — собрать рабочую карту знаний для агента. В результат идут понятия, решающие правила, сценарии применения, анти-паттерны, словарь и карта источников.
Из технического:
🔸 запуск через
uv run --script, без ручной возни с окружением;🔸 EPUB-оглавление берётся из
toc.ncx или nav.xhtml, если оно есть;🔸 если оглавление не очевидно, сначала делается компактная разведка структуры;
🔸 у тезисов есть
source-map.json: видно, из какого сегмента книги взялась идея (как это прменить для пользователя еще не придумал и надо ли применять тоже);🔸 есть проверка длинных дословных совпадений через n-граммы, чтобы навык случайно не стал копипастой книги. Как будто надо префиксные хеши считать.
⚖️ Где начинается серая зона
Я не юрист, поэтому моя рабочая граница такая.
Личный навык для агента из легально купленной книги выглядит как нормальный частный сценарий: я не публикую артефакт, не продаю его, не обхожу ограничения и не выкладываю текст книги.
А вот публичный навык по чужой коммерческой книге уже пахнет производным произведением. Особенно если там есть пересказ по главам, длинные цитаты, таблицы, листинги или схемы. Авторы «Пиши, сокращай» отсудили 9 млн у ребят, которые сделали пересказ.
С OpenAI и Anthropic история тоже не волшебная. Провайдер не выдаёт лицензию на чужую книгу просто потому, что вы загрузили её в модель.
У OpenAI пользователь отвечает за входные и выходные данные и должен иметь права на то, что передаёт в сервис. У Anthropic прямо написано, что Claude не должен использоваться для воспроизведения уже существующих материалов, а нарушения прав могут привести к предупреждению или блокировке.
Как будто создавать такие скиллы надо на локальном железе или арендовать железо у Валеры (надо смотреть лицензию): https://hub.neuraldeep.ru
📚 Что могли бы делать издательства
Мне кажется, здесь не только риск, но и новый товар.
Условная «Альпина» может продавать не просто книгу, а комплект:
— EPUB или PDF;
— официальный навык для Codex, Claude Code или другого агента;
— обновления к новым изданиям;
— лицензию для личного или корпоративного контура.
Для технических книг это особенно логично: книга остаётся источником, а навык становится рабочим интерфейсом к ней.
🔐 Что я уже добавил для защиты прав
В компиляторе сейчас такие правила:
— личный контур по умолчанию;
— не обходить платный доступ и технические ограничения;
— не копировать длинные цитаты, таблицы, код и схемы;
— хранить карту источников и манифест происхождения;
— проверять дословные совпадения с исходником;
— публичную публикацию чужих коммерческих источников считать отдельным режимом.
Что бы вы ещё добавили: лимит цитат, проверку смысловой близости, ручной чеклист перед публикацией?
И главный вопрос: вы бы покупали официальные навыки к книгам?
----
Поляков считает — AI, код и кейсы
❤ 20
👍 20
🔥 12
120 240 3.6K
Обсуждение 120
Обсуждение не доступно в веб-версии. Чтобы написать комментарий, перейдите в приложение Telegram.
Обсудить в Telegram