Refat Talks: Tech & AI
@nobilix
Claude Agent Skills - полезные процедурные навыки для агента. Давайте разбираться!
Итак, Anthropic на прошлой неделе запустили Agent Skills - по сути предложили механизм расширения навыков для агентов, вместо того чтобы каждый раз объяснять модели как делать задачу, ты один раз пакуешь инструкции, скрипты и ресурсы в папку - и Claude сам загружает это когда нужно.
Технически Skill - это просто папка с файлом
Помните, я писал недавно про то как Claude научился создавать и редактировать реальные файлы: excel, word, powerpoint - так вот это как раз были Skills. Самым мощным агентам нужен runtime и Антропики (и не только они) активно развивают эту идею. Окей, ну если сама модель и так может писать код и запускать его чтобы делать для нас всякие полезные штуки (вычисления, таблицы, документы, изображения), то зачем нужны Skills, спросите вы? Как минимум для 3 целей:
1. эффективный контекст менеджмент: скилы очень экономно расходуют контекст и позволяют постепенно раскрывать детали по мере необходимости
2. предсказуемый результат: скрипты и CLI-тулы и 'рецепты' к ним дают детерминированный результат сохраняя гибкость самого агента
3. дистрибуция: можно делиться через zip-архивы или Claude Code плагины + пишут что они разрабатывают более удобные способы делиться скилами в рамках организации и даже будет Marketplace
Да, кстати, они работают во всех продуктах Claude: Claude App, Claude Code и даже в API - большой простор для автоматизаций.
На видео я 'научил' Claude экспортировать mermaid как картинку (давно такого не хватало).
Заметил что их часто сравнивают с Sub Agents и MCP, хотя они скорее дополняют друг друга, а не заменяют, сделал небольшую сравнительную таблицу:
И конечно можно комбинировать, например Skills описывают процесс и диктуют процедуру, а MCP дает доступ к данным.
Skills могут включать код, они могут исполнять его и рефлексировать над результатом исполнения.
Но что есть из коробки? Я покопался в их "виртуалке" и это по сути Ubuntu 24.04 с Python 3.12 и Node.js 22, предустановленными библиотеками для обработки документов (docx/pdf/pptx/xlsx), медиа (FFmpeg/ImageMagick), веб-автоматизации (Playwright) и DS (pandas/numpy/scikit-learn) и др. - подробности я выложил в этом gist. Обратите внимание, что доступ к сети ограничен, но этим можно управлять (напр. в десктопной Claude это Capabilities -> Domain allowlist).
Где можно применить:
- Для разработчиков: код-ревью по стандартам, QA, умная кодогенерация
- Legal Tech: драфтинг контрактов, комплайенс-отчеты, сравнение версий документов с выделением рисков и тд
- Для офиса: презентации в корп. стиле, репорты в стандартном формате, КП, financial modeling, бюджеты и тд
- Тренеры, преподаватели, архитекторы: планы питания и тренировок, учебные программы, сметы и спецификации проектов
Полезные ресурсы по теме:
- Официальный анонс от Anthropic и гайд
- Engineering deep-dive
- Официальная документация
- Claude Cookbook по Skills
- Официальный репозиторий с примерами - готовый код Skills для кастомизации
- Мой gist с деталями sandbox окружения - что доступно "из коробки"
Пост получился большим, не успел рассказать про свой опыт создания и использования, чувствую это не последний пост на эту тему.
Если считаете пост полезным - сохраняйте/делитесь)
🔥➕🔁
Итак, Anthropic на прошлой неделе запустили Agent Skills - по сути предложили механизм расширения навыков для агентов, вместо того чтобы каждый раз объяснять модели как делать задачу, ты один раз пакуешь инструкции, скрипты и ресурсы в папку - и Claude сам загружает это когда нужно.
Технически Skill - это просто папка с файлом
SKILL.md внутри + любые доп. файлы. Сначала заголовок с описанием, а дальше - markdown с инструкциями. Claude видит описания всех доступных skills в system prompt и загружает нужный когда понимает что задача подходит. Важный аспект: скилы могут запускать скрипты в sandboxed окружении - это, так сказать, основная супер-сила.Помните, я писал недавно про то как Claude научился создавать и редактировать реальные файлы: excel, word, powerpoint - так вот это как раз были Skills. Самым мощным агентам нужен runtime и Антропики (и не только они) активно развивают эту идею. Окей, ну если сама модель и так может писать код и запускать его чтобы делать для нас всякие полезные штуки (вычисления, таблицы, документы, изображения), то зачем нужны Skills, спросите вы? Как минимум для 3 целей:
1. эффективный контекст менеджмент: скилы очень экономно расходуют контекст и позволяют постепенно раскрывать детали по мере необходимости
2. предсказуемый результат: скрипты и CLI-тулы и 'рецепты' к ним дают детерминированный результат сохраняя гибкость самого агента
3. дистрибуция: можно делиться через zip-архивы или Claude Code плагины + пишут что они разрабатывают более удобные способы делиться скилами в рамках организации и даже будет Marketplace
Да, кстати, они работают во всех продуктах Claude: Claude App, Claude Code и даже в API - большой простор для автоматизаций.
На видео я 'научил' Claude экспортировать mermaid как картинку (давно такого не хватало).
Заметил что их часто сравнивают с Sub Agents и MCP, хотя они скорее дополняют друг друга, а не заменяют, сделал небольшую сравнительную таблицу:
Skills MCP Subagents
Параллелизация - - +
Stackable + ± -
Доступ к сети ± + +
Токенов на старте ~50 ~5k+ ~1k
Работает в API + + -
Работает в CC + + +
Работает в App + ± -
Setup сложность * ** ***
Изолированная среда + - -
Progressive + - -
disclosure
Портативность/ *** ** *
удобство дистр.
И конечно можно комбинировать, например Skills описывают процесс и диктуют процедуру, а MCP дает доступ к данным.
Skills могут включать код, они могут исполнять его и рефлексировать над результатом исполнения.
Но что есть из коробки? Я покопался в их "виртуалке" и это по сути Ubuntu 24.04 с Python 3.12 и Node.js 22, предустановленными библиотеками для обработки документов (docx/pdf/pptx/xlsx), медиа (FFmpeg/ImageMagick), веб-автоматизации (Playwright) и DS (pandas/numpy/scikit-learn) и др. - подробности я выложил в этом gist. Обратите внимание, что доступ к сети ограничен, но этим можно управлять (напр. в десктопной Claude это Capabilities -> Domain allowlist).
Где можно применить:
- Для разработчиков: код-ревью по стандартам, QA, умная кодогенерация
- Legal Tech: драфтинг контрактов, комплайенс-отчеты, сравнение версий документов с выделением рисков и тд
- Для офиса: презентации в корп. стиле, репорты в стандартном формате, КП, financial modeling, бюджеты и тд
- Тренеры, преподаватели, архитекторы: планы питания и тренировок, учебные программы, сметы и спецификации проектов
Полезные ресурсы по теме:
- Официальный анонс от Anthropic и гайд
- Engineering deep-dive
- Официальная документация
- Claude Cookbook по Skills
- Официальный репозиторий с примерами - готовый код Skills для кастомизации
- Мой gist с деталями sandbox окружения - что доступно "из коробки"
Пост получился большим, не успел рассказать про свой опыт создания и использования, чувствую это не последний пост на эту тему.
Если считаете пост полезным - сохраняйте/делитесь)
🔥➕🔁
🔥 70
❤ 19
👏 11
👍 3
25 293 9.3K
Обсуждение 25
Обсуждение не доступно в веб-версии. Чтобы написать комментарий, перейдите в приложение Telegram.
Обсудить в Telegram