Refat Talks: Tech & AI
@nobilix
12 204 1.6K
npx skills add nobilix/twenty-crm-skill
claude update.- Fable как "warp-двигатель для кода": амбициозные штуки одним промптом, но для понятных и коротких задач дорого и медленно.
- Скачок виден на больших автономных билдах, а не на рутине.
- На их внутреннем инженерном бенче: Fable 91/100 (Opus 4.8 - 63 и GPT-5.5 - 62).
- Сделал клон их продукта "Proof" (collaborative document editor) с одного промпта без доступа к исходному коду за ≈3 часа.
- В другом тесте снял скриншоты собственной работы на desktop и mobile, нашёл визуальные дефекты и починил - QA встроен в рабочий цикл без отдельного промпта.
- По их наблюдениям чинит корневую причину, а не симптом.
- Пишут что старые скиллы могут ограничивать новые модели (например Fable делает PowerPoint лучше, когда ему сказали вообще не использовать скилл, а просто дали бренд-гайдлайны)
- При этом текст пишет не чуть хуже Opus-а
- Самое сильное преимущество вне кода - суждение, особенно с большим контекстом
agent()/parallel()/pipeline() + пара хелперов и очень урезанный plain JS в качестве клея. Это все, и этого достаточно для многих вещей./workflows - она показывает дерево прогресса в реальном времени и там же можно нажать 's' и сохранить код в .claude/workflows/*.js - именованные workflow можно добавлять в Skills, причем скилы их используют скорее как шаблон, чем как исполняемый код./deep-research в Claude Code сделан уже на dynamic workflows: разносит поиск на параллельные ветки, тащит источники, проверяет каждый факт, собирает отчет со ссылками.~/.claude/projects и найти хорошие кандидаты на использование workflows. Один результат я уже применил: запустил несколько десятков параллельных гипотез оптимизации на реальном проекте (извлечение сложных данных из PDF). Одна неожиданно вскрыла проблему в эвалах, другая дала небольшой прирост F1 в извлечении данных. Буду тестить дальше.
auth.md - протокол авторизации агентов от имени пользователей
Workflow-First | Agent-First
----------------|----------------
[in] | [in]
↓ | ↓
(llm) | (agent)─►─[T]
┌─┴─┐ | ↑ │
[T] [T] | │ ↓
└─┬─┘ | [T]──◄────┘
✓ | ✓?
↓ | ↓
out | out
----------------|----------------
Шаг за шагом | Цикл решений
Жесткая схема | Автономия
Цена ясна | Бюджет рандомный
Сложно менять | Оч просто менять
Быстрый | Медленный
Не креативный | М.б. креативным
developer agent expert
│ │ │
└───────┼────────┘
▼
┌────────────────┐
│ workflow files │
└───────┬────────┘
▼
[ git + deploy ]
produce the minimum diff, the less LoC, the better помогают, неплохой пример тут: andrej-karpathy-skills (138К звезд, секция "Simplicity First" в самом начале)./simplify в Claude Code (или аналог, сама команда не сложная) - все еще отлично работает. Куда проще упорядочить и упростить то что уже написано и работает (но пока не закомичено), чем сразу написать как надо.
/goal (раньше был плагином).claude -p будет отдельный ежемесячный лимит $20-$200 по тарифам API. По сути легальное использование сторонних харнесов типа OpenClaw. И увеличила недельные лимиты на 50% на 2 мес. + Fast mode для Claude Opus 4.7 @meta.ai на базе Muse Spark.
npx skills add https://github.com/sernote/audit-prompt-caching --skill audit-prompt-caching
@имя, боты могут отвечать другим ботам, стриминг и др.
/v1/agents как headless-сервис, который дергается как API.
/goal - аналог ральф-лупа, добавили вкладку Work - зачатки Cowork в Codex, голосовой ввод везде и питомцев.CLAUDE.md.
~/.claude -> /srv/ai/claude с общей группой.
DESIGN.md.