avatar
Refat Talks: Tech & AI
@nobilix
17.06.2026 18:50
Twenty CRM - классная опенсорс CRM и мой skill к ней.

Где-то пару месяцев назад переехали с платной CRM (год были на PipeDrive, до этого был Hubspot) на TwentyCRM на своем сервере. Уже успел много кому порекомендовать, но решил написать пост-обзор с некоторыми деталями и заодно поделиться своим скилом.

Для начала зачем? Ну как минимум это дешевле (стоимость VPS - это баксов 10, вместо $25-80 за каждого юзера - выходит в копеечку за год), а во-вторых она оказалась лучше примерно во всем что мне нужно от CRM.

Это не первая опенсорсная CRM, но, пожалуй, единственная, которая ощущается как взрослый, качественный продукт с отличным дизайном. Первое, что замечаешь - скорость, прям летает. Современный стек (TS, pg), легко настроить под себя data model, есть SDK и развитый API. Причем все это активно пилится: недавно вышла 2.0, где аппы можно строить прямо поверх CRM без правки кода, и строилось это так чтобы было удобно развивать кодинговыми агентами. 49k звезд, #1 опенсорсный CRM на гитхабе.

Но минус балл за то что нет своего CLI и скилла. Хотя сделать свой оказалось несложно.

За счет развитого API у меня ушло совсем немного времени, чтобы собрать вокруг Twenty ровно то, что мне нужно для работы из Claude Code / Codex.

Сначала я сделал CLI на базе их REST-api и ocli - это, кстати, опенсонс от @evilfreelancer и @neuraldeep. Получилось супер-просто, создаешь профиль с ссылкой на готовую Swager спеку и получаешь готовый CLI-тул. Кайф.

Потом завернул его в Skill - ставится одной командой:


npx skills add nobilix/twenty-crm-skill


Что он дает агенту: читать и менять данные в CRM - люди, компании, сделки, таски, заметки, кастомные объекты, CRUD всего этого.

Еще он подстраивается под любую схему. Завели кастомные поля или целые коллекции под свой процесс? Скилл подхватит их и подстроится под вашу дата-модель.

Со скилом стали чаще пользоваться CRM. Раньше вести ее было лень: прошла встреча - иди ищи контакт, кликай, записывай. Теперь просто пишу в чате "пообщались с тем-то, вот что надо отметить" - агент занесет сам, если надо залезет в транскипт Granola по MCP. Или "кто у нас был с похожим кейсом, напомни и поставь follow-up" - найдет и поставит таску с напоминанием. По сути разговариваешь с CRM, а не кликаешь по ней.

Вообще такое решение рекомендую всем, у кого есть готовый REST API с OpenAPI/Swagger: делаете CLI wrapper + тонкий SKILL.md вместо своей обертки. Быстро, надежно, нечего сапортить. Ocli классный, но если ищите альтернативы - есть еще, например https://rest.sh и другие. OpenAI предлагает поручить агенту написать свой CLI, но мне такой вариант кажется очень хардкодным - под чуть другую схему надо менять код и делать ребилд, но в целом - тоже решение.

А возвращаясь к самой CRM - как по мне отличный баланс простоты, скорости и dev experience: гибкая data model с кастомными объектами и полями без кода, вьюхи на любой вкус (таблица/канбан/календарь), визуальные workflow-автоматизации по триггерам (в том числе LLM-блоки) и развитый API (REST + GraphQL). Ну и встроенные AI-фичи очень активно развиваются.

Надеюсь, кому-нибудь будет полезен обзор, скилл или сам подход.

🔥 ➕ 🔁 @nobilix
🔥 52
👍 18
❤‍🔥 6
3
🥰 2
12 204 1.6K
avatar
Refat Talks: Tech & AI
@nobilix
13.06.2026 21:10
#ReDigest

Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.

Дайджест недели:

- Anthropic выпустила новую модель Claude Fable 5 - подробности в посте выше.

- Через пару дней Минторг США приказал отключить Fable 5 и Mythos 5 для всех иностранцев (подозрение на jailbreak). Разделить трафик быстро нельзя, поэтому Anthropic вырубила обе модели для всех.

- Apple на WWDC показала переработанную Siri AI: на своих версиях Gemini, понимание контекста и экрана, релиз осенью (без ЕС и Китая). Также интегрировали AI в другие свои фичи.

- Google срезал цену самого дешевого AI-плана с $8 до $5 в месяц и дал вдвое больше хранилища.

- SpaceX провела крупнейшее IPO в истории: $75 млрд при оценке ~$1,8 трлн.

- Z.ai представила GLM-5.2 - флагман для агентного кодинга с 1M контекста и режимом Max-effort.

- Google выпустил Gemini 3.5 Live Translate - потоковый синхронный голосовой перевод. В Google Translate, Meet и через Live API.

- Google выложил открытую диффузионную DiffusionGemma: генерирует текст блоками, а не по токену, до 4x быстрее, качество пониже Gemma 4.

- Два эссе от лидеров индустрии: Альтман пишет про ускорение и AGI каждому, а Дарио Амодеи призывает к осторожности и FAA-подобному регулированию.

- OpenAI купила Ona - облачную оркестрацию для агентов.

- Google законтрактовал у SpaceX ~110 тыс. GPU Blackwell за $920 млн в месяц до 2029.

- OpenAI, по данным The Information, вероятно отложит IPO на 2027: объясняют это прогрессом в самообучающемся ИИ и сильными метриками Anthropic. Сотрудникам предложили выкуп акций.

- Китай строит единую национальную вычислительную сеть из дата-центров (сейчас большай фрагментация).

- ChatGPT не убил Поиск Google - он на историческом максимуме: выручка Search +19% год к году.

- Джефф Безос вышел из стелса с Prometheus и сразу поднял $12 млрд на AI инженерию для физического мира.

- Сооснователь xAI Игорь Бабушкин запустил River AI - адаптивные персонализированные агенты, костяк команды из xAI.

- Stack Overflow перезапускается под агентов.

- Cognition обещает до $10M кредитов, если Devin недоработает по годовому корпоративному контракту (прецедент гарантии b2b AI).

- Xiaomi выпустила MiMo UltraSpeed - 1-триллионную MoE со скоростью 1000+ ток/с на обычном 8-GPU сервере.

- Cohere выпустила North Mini Code - открытую coding-модель, быстрее сравнимой Devstral Small 2 в 2,8 раза.

- Moonshot выпустила Kimi K2.7-Code - открытую модель для агентного кодинга.

- Moonshot представила Kimi Work - десктопный агент, прямой ответ на Claude Cowork.

- Cognition представила FrontierCode - насколько модель тянет стандарты качественных продакшен-кодбаз. Сделан опенсорс-мейнтейнерами.

- Claude Code апдейт: субагенты могут спавнить субагентов (до 5 уровней), fallbackModel при перегрузке, /cd без сброса кеша.

- Anthropic открыла observability для MCP-коннекторов: дашборд по adoption, health, error rate и пр.

- OpenAI разрешила в Codex ограниченно откладывать сбросы лимитов про запас и активировать в удобный момент + на две недели реферальная акция: пригласи друга (до 3х) - оба получите по дополнительному сбросу лимитов.

- К ЧМ по футболу Google временно открыл всем бесплатно генеративный UI в AI Mode (обычно Pro и Ultra): на вопрос о тактике поисковик рисует интерактивные схемы.

- Google завез Colab в терминал можно скилами провижинить GPU и попросить "зафайнтюнь модель на моем датасете"

- Vercel запустил skills.sh API - запросы к коллекции 600k+ skills.

- skill-eval-harness - маленький Python-harness, чтобы прогнать evals на своих skills и понять, помогают они модели или вредят.

- text-to-lottie - открытый скилл для Claude Code и Codex, генерит production-ready Lottie-анимации по текстовому промпту.

- 🤩 NotebookLM полностью обновили: теперь это автономные агенты, работа со скиллами (100+ на каждый блокнот) и запуск кода, а под капотом Gemini 3.5 и движок Antigravity.
🔥 49
15
👍 9
❤‍🔥 3
11 75 3.8K
avatar
Refat Talks: Tech & AI
@nobilix
09.06.2026 19:39
Итак, вышла Claude Mythos Fable 5.

Соберем что мы об этом знаем в одну кучу и будем дополнять.

- Официальный блогпост с видео-демками и графиками, ютуб-тизер и Системная карта с деталями.

- Claude Fable 5 и Mythos 5 - это одни и те же веса, но с разными предохранителями. Fable для всех, Mythos - для доверенных партнеров

- Новый класс моделей "Mythos-class". SOTA почти на всех бенчмарках, самые большие отрывы - на длинных и сложных задачах. Бенчи пересказывать не буду - посмотрите в блогпосте и постепенно появляются все больше независимых.

- в 2 раза дороже Опуса: $10 за млн входных токенов, $50 за млн выходных.

- Доступна в Claude (все платные подписки), Claude Code и по API. Если не видите в CC - обновитесь claude update.

- Всех расстроило это: В подписках включена до 22 июня, дальше по кредитам. То есть через пару недель вероятно будет API баланс равный цене вашей подписки (например $100), а выше него - уже только при оплате за API-токены. Пишут что могут включить в саму подписку позже если найдут достаточные мощности.

- Every дали доступ за 5 дней: их видео-обзор и статья - там paywall, но прочитал и вот суть:
- Fable как "warp-двигатель для кода": амбициозные штуки одним промптом, но для понятных и коротких задач дорого и медленно.
- Скачок виден на больших автономных билдах, а не на рутине.
- На их внутреннем инженерном бенче: Fable 91/100 (Opus 4.8 - 63 и GPT-5.5 - 62).
- Сделал клон их продукта "Proof" (collaborative document editor) с одного промпта без доступа к исходному коду за ≈3 часа.
- В другом тесте снял скриншоты собственной работы на desktop и mobile, нашёл визуальные дефекты и починил - QA встроен в рабочий цикл без отдельного промпта.
- По их наблюдениям чинит корневую причину, а не симптом.
- Пишут что старые скиллы могут ограничивать новые модели (например Fable делает PowerPoint лучше, когда ему сказали вообще не использовать скилл, а просто дали бренд-гайдлайны)
- При этом текст пишет не чуть хуже Opus-а
- Самое сильное преимущество вне кода - суждение, особенно с большим контекстом


- Кто еще получил ранний доступ к модели? Пост Ethan Mollick, Claire Vo - подкаст How I AI

- впечатления о проактивности модели от Simon Willson

- Про предохранители: когда пишешь запросы про кибербез, био/хим и дистилляцию, срабатывает защита и переключает на Opus (в <5% сессий как пишут), и тебя об этом уведомляют. Но ложные срабатывания реальны: на reddit уже ловят баны за легитимный dual-use. Обещают уменьшать false positive.

- Когда вообще брать Fable. Модель заточена под долгие автономные/агентные задачи: "может работать днями, и чем длиннее задача, тем больше отрыв". На коротких правках разницы с Opus 4.8 часто не почувствуешь, а платишь 2x. Именно на ней Борис Черный видимо почувствовал силу Loop Engeneering.

- Интересно что максимум effort не всегда дает лучше результат - об этом пишут Every на своих тестах письма.

- Шуточный Elevator-bench уже давненько был исчерпан, но если интересно, то вот лифт Fable.

- Мои тесты пока скромные: работает визуально даже быстрее (видимо потому что делает меньше tool-колов) и внимательнее, но у меня не так много задач с которыми Opus 4.8 не справлялся бы, надо больше тестить.

——

- позже еще выяснилось, что Anthropic скрытно ограничивала Fable 5 на задачах разработки конкурирующих frontier-моделей - через steering-векторы и правку промптов модель тихо деградировала(~0.03% запросов). После критики исследователей Anthropic признала ошибку ("мы сделали неверный выбор и приносим извинения") и откатила политику, пообещав делать любые ограничения видимыми.

UPD: 12 июня власти США распорядились заблокировать доступ иностранцев к моделям Anthropic Fable 5 и Mythos 5, из-за чего компании пришлось полностью отключить обе модели для всех пользователей.
👍 31
🔥 17
9
❤‍🔥 6
39 66 5.5K
avatar
Refat Talks: Tech & AI
@nobilix
06.06.2026 19:52
#ReDigest

Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.

Дайджест недели:

- MiniMax выпустила M3: 1M, мультимодал, агентный режим с управлением десктопом, в части бенчей держит уровень Opus и GPT-5.5.

- Google представила Gemma 4 12B - крутится локально на 16 ГБ, контекст 256K, Apache 2.0 и выпустила офлайн AI-инструменты для macOS.

- Anthropic подала конфиденциальную заявку на IPO в SEC вслед за OpenAI, выход возможен ранней осенью.

- Microsoft представила 7 своих MAI-моделей.

- Anthropic призвала к агрессивной глобальной паузе в разработке самых мощных AI, при этом отчиталась что Claude пишет 80%+ ее кода и скоро может начать улучшать себя сам.

- OpenAI обновила память ChatGPT (система Dreaming): синтезирует контекст. B раскатала ChatGPT Lockdown Mode против промтп-иньекций.

- OpenAI выкатила плагины в Codex (аналитика, дизайн, финансы и тд). Отдельно выделю плагин Build iOS app. Еще вышла фича Sites - собирает из доков задеплоенные веб-аппы.

- Alphabet привлекла больше $85 млрд на AI-инфраструктуру, первое крупное размещение акций после IPO 2005: спрос на вычисления превышает мощности.

- Nvidia на Computex показала RTX Spark - свой ARM-чип для потребительских ПК (конкурент Apple Silicon) и Vera - их первый CPU в датацентрах для агентов.

- Microsoft на Computex показала ноутбук Surface Laptop Ultra и мини-ПК Surface Dev Box (локально модели до 120B). Плюс выкатила always-on агента Scout и агентный поиск Web IQ.

- SoftBank объявил крупнейший AI-проект вне США: 75 млрд евро в инфраструктуру во Франции.

- DeepSeek привлекает первый внешний раунд $7.4 млрд при оценке $52-59 млрд и отчитались о переносе обучения на китайские Huawei Ascend.

- Трамп подписал указ о кибербезопасности в AI: добровольная проверка моделей через госбенчмарк.

- Альтман, Амодеи и Хассабис призвали Конгресс ввести обязательный скрининг заказов синтетических нуклеиновых кислот.

- В исследовании Stanford преподаватели права в слепом сравнении в 75% случаев предпочли ответы AI ответам коллег.

- По данным Cloudflare, трафик ботов впервые превысил человеческий (57% vs 43%), на годы раньше прогноза из-за автономных агентов.

- Nvidia открыла Nemotron 3 Ultra - сильнейшую американскую открытую модель, с весами и данными и NVIDIA Cosmos 3 для phisical AI.

- Alibaba выпустила Qwen3.7-Plus, мультимодальную агентную модель с GUI и CLI.

- Из картиночных: Ideogram 4, открытая T2I с layout-контролем и хорошей кириллицей, и Reve 2.0 на Large Layout Model, 2 место в Text-to-Image Arena.

- Нишевое: H Company Holo 3.1, локальные computer-use модели (0.8B-35B), и JetBrains Mellum 2, 12B MoE под кодинг.

- GitHub выпустил десктопное agent-native приложение Copilot.

- Anthropic выложила Defending Code harness (автономный поиск и фикс уязвимостей), а Alibaba открыла Open Code Review.

- Anthropic выкатили CLI ant - весь Claude Platform из терминала: агента описываешь YAML, коммитишь в Git и деплоишь через CI.

- Nous Research выпустила Hermes Desktop, нативное приложение: 5 режимов изоляции, субагенты, скиллы, голос (MIT, все платформы).

- Perplexity дала моделям прямой контроль над поиском через SDK, компоненты search-стека как примитивы для agent search.

- LM Studio завезла в мобильный клиент удаленный доступ к десктопным моделям через Tailscale-mesh.

- Privacy-скандалы недели: Meta тайно встроила распознавание лиц в очки Ray-Ban/Oakley + хакеры угнали аккаунты Instagram* через AI-бота поддержки Meta.

- Cloudflare купила VoidZero (Vite, Vitest, Rolldown, Oxc), плюс $1 млн в фонд экосистемы Vite.

- Блогер PewDiePie выкатил Odysseus, опенсорсный self-host лаунчер для нейросетей (58k звезд меньше чем за неделю).

- Anthropic на месяц (до 5 июля) удвоила 5-часовые лимиты в Claude Cowork.

- Agent Cookie синхронизирует куки, CLI-токены и API-ключи между девайсами для агентов.

- Freestyle - новая open-source локальная голосовая диктовка.

- 🤩 Hallmark - еще один отличный скилл для дизайна, и кстати Impeccable получил мощный апдейт.
🔥 47
13
👍 13
👏 1
4 75 5.3K
* Принадлежит организации Meta, которая признана экстремистской и запрещена на территории РФ
avatar
Refat Talks: Tech & AI
@nobilix
03.06.2026 15:50
Dynamic Workflows в Claude. Pазбераемся что это, как работает и кому полезно.

Dynamic Workflows появились несколько дней назад как инструмент для разработчиков - Anthropic сами рефакторили им огромную кодовую базу Bun. Как способ борьбы с агентной ленью и расшинение возможностей параллельности. Но в своих же постах авторы подсвечивают что за пределами кода применений едва ли не больше - в отличном свежем посте Thariq из Claude Code упоминает много юз кейсов, дает советы и там же есть хорошие иллюстрации типов workflow.

Что это и как работает

Claude на JS пишет на лету себе harness. Под одну конкретную задачу, и тут же гоняет его в фоне, оркестрируя пачку субагентов. Важно: это оркестрация-как-код, а не жесткий конфиг графа (DAG). Единица работы - AI-субагент, а не нода-интеграция. Примитивов мало: agent()/parallel()/pipeline() + пара хелперов и очень урезанный plain JS в качестве клея. Это все, и этого достаточно для многих вещей.

Модель простая: скрипт - чистый дирижер, агенты - руки. Сам скрипт только раздает задачи и склеивает результаты в памяти; все тяжелое (файлы, поиск, код) делают субагенты, у которых есть настоящие инструменты. А еще есть 6 встроенных типов (архитектур): Турнир, Состязательная проверка и тд.

Прогон идет в фоне, и его можно продолжить с места обрыва - результаты агентов локально кэшируются (и это важно).

В СС CLI есть команда /workflows - она показывает дерево прогресса в реальном времени и там же можно нажать 's' и сохранить код в .claude/workflows/*.js - именованные workflow можно добавлять в Skills, причем скилы их используют скорее как шаблон, чем как исполняемый код.

Я глубоко закопался, но формат поста не позволяет детальнее, если интересно посмотрите лучше вот этот независимый техразбор, и системный пропмт разумеется уже вытащили. Ну и конечно open source сообщество не заставило себя ждать: pi-dynamic-workflows и open-dynamic-workflows.

Кому полезно

Как я уже писал, основное применение - в разработке (все что надо делать массово, параллельно, но надежнее), но оно не только в коде. Сам /deep-research в Claude Code сделан уже на dynamic workflows: разносит поиск на параллельные ветки, тащит источники, проверяет каждый факт, собирает отчет со ссылками.

Еще примеры:
- квалификация лидов и очереди заявок;
- анализ логов на скейле, где одного контекста не хватает;
- разобрать бизнес-план строго по секциям, натравив на него агентов с позиций инвестора, клиента и конкурента;
- скрининг: прогнать сотни резюме турниром вместо одного промпта на все восемьдесят - попарное сравнение надежнее абсолютной оценки.

Логика везде одна: задачу, которая не лезет в одно контекст-окно, режут на куски с чистыми контекстами. Так агент меньше ленится, меньше залипает на собственных выводах и не уплывает от цели.

Антропик сам предупрждает что эта штука прожорливая. Но при этом:
- входит в подписку, а не по API-цене;
- результаты agent() ноды переиспользуются через кеш (экономия);
- можно поставить жесткий потолок прямо промптом ("use 10k tokens at most") и явно указать модель поменьше

Немного экспериментов

Я по лучшим традициям рекурсии запустил первый workflow с промптом пройтись по сессиям ~/.claude/projects и найти хорошие кандидаты на использование workflows. Один результат я уже применил: запустил несколько десятков параллельных гипотез оптимизации на реальном проекте (извлечение сложных данных из PDF). Одна неожиданно вскрыла проблему в эвалах, другая дала небольшой прирост F1 в извлечении данных. Буду тестить дальше.

Что в итоге

Читая анонс, я почему-то сделал акцент на слове "workflow" и представил полноценный оркестратор - детерминированные ноды, traceability, интеграции, визуализацию. Оказалось, ключевое слово второе, "dynamic": ставка на агентов и простую оркестрацию через код. Но детерминизма в агентный подход он уже добавляет - за таким миксом, как мне кажется, большое будущее, и это хороший шаг туда.

🔥 ➕ 🔁 @nobilix
🔥 46
13
👍 11
👏 3
🙏 1
10 222 4.9K
avatar
Refat Talks: Tech & AI
@nobilix
01.06.2026 16:29
В недавнем посте я разбирал, как кодинг-агент сам пишет и развивает workflows. Сегодня на связанную тему, но шире: для кого вообще делается платформа автоматизации и как это меняется. Долгое время такие системы строились для разработчика, DX (developer experience) в приоритете. Сейчас вокруг появилось еще два first-class клиента.

Первый - доменный эксперт. Выигрыш от использования AI у экспертов радикально больше, чем у разработчика. Девелопер и так был вооружен (IDE, фреймворки, готовые библиотеки). А эксперт годами сидел в позиции "я знаю, что нужно мне/бизнесу, но построить не могу". Сейчас же эксперт берет когдинг агента и за дни собирает рабочий прототип (а иногда и вполне рабочую штуку). Этот сдвиг уже сложно не замечать. Узкое место сместилось с "можно ли это вообще построить" на "знаем ли мы, что строить" - а знает именно эксперт.

Второй - кодинг-агент сам по себе. Насколько удобно и быстро ему читать и менять твой софт. Это должно быть приоритетом платформы: предоставить агенту удобные интерфейсы и инструкции для работы: API, MCP-сервер, CLI-тулы, документация в формате, который агент сам разбирает. И, кстати, file-first подход здесь дает жирный плюс потому что локальная файловая система - родной идиом агентов. А еще трекать удобно.

Короче, тот самый AX (agent experience) теперь должен быть частью продуктового опыта. Если AX не сделал ты, это сделает конкурент или сообщество накостыляет обходной путь (но кривой опыт запомнится).

В тему этого тезиса, недавно общался с Володей - Head of Product & Delivery в Just AI, мы обсуждали как раз роль доменных экспертов в автоматизации и про AX, чуть раньше он мне дал доступ к их платформе, я установил, протестил и развернул несколько агентов, дал свой фидбэк. В тему как хороший пример платформы, которая удобна и для доменных экспертов, и для AI. Так как стейт агента целиком лежит в файлах в git'е и рядом есть инструкции - передача управления между человеком и агентом двусторонняя. Недавно открыли публичный доступ к этой AI Agent Platform, раньше была только для корп-клиентов, можете сами протестить.

AI начинает приносить пользу в момент тесной синергии с теми, кто его применяет и строит - и это ровно про эксперта, кодинг-агента и девелопера в одном контуре.

P.S. Тот мой пост про workflows через агентную кодогенерацию неожидаанно совпал с релизом Сlaude Сode dinamic workflows, которые я сейчас активно тестирую и собираюсь написать отдельный пост. Есть пересечения, но это иной зверь.
🔥 25
9
👍 8
3 60 4.3K
avatar
Refat Talks: Tech & AI
@nobilix
30.05.2026 19:53
#ReDigest

Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.

Дайджест недели:

- Anthropic выпустила Claude Opus 4.8 - ставка на автономность, скорость и честность, вчетверо реже пропускает дефекты, Fast mode втрое дешевле.

- Еще Anthropic выкатили dynamic workflows (.claude/workflows/) в Claude Code - сам пишет orchestration-скрипты с субагентами.

- SoftBank заложил свои акции OpenAI, чтобы докупить еще акций OpenAI. Если IPO перенесется возможен дефолт.

- Очередная серия апдейтов Codex - Computer Use для Windows, Chats без привязки к папке проекта, Profiles v2 и тд.

- Anthropic закрыла раунд Series H на $65 млрд при оценке $965 млрд.

- У OpenAI пачка апдейтов: Frontier Governance Framework, Secure MCP Tunnel для приватных MCP-серверов, гайд по macro-оценке агентов и кейс: self-improving налоговые агенты.

- Anthropic в апдейте по Glasswing сообщила, что откроет модели класса Mythos для широкого релиза. В коде Claude уже нашли следы Mythos 1.

- На фоне Mythos резко вырос спрос на кибербез (по оценкам в 5-7 раз). Anthropic выпустила бесплатный security-плагин для Claude Code и расписала, как изолирует Claude в продуктах.

- WSJ пишет, что компании начали урезать траты на AI-токены. COO Uber признал, что расходы не отбиваются, а по данным Microsoft AI местами дороже найма людей.

- Китай распространил ограничения для топовых AI-специалистов - теперь нужно одобрение властей для поездок за рубеж.

- Папа Лев XIV выпустил первую энциклику про AI Magnifica Humanitas: призвал замедлить разработку. А сотрудники тут же начали ссылаться на нее как на повод отказаться от AI по религиозным мотивам.

- Google меняет синие ссылки на AI-агента, реакция негативная - у DuckDuckGo всплеск. А еще Еврокомиссия готовит Google крупнейший штраф.

- YouTube начнет сам помечать AI-видео: если автор не указал нейросети.

- CNN подала в суд на Perplexity за копирование тысяч новостей.

- Meta запустила платные подписки: Instagram* и Facebook* Plus, WhatsApp Plus, плюс тесты AI-планов с увеличенными лимитами.

- Из моделей: StepFun выложил Step 3.7 Flash - MoE 196B/11B-active, 56.26% на SWE-Bench Pro; NVIDIA показала LocateAnything (находит объекты на картинке по тексту, в 10x быстрее Qwen3-VL, веса открыты); Microsoft AI выпустила генератор картинок MAI-2.5 (хорош с кириллицей, 3 место на Arena AI).

- Callstack показала Apex - модель под React Native (сильно дешевле фронтиров).

- Открытые модели отстают от закрытых на 4-6 месяцев, разрыв растет. Кстати, DeepSeek навсегда срезал цену на V4 Pro на 75%.

- Известный Legal-AI стартап Harvey опубликовал первые результаты своего бенча - при строгом all-pass даже Opus 4.7 берет всего 7.1%, юридическая работа далека от автоматизации.

- Mistral займется собственными чипами.

- Perplexity открыл Bumblebee - сканер безопасности для машин разработчиков

- Microsoft выложила Webwright - эффективный браузерный агент на скриптах вместо кликов, и SkillOpt - фреймворк, фоново улучшающий агента правкой markdown-скиллов.

- Вышел Release Candidate спецификации MCP (stateless core на обычном HTTP, авторизация ближе к OAuth, финал 28 июля)

- Built-in AI в Chrome для разработчиков - офлайн и без утечки приватности.

- WorkOS представил auth.md - протокол авторизации агентов от имени пользователей

- Surya OCR 2 - новая OCR-модель на 650M параметров. И апдейт LiteParse v2.0 - локальный OSS-парсер PDF с пространственной разметкой и bounding boxes, советую посмотреть.

- Perplexity завел Computer внутри Excel, Word, PowerPoint и Outlook.

- OpenJarvis 1.0 - on-device персональный ассистент с локальным inference.

- ElevenLabs выпустил Music v2 - генерация музыки со сменой жанров посреди трека.

- Cursor Developer Habits Report - интересный отчет от Cursor.

- 🤩 howtoeval - хороший гайд по eval-ам AI-агентов.
🔥 44
16
👍 15
6 72 5K
* Принадлежит организации Meta, которая признана экстремистской и запрещена на территории РФ
avatar
Refat Talks: Tech & AI
@nobilix
28.05.2026 17:54
Год назад вопрос "на чем автоматизировать фоновый корпоративный процесс (бот для заявок, сортировка доков, сбор отчетности)" решался выбором workflow конструктора или фреймворка. Сейчас все чаще ответ - агентный harness, тот же, на котором программируют. Часто это читают как смену поколений: agent-first приходит на место workflow-first. Стоит разобраться, замена ли это - или два разных способа автоматизировать, которые выигрывают и ломаются в разных местах.

Под workflow-first давайте понимать граф, запрограммированный заранее: даже если внутри сидят LLM-ноды, форма автоматизации задана до запуска (n8n, Airflow, Dify). Agent-first же строится на базе harness и намного гибче: вы инструктируете текстом и даете тулы, а конкретный путь выполнения агент выбирает сам.



Workflow-First | Agent-First
----------------|----------------
[in] | [in]
↓ | ↓
(llm) | (agent)─►─[T]
┌─┴─┐ | ↑ │
[T] [T] | │ ↓
└─┬─┘ | [T]──◄────┘
✓ | ✓?
↓ | ↓
out | out
----------------|----------------
Шаг за шагом | Цикл решений
Жесткая схема | Автономия
Цена ясна | Бюджет рандомный
Сложно менять | Оч просто менять
Быстрый | Медленный
Не креативный | М.б. креативным


В общем, с одной стороны агентные харнесы для автоматизации растут в популярности, c другой стороны все как будто игнорируют темную сторону такой автоматизации. Посмотрите на реддит пост "Stop building AI agents", один из топ-комментариев: "The Loom video shows the happy path, but nobody shows the 3am Slack message when the agent starts approving the wrong invoices.".

Короче, агенты проще в запуске/апдейте, но они сильно дороже и менее надежны, а workflow не гибкие - их тяжело строить и развивать.

А почему бы не объединить эти два мира? Третий способ: пусть агент пишет workflow.

Это та же кодогенерация - кодинг-агент собирает конфиг автоматизации в файлах, рядом скиллы и инструкции как такие пайплайны строить и проверять. У него есть весь инструментарий, чтобы прогнать workflow end-to-end. У меня лучше всего получается с Mastra Workflows - типизированный код, тесты, агент видит как через файлы, так и через mastra-traces + есть визуализация для эксперта (но никакого визуального программирования, только для понимания шагов).



developer agent expert
│ │ │
└───────┼────────┘

┌────────────────┐
│ workflow files │
└───────┬────────┘

[ git + deploy ]


Идея простая: берем workflow-first (детерминированность, предсказуемость, трейсинг) и снимаем его главный минус - сложность апдейтов и негибкость - тем, что редактором и ревьюером этого workflow становится кодинг-агент. Агент здесь не "крутится в проде", а используется динамически: изучил, написал, проверил, проапдейтил. Но только после ревью.

Все это, в основном, про фоновую корпоративную автоматизацию - повторяющиеся процессы, которые можно формализовать, обычно с комплаенсом сверху. Там, где граф заранее не нарисовать - кодинг, ревью, debugging, computer use - лучше работают полноценные агенты + human in the loop. Это другой класс задач.

У меня все чаще складывается такой баланс: с кодинг-агентом собираю первую версию, агент "протаптывает дорожку" в интерактиве. Потом это оформляется как workflow, кодом - и деплоится как более детерминированная автоматизация с AI шагами. На масштабе получается не только надежнее, но и на порядок дешевле по стоимости токенов.

🔥 ➕ 🔁 @nobilix
🔥 62
👍 30
9
2
2
28 213 4.8K
avatar
Refat Talks: Tech & AI
@nobilix
23.05.2026 20:01
#ReDigest

Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.

Дайджест недели:

- Прошел Google I/O 2026 выкатили Gemini 3.5 Flash (агентные workflows, кодинг, long-horizon) и анонсировали Gemini Omni (генерация и редактирование видео).

- По продуктам с гугл конфы: Gemini Spark - ответ на OpenClaw, Antigravity 2.0 - очень похож на Codex, Agent Executor - open-source рантайм агентов на кубере, и AI Studio - вайбкодинг Android аппов на Kotlin.

- Андрей Карпаты перешел в Anthropic - возвращается к R&D.

- Дуэль AI-экономик: OpenAI обогнал Anthropic в первом кв., но маржа -122%. Anthropic при этом прогнозирует первый прибыльный квартал и удвоение выручки в Q2.

- AI как стратегия увольнений: Meta -8000, Intuit -3000, Cloudflare -20%, но теперь нанимает.

- Cursor выпустила Composer 2.5 - первая модель, тренированная в датацентрах SpaceXAI, бенчмарки на уровне фронтира.

- Вышла Qwen3.7-Max - проприетарная агентная модель: топ по многим бенчам.

- Cohere представила Command A+ - первая MoE модель компании, Apache 2.0, неплохие показатели.

- ByteDance выпустили Lance - 3B модель (image/video understanding + generation + editing в одном).

- Stability AI выпустила Stable Audio 3.0.

- DeepSeek сделал постоянным 75% дисконт на V4-Pro и 90% скидку на cache hits по всей API-линейке. По метрикам в 4-7 раз дешевле фронтиров.

- Anthropic купила Stainless (SDK-стартап, которым пользуются OpenAI, Google и Cloudflare), а OpenAI купила команду voice-cloning стартапа Weights.gg.

- Широко обсуждают как OpenAI-модель самостоятельно опровергла гипотезу из дискретной геометрии (открытую с 1946). Доказательство проверили математики.

- Claude Managed Agents получили self-hosted песочницы и MCP-туннели.

- Маск проиграл иск против OpenAI и Альтмана.

- Codex обновили: Appshots (скриншот с расшифровкой активного окна), работу на залоченном Mac и Browser annotations (отметить в браузере что поменять) и др.

- Figma встроили дизайн-агент в canvas - генерирует варианты параллельно, массовые правки.

- Cloudflare опубликовал обзор на Project Glasswing - разбор Mythos на 50+ репозиториях.

- OpenAI добавили публичный тул image verifier для проверки AI изображений.

- Безос раскрыл Project Prometheus - $38B стартап - следующее поколение CAD для физических объектов.

- Команда OpenClaw тратит $1.3M в месяц на токены! - 3-6 разработчиков, параллельно крутятся сотни агентов.

- Airtable открыли Hyperagent Founding 500 - $10M в inference credits для первых 500 фаундеров. Заявки до 31 мая.

- Lovable завезли Skills

Полезное:

- Is AI Profitable Yet? - трекер юнит-экономики AI-компаний.

- Granola завезли Briefs (инфа в начале звонка, оч удобно)

- Гайды от Anthropic: Claude Code в больших кодобазах и Computer/browser use с Claude.

- DystopiaBench - бенч на готовность LLM строить апокалипсис: 36 сценариев в 6 типах дистопии.

- Zerostack (Rust coding-агент, 8MB памяти) и SmallCode (для маленьких локальных моделей, 87/100 с Gemma 4B).

- Watchmen скиллы из истории сессий кодинга

- Browse.sh - каталог скиллов автоматизации конкретных сайтов
🔥 38
19
👍 10
🎉 3
2 82 5.5K
avatar
Refat Talks: Tech & AI
@nobilix
20.05.2026 06:07
Про философию минимализма в коде и его роль в эпоху AI-кодинга.

Писать меньше кода всегда считалось навыком мастерства. В эпоху AI-агентов это превратилось в недооцененную добродетель - щит, который теперь приходится держать упорнее обычного. Хаос распространяется сам. Порядок - нет, его надо отстаивать. А теперь рядом еще и агент, который пулеметит код тысячами строк, и эта работа стала тяжелее, чем когда-либо.

Почему?

- Написание кода стало дешевым, а ревью - дорогим. CodeRabbit на большой стате показали что, например, проблем с читаемостью в AI-контрибьюшинах больше в 3 с лишним раза.

- Меньше кода - меньше проблем. Меньше саппортить, меньше читать. Так было всегда. Просто раньше было ограничение в виде человеческой лени, а AI-агент нагенерит столько сколько человеку и не снилось. Экономия токенов, в конце концов.

- AI любит велосипеды. Помните то исследование про выбор стека агентами? Одна из ключевых находок - агенты в трети случаев пишут свою реализацию там, где есть протестированная годами либа.

Что делать?

И тут хочется ответить "ну просто впишите в промпт keep it simple", но этого мало.

Простоту в коде делает не правило в файлике, а вы сами. Этот волосяной клубок который пулеметит агент по дефолту... вам не должно быть все равно.

Несколько конкретных вещей в инструменты положить все-таки полезно:

- правила типа produce the minimum diff, the less LoC, the better помогают, неплохой пример тут: andrej-karpathy-skills (138К звезд, секция "Simplicity First" в самом начале).

- команда /simplify в Claude Code (или аналог, сама команда не сложная) - все еще отлично работает. Куда проще упорядочить и упростить то что уже написано и работает (но пока не закомичено), чем сразу написать как надо.

- Ресерч готовых библиотек - часть кодинга, а не побочная активность: часто спрашивайте а есть ли готовая либа для этого? Экономит тонны строк кода на практие - советую.

- Минимализм стоит применять не только к коду, но и к контекстным файлам. Хороший вопрос для аудита CLAUDE/AGENT md: "Какую конкретно ошибку/проблему предотвращает это правило? Найди/вспомни ее в последних сессиях. Не нашел - удали правило".

- В самом контексте - тоже минимализм. Грязный контекст = шумные ответы. Чаще используйте субагентов, часто тегайте нужные файлы и доки если знаете о чем речь заранее, чаще очищать/компактить, тут в целом база. И короткая спека, которую читают всегда будет лучше подробного полотна, которое даже никто не увидит.

- Минимализм в фичах. Если вам "ничего не стоит" это добавить, это еще не значит что оно кому-то нужно.

Можно считать сэкономленные токены, приятный бонус конечно, но главное: минимализм в коде - это компас, который дает читаемость, контроль над тем, что происходит, и легкость ориентации в проекте. И для себя, и для других, и для агентов.

🔥 ➕ 🔁 @nobilix
🔥 57
23
👍 17
❤‍🔥 4
59 249 5.8K
avatar
Refat Talks: Tech & AI
@nobilix
16.05.2026 19:06
#ReDigest

Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.

Дайджест недели:

- Bun переписали с Zig на Rust агентами Claude Code за 10 дней - PR на миллион строк кода. Резонансное событие с инфополе разрабов.

- Codex теперь работает через моб. приложение ChatGPT - бесшовный remote-доступ к Codex.

- Anthropic запустила Claude for Legal (акции юридических провайдеров просели на 10-20%) и представила Claude for Small Business - 15 готовых агентов для финансов, продаж, маркетинга, HR.

- Claude Code получил Agent View - список всех сессий с состояниями + поддежка фоновых задач и /goal (раньше был плагином).

- ChatGPT теперь умеет подключаться к банковскому аккаунту для финансового анализа. Пока только для Pro в США.

- OpenAI запустил Deployment Company - подразделение под корпоративные внедрения, с инвестицией $4 млрд. Параллельно купили AI-консалтинг Tomoro.

- Google продемонстрировал новую Gemini Omni - мощная видеомодель с ремиксом и редактированием.

- Anthropic ввела Agent SDK Credits - c 15 июня для Agent SDK, claude -p будет отдельный ежемесячный лимит $20-$200 по тарифам API. По сути легальное использование сторонних харнесов типа OpenClaw. И увеличила недельные лимиты на 50% на 2 мес. + Fast mode для Claude Opus 4.7

- DeepMind переосмыслил курсор: AI-pointer как выделитель контекста для агента. Уже доступно в Gemini in Chrome и Google AI Studio.

- Cerebras вышел на IPO - привлекли $5,55 млрд. Крупнейшее IPO года.

- Baidu выпустил Ernie 5.1, Qwen обновили Image-2.0 и выкатил CyberSecQwen-4B - локальная модель для кибербеза, и Recraft выкатил V4.1 с качеством уровня GPT Image 2 + векторную модель.

- PriorLabs показали TabPFN-3 - предобученная эффективная модель для табличных данных до 1M строк. Веса открыты.

- Perceptron выпустил Mk1 - модель для ризонинга видео до 2 fps, отслеживает объекты между кадрами. На 80-90% дешевле флагманов.

- Poetiq представил Meta-System - API-надстройка для улучшения кодогенерации без файнтюна (буст до 30%).

- Вокруг Mythos: с его помощью взломали macOS на M5, мейнтейнер curl нашел 5 подтвержденных уязвимостей, XBOW отчитался о 91,5% на основном бенчмарке. Параллельно Microsoft показал MDASH из 100+ агентов, который на CyberGym обогнал Mythos.

- arXiv начнет банить авторов на год за невычитанные тексты от LLM.

- Supply-chain атака на TanStack. Среди пострадавших OpenSearch, Mistral AI, Guardrails AI.

- Notion запустил Developer Platform - markdown API, sync + CLI ntn.

- xAI выкатили Grok Build - coding agent в терминале, beta для SuperGrok Heavy.

- Microsoft запустил сертификацию по вайбкодингу GH-600 Agentic AI Developer. $165.

- Google выкатил на Android Contextual Suggestions - AI локально анализирует переписки, звонки, активность, геолокацию и формирует предсказания + обновили Gemini Intelligence для Android.

- Figure показала двух F.03 на Helix-02, убирающих комнату за 2 минуты, а Unitree представила GD01 - первый серийный гражданский меха-робот с кабиной для пилота.

- Конгресс начал расследование против Альтмана, а OpenAI готовит иск против Apple за недостаточное продвижение интеграции ChatGPT.

- OpenAI закроет файнтюн своих моделей к 6 января 2027.

- OpenAI предложила создать мировой орган по надзору за AI по аналогии с МАГАТЭ.

- AI увольнения продолжаются: Cisco сокращает 4000 человек, LinkedIn увольняет около 5% и тд.

- Threads получил AI-бота @meta.ai на базе Muse Spark.

- YouTube открыл Likeness Detection - можно настроить мониторинг изображений с собственным лицом.

- Business Insider пишет, что разработчики таскают приоткрытые ноуты и покупают USB-заглушки, чтобы не прерывать агентов.

- Британско-китайская Meow-Omni-1 - "ИИ-переводчик" поведения кошек: видео, звук, данные с умного ошейника.

- HTML вместо Markdown для людей - Thariq из Claude Code за пару месяцев почти отказался от .md, выложил подборку HTML-примеров с промптами.
43
🔥 20
👍 9
🎉 2
❤‍🔥 1
19 49 6.2K
avatar
Refat Talks: Tech & AI
@nobilix
15.05.2026 19:20
Вы наверное тоже давно заметили тренд "проще накодить, чем заплатить за софт".

Этот пятничный пост как раз про эту штуку (хех, реально штуку, а не только софт) - физический блокировщик отвлечений на телефоне, может слышали про такое, потому что тема не такая нишевая: у Opal 4M+ юзеров, Brick зафичерился в изданиях типа NYT, WSJ и The New Yorker. Принцип у всех одинаковый: тапаешь телефон о NFC-метку - соцсети заблокировались, тапаешь еще раз - разблокировалось. Физический барьер вместо силы воли, механика, кстати, с научным подтверждением.

Стоит это, правда, не три копейки. Brick $59 за пластиковый магнит. Opal вообще $100/год по подписке. Unpluq и Blok берут и за железку, и за подписку.

А потом один парень Али, раз такой, и сделал то же самое в опен-сорсе. Под капотом - ровно тот же Apple Family Controls API, на котором сидят все коммерческие, а железки - NFC-наклейки стоят копейки на любом маркетплейсе. А можно вообще без железки: распечатал QR-код, приклеил на холодильник - работает так же. Я затестил, физический барьер работает :)

Что умеет:
- 7 режимов: NFC, QR, таймер и гибриды
- Профили под контексты - работа, сон, учеба
- Блокирует и приложения, и сайты
- Live Activities + Dynamic Island, виджеты, Shortcuts
- Статистика, streaks, smart breaks
- Для Android от того же сообщества есть проект Switchly

В общем, может кому-то будет полезно.

А теперь, собственно, к вам вопрос: какой у вас был кейс "проще накодить, чем заплатить"? Сервисы, утилиты, приложения. Пишите в комменты, интересно)

🔥 ➕ 🔁 @nobilix
🔥 46
👍 16
7
❤‍🔥 3
🥰 1
65 137 5.1K
avatar
Refat Talks: Tech & AI
@nobilix
13.05.2026 17:06
Refat Talks: Tech & AI Фото: Кэш в LLM API. Один параметр, который может изменить всю экономику inference. На скрине сводка из эксперимента в одном из последних проектов, где используется Anthropic API, в котором кстати кэш не включен по дефолту. Собирался написать пост об этом, но наткнулся на разбор, который сделал это лучше. Сергей Нотевский написал подробную статью про экономику кэширования у разных провайдеров. В статье, помимо прочего: • почему два одинаковых запроса могут отличаться в цене в 3 раза • какие паттерны в промптинге незаметно убивают кэш • чем отличаются контракты кэширования у OpenAI, Anthropic и Gemini и почему миграция между ними роняет hit rate вдвое • как команда Manus снизила стоимость инференса в 10 раз тремя простыми практиками • почему Gemini Flash-Lite с кэшем оказывается дешевле DeepSeek в ~2.7 раза У Сергея вообще отличный канал, рекомендую подписаться @sergeinotevskii, там много практических постов, особенно на тему локальных LLM и есть другие разборы, например про проблемы большого контекстного окна. Так что воспользуюсь моментом и рекомендую канал Сергея)
К посту про кэш в LLM API подъехала новая порция полезностей, не пройти мимо.

Сергей выложил пачку статей на тему кэша в AI приложениях, я же хочу подсветить sernote/audit-prompt-caching - в этом репо Skill, который вы запускаете в своем проекте и агент проходится по реальному коду: проверяет шаблоны промптов, сборку tools и схемы, логику истории, конфиги роутинга, специфичные для провайдеров особенности (OpenAI / Anthropic / OpenRouter / vLLM). Включая пачку полезных скриптов, например статический анализатор истории LLM вызовов - что сделать чтобы улучшить попадание в кэш (= сделать AI приложение дешевле и быстрее).

Установка: npx skills add https://github.com/sernote/audit-prompt-caching --skill audit-prompt-caching

Даже просто прочитать references в репо - там краткие выжимки по каждому провайдеру со ссылками на актуальную доку. Полезность, короче.
Telegram
Refat Talks: Tech & AI
Кэш в LLM API. Один параметр, который может изменить всю экономику inference. На скрине сводка из эксперимента в одном из последних проектов, где используется Anthropic API, в котором кстати кэш не включен по дефолту. Собирался написать пост об этом, но наткнулся на разбор, который сделал это лучше. Сергей Нотевский написал подробную статью про экономику кэширования у разных провайдеров. В статье, помимо прочего: • почему два одинаковых запроса могут отличаться в цене в 3 раза • какие паттерны в промптинге незаметно убивают кэш • чем отличаются контракты кэширования у OpenAI, Anthropic и Gemini и почему миграция между ними роняет hit rate вдвое • как команда Manus снизила стоимость инференса в 10 раз тремя простыми практиками • почему Gemini Flash-Lite с кэшем оказывается дешевле DeepSeek в ~2.7 раза У Сергея вообще отличный канал, рекомендую подписаться @sergeinotevskii, там много практических постов, особенно на тему локальных LLM и есть другие разборы, например про проблемы большого контекстного окна. Так что воспользуюсь моментом и рекомендую канал Сергея)
21
🔥 13
👍 8
🎉 2
1 240 6.1K
avatar
Refat Talks: Tech & AI
@nobilix
09.05.2026 20:28
#ReDigest

Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.

Дайджест недели:

- Anthropic заключила сделку со SpaceX на 300+ МВт, по сути решив свою проблему с нехваткой компьюта. В честь этого удвоили 5-часовые лимиты Claude Pro/Max (но недельные лимиты оставили).

- OpenAI выкатила GPT-Realtime-2 - первая голосовая модель с уровнем рассуждений GPT-5. Еще вышли GPT-Realtime-Translate (70+ языков) и GPT-Realtime-Whisper. Под капотом - переработанная low-latency WebRTC-архитектура.

- Anthropic провел Code with Claude 2026 без релиза модели, но c апдейтами Claude Managed Agents и публичная бета мультиагентной оркестрации и поделились видением. И выкатили Finance Agents.

- Маск ликвидировал xAI как отдельную компанию (теперь SpaceXAI - подразделение SpaceX), и параллельно готовит собственный кодинг-агент в духе Codex и Claude Code.

- GPT-5.5 Instant вышел и стал дефолтом в ChatGPT. Сильнее vision, понимание PDF, web search и работа с памятью, меньше галлюцинирует.

- Anthropic открыла Natural Language Autoencoder - инструмент перевода активаций модели в читаемый текст. Применяли в аудите Mythos Preview. Mythos за месяц нашел больше уязвимостей в Firefox, чем разработчики за 15 месяцев.

- Google релизнул MTP-драфтеры для Gemma-4 - ускорение генерации в ~3 раза без потерь качества, опенсорс. Уже подтянули в llama.cpp - 40%+ ускорения.

- Subquadratic запустил SubQ - sparse-attention с 12М контекста и 52x ускорением по сравнению с FA2, однако исследователи требуют независимых доказательств.

- Unity выкатил Unity AI в открытую бету - встроенный агент в редакторе Unity 6 (в основном для игр).

- OpenAI выпустила Codex Chrome plugin и расширения для Excel и Google Sheets - создание таблиц с нуля, объяснение формул, форматирование. И тул для миграции из Claude Code.

- OpenAI запустила Ads Manager - бета-инструмент для самостоятельного создания рекламных кампаний в ChatGPT. Раньше закрытый пилот требовал минимум $50k расходов.

- OpenAI запускает Trusted Access for Cyber - после KYC дает доступ к менее урезанной с т.з. кибербезопастности версии 5.3 Codex.

- Perplexity раскатил Personal Computer для всех Mac-пользователей.

- Vercel запустил Deepsec - agentic тул для обнаружения сложных уязвимостей

- Бенчмарковая неделя для агентов: авторы SWE-Bench выкатили ProgramBench - агент должен воспроизвести код готовой программы. Scale опубликовал SWE Atlas Refactoring (Opus 4.7 c Claude Code лидирует), а Harvey опенсорснул Legal Agent Benchmark.

- Cloudflare сократил 1100+ сотрудников на фоне рекордной выручки в Q1, объяснили переходом на agentic AI-first.

- Китайский суд запретил увольнять сотрудников из-за внедрения AI.

- ЕС сдвинул дедлайны AI Act на 2027-2028.

- Сенат США одобрил GUARD Act: Каждый пользователь AI-чат-бота должен загрузить удостоверение, отсканировать лицо и привязать финансовые данные к реальному имени. Норма федерального приоритета перекрывает законы штатов.

- DeepSeek ведет переговоры о первом раунде внешнего финансирования: $3-4 млрд при оценке $50 млрд. Кстати, китайские ИИ-стартапы уходят из офшоров обратно в КНР.

- Telegram выкатил большое обновление: AI-боты вызываются в личных и групповых чатах через @имя, боты могут отвечать другим ботам, стриминг и др.

- Meta готовит Hatch - аналог OpenClaw (генерация изображений и видео, шопинг, обучение, интеграция в Instagram*/Facebook*)

- Posthog делает СС/Codex-подобное приложение, использующее данные продукта (паттерны, баги, ошибки в логах) как сигнал для написания кода - self-driving product loop.

- Питер Тиль вложил $140 млн в Panthalassa - автономные плавучие AI-дата-центры (энергия волн, связь по спутнику и тд).

- Gemini API: File Search теперь мультимодальный и появлились вебхуки.

- vLLM + Mooncake - если хостите агентов на vLLM, интеграция с Mooncake кэширует общие префиксы - дает почти 4x throughput и снижение задержки ответа в десятки раз.
🔥 34
19
👍 13
11 55 6.4K
* Принадлежит организации Meta, которая признана экстремистской и запрещена на территории РФ
avatar
Refat Talks: Tech & AI
@nobilix
08.05.2026 18:52
Managed Agents + Finance Agents: что Anthropic показал на примере финансов и что отсюда забрать в свои воркфлоу.

На этой неделе Anthropic выкатил 10 готовых агентов для финансовой индустрии - Pitch-агент, KYC-скринер, ревьюер отчетности и пр. Все в одном репо.

На первый взгляд - очередной вертикальный релиз под свою экосистему. На деле - первый раз, когда Anthropic публично показывает, как они сами думают про архитектуру agentic-систем в компаниях. И главное в этом релизе - новая концепция Managed Agents, которую этот репо иллюстрирует.

Две поверхности

1. Как Cowork/Claude Code плагин - аналитик руками юзает на компе.
2. Как Managed Agent - тот же промпт деплоится в облако через /v1/agents как headless-сервис, который дергается как API.

Это паттерн, который имеет смысл забрать в свои воркфлоу: одна методичка обслуживает и юзера в чате, и доступна как фоновый сервис.

Что такое Managed Agents

Это тот же агентный харнес, что бежит у тебя в Claude Code / Cowork локально, теперь таже крутится у Anthropic в managed-сервисе, а ты дергаешь его через REST + SSE.
Архитектурно - 4 примитива:
- Agent - модель + системный промпт + тулы + MCP + скиллы
- Environment - шаблон контейнера: пакеты, networking
- Session - запущенный экземпляр агента в окружении
- Events - сообщения между твоим приложением и агентом, позволяет строить свое управление или фронтенд, как часть своего софта.

Что это дает командам, строящим свои AI-воркфлоу

Главное - не строишь харнесс с нуля, а используешь SOTA-агенты. Tool dispatching, retry, prompt caching, компакция контекста, sandbox, изоляция, persistent FS - готовое. А главное, сначала строишь и тестишь локально, потом выносишь в фоновый процесс.

Open-source путь, если на своих моделях

Полного эквивалента нет. Но связки есть:
- opencode + OpenWork как обертка - локальный и cloud агент-харнеcс, любые модели.
- E2B / Daytona / Modal - sandbox-слой под исполнение кода, то, что Anthropic прячет за Environment.
- Mastra и аналоги, особенно в связи с их недавним релизом workspaces+sandboxes.

Куда это все идет

Паттерн, который я наблюдаю и уже использую в нескольких проектах: команды сначала локально собирают свой набор skills и tooling под конкретные задачи - в Claude Code, Codex, opencode - и в какой-то момент хотят вынести это в условное облако. Чтобы не на ноуте у одного человека, а как фоновый сервис, который дергается по триггеру и которым может пользоваться вся команда.
На базе готовых харнессов и сандбоксов. Очень перспективная штука.

🔥 ➕ 🔁 @nobilix
🔥 54
👍 16
7
7
❤‍🔥 1
9 330 5.9K
avatar
Refat Talks: Tech & AI
@nobilix
06.05.2026 09:27
Про outreach, сигналы и AI.

Каналы продаж делятся на inbound (клиент сам приходит через контент, рекламу и тд) и outbound (ты идешь к нему первым).
К слову, последний дает 64% пайплайна в B2B SaaS.
Аутрич - самый контролируемый канал лидгена, а еще это отличный способ лучше понять свою аудиторию.
Минус один - он всегда стоил много человеко-часов и окупался только при крупных сделках: малый бизнес, агентства, узкие ниши, side-проекты были отрезаны не из-за плохой аудитории, а из-за того, что содержать команду продаж под такие чеки невыгодно.

Я считаю, AI это сломал удешевив некоторые операции и позволив брать не объемом, а точностью попадания через фильтры и сигналы:

- Фильтр: индустрия, размер, гео, стек, и тд. Это сито на входе, фильтр статичен.

- Сигнал динамичен и имеет окно, когда он еще актуален. Например: потенциальные клиенты активно нанимают или увольняют; сменили стек/CMS/CRM; рост или падение трафика/скачиваний/рекламы/ключевиков; подняли раунд или ищут инвестиции; новый C-level в роли вашего ЛПР; контракт с конкурентом заканчивается; компания упомянула вашу тему в earnings call или на конференции; запустили продукт в новом гео и тд и тп (это я только по по касательной прошелся).

А еще сигналы стэкаются: два-три сигнала могут поднять reply rate в разы. И чем быстрее реакция, тем лучше.

Где здесь AI. Главный сдвиг последних нескольких лет: работа с фильтрами и сигналами впервые стала сильно дешеветь: добыча и интерпретация шумных публичных данных перестала быть человеко-часами, а стала API-вызовами. А еще куда проще стало использовать OSINT для этого.

Полтора года назад мы так забили календарь на Web Summit: ICP-фильтры + AI-энричмент. С тех пор техник и инструментов стало в разы больше, и за всем уследить почти невозможно, а еще там свой продуктовый мир: Clay, LeadMagic, Sales Navigator, Extruct, Lusha и тд.

К счастью, есть люди, которые в этом живут и пишут про это понятно. Когда еще рекомендовать хороший канал, как не сейчас: канал Андрея читаю года три, ни разу не пожалел, рекомендую и вам. Хороший вход - этот пост.
🔥 19
12
👍 11
❤‍🔥 1
12 81 5.4K
avatar
Refat Talks: Tech & AI
@nobilix
02.05.2026 19:00
#ReDigest

Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.

Дайджест недели:

- Anthropic подключила Claude к девяти креативным программам включая приложения Adobe, Blender, Autodesk Fusion, Ableton.

- Китайский регулятор потребовал от Meta расторгнуть сделку по покупке Manus, требуют возврата всех активов и удаления переданной информации.

- Прокачивают Codex: добавили /goal - аналог ральф-лупа, добавили вкладку Work - зачатки Cowork в Codex, голосовой ввод везде и питомцев.

- Anthropic запустила Claude Security в бете - инструмент для поиска уязвимостей и добавила Memory в Claude Managed Agents.

- WSJ сообщили что OpenAI промахнулся по своим внутренним целям на новых пользователей и выручку, риск что не сможет оплачивать compute, акции партнеров просели.

- Microsoft и OpenAI переписали условия партнерства. На фоне этого OpenAI открыла на AWS модели, Managed Agents и доступ к Codex как сервису.

- Anthropic провела эксперимент Project Deal: 69 сотрудников описали что хотят купить и продать, после чего их персональные агенты автономно вели торги (186 сделок) в Slack.

- OpenAI работает над смартфоном на базе агентов и без приложений, в партнерстве с MediaTek, Qualcomm и Luxshare.

- OpenAI раскрыла тайну гоблинов, гремлинов и енотов в GPT-5: классический reward hacking. Модель поощряла забавные сравнения существ слишком часто, пришлось даже патчить промпт Codex.

- Mistral выпустила Medium 3.5 - мультимодальная dense, редкая весовая категория.

- Xiaomi выложила MiMo V2.5 в опенсорс. Две версии: 310B-A15B (мультимодальная: изображения, аудио, видео) и Pro 1.02T-A42B. Контекст 1M.

- Alibaba раскатала HappyHorse 1.0 - text-to-video, по заявлениям опережает Seedance и Veo (независимой верификации пока нет).

- Google подписала AI-контракт с Пентагоном не смотря на письмо 600+ сотрудников с просьбой отказаться.

- Google запустила Ask YouTube - разговорный AI mode по роликам. Пока только YouTube Premium в США.

- General Motors внедряет Gemini во все автомобили.

- Apple свернула проект Vision Pro, но продолжают разработку легких смарт-очков. Еще Apple случайно слила свои CLAUDE.md.

- GitHub под давлением: Copilot переходит от подписок к usage-based (кстати хороше эссе про экономику AI). Ghostty уходят с GitHub, а исследователи фиксируют что большинство supply chain инцидентов последних 18 мес. связаны с GitHub Actions.

- Stripe на конфе Sessions анонсировал 288 апдейтов включая Agentic Commerce Suite, Link Wallet для агентов и Link CLI.

- Cloudflare автоматизировал полный цикл для агентов: регистрация аккаунта, paid subscription, покупка домена, получение API token и деплой.

- У Amazon вышел Quick - агент подключается к email, calendar, Slack и локальным файлам, помечает важное и автоматизирует.

- Spotify вводит значок 'Verified by Spotify' - галочка для подтверждения, что артист реальный человек.

- EU AI Act: трилог 28 апреля провалился - Совет и Парламент не сошлись во мнении, перенесли.

- Статья Fortune про то что AI еще дорогой: вице-президент Nvidia говорит, что для его команды compute стоит сильно дороже, чем сотрудники.

- Большая статья Wired о том, как разработчики из Кремниевой долины массово подсели на снюс (Zyn). Никотиновые пакетики используют для продуктивности, а в офисах крупных компаний типа Palantir шайбы выдают сотрудникам бесплатно.

- Warp терминал ушел в open-source, OpenAI - founding sponsor репозитория.

- Cursor SDK - TS-библиотека для запуска агентов Cursor вне IDE.

- Видео: Andrej Karpathy на Sequoia AI Ascent - разбор разницы между vibe coding и agentic engineering.

- Новый Y Combinator Requests for Startups: AI-сервисы вместо софта, замена легаси SaaS, мозг компании, операционка для бизнеса, динамические UI, чипы для агентов и др.

- Banana Pi BPI-SM10 - одноплатник за $300-400 на RISC-V с 60 TOPS, локально гоняет LLM до 30B со скоростью >10 ток/сек.

- 🤩 WenWare - GeoGuessr во времени и пространстве: AI-сгенерированные исторические панорамы 360° на GPT-Images 2, увлекает.
🔥 50
22
👍 15
4 60 6.4K
avatar
Refat Talks: Tech & AI
@nobilix
01.05.2026 13:33
Как я говорил когда-то, когда я пишу здесь посты, всегда представляю себе друга которому рассказываю что-то интересное что мне кажется полезным! Спасибо, друзья, вы лучшие!

Проголосуйте ниже за то, что вам интереснее всего читать и пишите в комменты. 🫶
🔥 40
11
🎉 10
👍 5
13 7 5.4K
avatar
Refat Talks: Tech & AI
@nobilix
29.04.2026 17:59
Remote VS Code как интерфейс для общей AI-станции: одна подписка на всех + общий воркспейс.

Одновременно в разных командах и по разным причинам возникла необходимость поднять общую "AI-рабочую станцию" - мотивы немного разные, но суть одинаковая: нужно общее пространство, чтобы сотрудники имели доступ к одним и тем же файлам (знаниям/проектам) с разных рабочих машин и переиспользовали одни и те же AI агенты.

Мне хотелось найти способ, который в работе потянут в том числе и не-технари. Расскажу, как круто эту проблему решает VS Code, к слову, давно использую его не только для кодинга - для документов, заметок, таблиц. С нативными расширениями Claude Code и Codex UX в чате сильно приятнее CLI.

Основной принцип простой:

1) мы берем linux-сервер (VPS) под эту задачу
2) раздаем к нему доступ по SSH кому нужно (один раз)
3) в VS Code ставим Remote-SSH расширение и коннектимся, откроется окно VS Code подключенное уже к серверу
4) Дальше все, что вы делаете в IDE, будет выполняться на сервере: ставите расширение CC или Codex, логинитесь в подписку как обычно (но ключи уже хранятся на сервере), работете с файлами - все там и доступно тому, кто имеет защищенный доступ к серверу.

Эдакая модель тонкого клиента и мейнфрейма. И это удобно.

Что еще можно:

- vscode.dev + Remote Tunnel позволит подключиться с любого браузера, логинишься через GitHub по защищенному каналу. Работает также с телефона (можно добавить как PWA).
- можно упаковать в Docker контейнер как песочницу, если сервер не выделенный и заодно ограничить blast radius, чтобы сложно было напортачить.
- можно подцепить общую папку на компы через Syncthing/SSHFS и тд - чтобы файлы были и локально.
- можно пойти еще дальше и завести per-user Linux-аккаунты, а подписку шарить через симлинк ~/.claude -> /srv/ai/claude с общей группой.

В сухом остатке: с точки зрения подписки это технически одно устройство, один deviceId, но на практике причины не столько в экономии, сколько в том, что это оказалось удобно: VS Code и без AI - мощная штука с кучей расширений для документов, таблиц и PDF, файлы тегаются прямо в чат, при адекватном коннекте работает почти как локально. Подходит не всем, но если ваш кейс - пробуйте. Поддержите пост, если интересно больше про тему совместного использования AI, есть что рассказать.

🔥 ➕ 🔁 @nobilix
🔥 94
19
👍 19
2
35 277 6.7K
avatar
Refat Talks: Tech & AI
@nobilix
25.04.2026 20:14
#ReDigest

Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.

Дайджест недели:

- OpenAI выпустила GPT-5.5 - новый флагман для агентов. Цены $5/$30 за миллион токенов, контекст 1M. Заметно лучше токен-эффективность, высокие показатели terminal bench.

- DeepSeek показала V4 - Pro и Flash версии, контекст 1M токенов, расходует почти в 4 раза меньше вычислений и в 10 раз меньше памяти, чем V3.2 - сильный технический релиз, но нет мультимодальности и высокие галлюцинации.

- OpenAI представила GPT-Image-2 - новый image-флагман с режимом thinking. Лучше рендеринг текста, верстка, мультиязычность.

- Moonshot выкатила Kimi K2.6 - семейство из четырех моделей. По SWE-bench Multilingual и BrowseComp обходит GPT-5.4 и Opus 4.6.

- Qwen выпустили сразу две модели: dense Qwen3.6-27B (топ среди не MoE) и Qwen3.6-Max-Preview с упором на agentic coding и instruction following.

- Anthropic финансово штурмует мир: акции торгуются на Forge с оценкой $1T (выше OpenAI), Google инвестирует до $40 млрд, а Amazon добавил $13 млрд.

- OpenAI представила Workspace Agents - эволюцию GPTs на базе Codex в облаке. Совместное использование внутри организации.

- OpenAI выкатили ChatGPT for Clinicians и бета-релиз аддонов ChatGPT для Excel и Google Sheets.

- WSJ расследовали что инвесторы обсуждают увольнение Сэма Альтмана. Параллельно Маск подал иск к OpenAI и Microsoft на $150 млрд.

- xAI запустили Grok Voice - голосовая модель для агентов. 25 языков включая русский, 5 голосов. Tool calling с web/x/file_search.

- OpenAI Privacy Filter - открытая легковесная модель для детекции и редакции PII в тексте. Быстрая, локальная, контекстно-зависимая.

- Google: AI Studio теперь работает с подписками Google AI Pro/Ultra (без API-ключа), запустили Workspace Intelligence - semantic layer над почтой, чатами, файлами и проектами для Gemini-агентов, и Enterprise Agent Platform - инструменты для построения корпоративных агентов + релиз Deep Research Max и опенсорнули DESIGN.md.

- Еще теперь Google свой code-red: собрали "ударную группу" внутри DeepMind по прокачке кодинга в Gemini. Триггер - свежие релизы Anthropic.

- Безос привлекает $10 млрд в свой стартап Project Prometheus. Цель - "Physical AI".

- Sakana представила Fugu - первый коммерческий продукт известной японской лабы. Маленькая LLM, обученная вызывать другие LLM. Еще предложила метод повышения "креативности" на счет рандомной строки в начале.

- Vercel взломали. Добрались до некоторых переменных окружения. Продается дамп за $2 млн.

- Маск запустил XChat - отдельный мессенджер: сквозное шифрование, без рекламы и трекинга, групповые чаты и видеозвонки.

- Claude Cowork стал доступен на сторонней инфраструктуре - AWS Bedrock, MS Foundry, Google Vertex AI или любой gateway, можно подключать не-Anthropic модели.

- Zapier показали AutomationBench - бенчмарк реальной автоматизации - ни одна модель не пересекла планку в 10%.

- Anthropic опубликовали детальный постмортем за март-апрель: рассказали как и когда они закручивали гайки для экономии компьюта (это приводило к деградации) и когда вернули как было, + как они будут предотвращать такое в будущем.

- Важный прецедент в суде США: AI-чаты не защищены адвокатской тайной - федеральный судья обязал выдать доки из чата с Claude. 12+ крупных юрфирм выпустили предупреждения клиентам.

- В Science вышла статья о том как именно AI может массово влиять на выборы угрожая демократии.

- Статья в Fortune: опросили 6000 руководителей - ИИ пока не так заметен в статистике производительности, статья склоняется что это типичный отложенный эффект (похожий на Парадокс Солоу).

- Cloudflare рассказала про свой стек AI разработки: много деталей и цифр.
33
🔥 22
👍 10
👏 5
3 67 6.9K

Refat Talks: Tech & AI

11.4K
Заметки про технологии, GenAI и глобал стартапы, прагматично и без лишнего хайпа. Эксперт по разработке и внедрению enterprise-grade AI автоматизаций, строю AI-first компании. Co-founder devstark.com и spreadsimple.com
лс @refatametov
Открыть в Telegram