Refat Talks: Tech & AI
@nobilix
#ReDigest
Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.
Дайджест недели:
- Anthropic запустила Agent Skills для Claude - по сути, папки с инструкциями, скриптами и ресурсами, которые модель подгружает когда нужно. Работает везде: в приложениях, Claude Code и через API. Есть готовые навыки для Excel, PowerPoint, Word, PDF.
- Google выпустил новую speech-2-speech модель Gemini 2.5 Native Audio. "Размышляющая" версия вышла на 1 место по бенчам + realtime версия с минимальной задержкой.
- Nvidia начала поставки "компактного суперкомпьютера" DGX Spark за $4k. Внутри супер-чип GB10 с 20-ядерным Arm-процессором Grace, GPU Blackwell и 128GB общей памяти. Позволяет выполнять инференс моделей с 200В параметров.
- Вышла Veo 3.1 с улучшенной гибкостью и контролируемостью. Можно редактировать: убирать элементы из сцены или дорисовывать прямо в кадр. Доступна загрузка референсов для сохранения стиля, персонажей, одежды. Звук естественнее, липсинк лучше. Добавили Scene Extension для продолжения видео с последних кадров.
- Apple анонсирует процессор M5 для 14-дюймового MacBook Pro, iPad Pro и Vision Pro. Neural Accelerator ускоряет AI-задачи в 3.5 раза, GPU быстрее M4 на ~30%. Цены прежние, старт продаж - 22 октября.
- Anthropic представила Claude Haiku 4.5 - по производительности в коде близка к Sonnet 4, но в 2+ раза быстрее и втрое дешевле.
- n8n выпустили AI Workflow Builder в бете. AI собирает черновой вариант флоу через чат: добавляет ноды, связывает шаги, код не нужен. Пока только в облаке, для self-hosted решения нет.
- Gemini теперь работает с Google Maps. Разработчики могут подключить ИИ к данным о 250+ миллионах мест. Можно комбинировать карты и поиск в одном запросе.
- Вышла Qwen3 VL в размерах 4B и 8B. Есть Instruct и Thinking. Несмотря на размер, кое-где обгоняют Gemini 2.5 Flash Lite и GPT-5 Nano. Почти дотянули до уровня Qwen2.5-VL-72B - можно делать такие штуки.
- Manus AI обновился до версии 1.5. Скорость выросла в 4 раза, добавили безлимитный контекст, совместную работу и Library для хранения артефактов. Заявляют поддержку создания production-ready full-stack приложений с одного промпта.
- Gemini 3.0 начали тестировать на ограниченном наборе пользователей. В твиттере мелькают впечатляющие демки.
- Slack запустил новую платформу для AI-агентов с Real-Time Search API и MCP server. Партнеры OpenAI, Anthropic, Google, Perplexity, Dropbox, Notion уже интегрировали свои AI. Заявляют ускорение принятия решений на 37% и экономию ~97 минут в неделю.
- Cloudflare выпустили Sandbox SDK для безопасного запуска кода AI-агентами. Можно выполнять команды, управлять файлами, запускать сервисы.
- Kayak запускает "AI Mode" для путешествий. Можно задавать вопросы, сравнивать и бронировать рейсы, отели, машины через AI-чатбот. Использует интеграцию с ChatGPT.
- Неплохой обзор более 50 современных бенчмарков, сгруппированных в четыре ключевые категории. Полезно для понимания ландшафта оценки моделей.
- Андрей Карпатый выкатил в опенсорс nanochat - простой клон ChatGPT. Всего 8k строк кода, минимум зависимостей. Запускаете один скрипт на облачном GPU, и через 4 часа общаетесь с собственной LLM. Плюс c Карпатым вышло большое интервью.
Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.
Дайджест недели:
- Anthropic запустила Agent Skills для Claude - по сути, папки с инструкциями, скриптами и ресурсами, которые модель подгружает когда нужно. Работает везде: в приложениях, Claude Code и через API. Есть готовые навыки для Excel, PowerPoint, Word, PDF.
- Google выпустил новую speech-2-speech модель Gemini 2.5 Native Audio. "Размышляющая" версия вышла на 1 место по бенчам + realtime версия с минимальной задержкой.
- Nvidia начала поставки "компактного суперкомпьютера" DGX Spark за $4k. Внутри супер-чип GB10 с 20-ядерным Arm-процессором Grace, GPU Blackwell и 128GB общей памяти. Позволяет выполнять инференс моделей с 200В параметров.
- Вышла Veo 3.1 с улучшенной гибкостью и контролируемостью. Можно редактировать: убирать элементы из сцены или дорисовывать прямо в кадр. Доступна загрузка референсов для сохранения стиля, персонажей, одежды. Звук естественнее, липсинк лучше. Добавили Scene Extension для продолжения видео с последних кадров.
- Apple анонсирует процессор M5 для 14-дюймового MacBook Pro, iPad Pro и Vision Pro. Neural Accelerator ускоряет AI-задачи в 3.5 раза, GPU быстрее M4 на ~30%. Цены прежние, старт продаж - 22 октября.
- Anthropic представила Claude Haiku 4.5 - по производительности в коде близка к Sonnet 4, но в 2+ раза быстрее и втрое дешевле.
- n8n выпустили AI Workflow Builder в бете. AI собирает черновой вариант флоу через чат: добавляет ноды, связывает шаги, код не нужен. Пока только в облаке, для self-hosted решения нет.
- Gemini теперь работает с Google Maps. Разработчики могут подключить ИИ к данным о 250+ миллионах мест. Можно комбинировать карты и поиск в одном запросе.
- Вышла Qwen3 VL в размерах 4B и 8B. Есть Instruct и Thinking. Несмотря на размер, кое-где обгоняют Gemini 2.5 Flash Lite и GPT-5 Nano. Почти дотянули до уровня Qwen2.5-VL-72B - можно делать такие штуки.
- Manus AI обновился до версии 1.5. Скорость выросла в 4 раза, добавили безлимитный контекст, совместную работу и Library для хранения артефактов. Заявляют поддержку создания production-ready full-stack приложений с одного промпта.
- Gemini 3.0 начали тестировать на ограниченном наборе пользователей. В твиттере мелькают впечатляющие демки.
- Slack запустил новую платформу для AI-агентов с Real-Time Search API и MCP server. Партнеры OpenAI, Anthropic, Google, Perplexity, Dropbox, Notion уже интегрировали свои AI. Заявляют ускорение принятия решений на 37% и экономию ~97 минут в неделю.
- Cloudflare выпустили Sandbox SDK для безопасного запуска кода AI-агентами. Можно выполнять команды, управлять файлами, запускать сервисы.
- Kayak запускает "AI Mode" для путешествий. Можно задавать вопросы, сравнивать и бронировать рейсы, отели, машины через AI-чатбот. Использует интеграцию с ChatGPT.
- Неплохой обзор более 50 современных бенчмарков, сгруппированных в четыре ключевые категории. Полезно для понимания ландшафта оценки моделей.
- Андрей Карпатый выкатил в опенсорс nanochat - простой клон ChatGPT. Всего 8k строк кода, минимум зависимостей. Запускаете один скрипт на облачном GPU, и через 4 часа общаетесь с собственной LLM. Плюс c Карпатым вышло большое интервью.
🔥 42
❤ 15
🙏 2
13 55 6.1K
Обсуждение 13
Обсуждение не доступно в веб-версии. Чтобы написать комментарий, перейдите в приложение Telegram.
Обсудить в Telegram