Refat Talks: Tech & AI
@nobilix
#ReDigest
Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.
Дайджест недели:
- OpenAI выпустила GPT-5.5 - новый флагман для агентов. Цены $5/$30 за миллион токенов, контекст 1M. Заметно лучше токен-эффективность, высокие показатели terminal bench.
- DeepSeek показала V4 - Pro и Flash версии, контекст 1M токенов, расходует почти в 4 раза меньше вычислений и в 10 раз меньше памяти, чем V3.2 - сильный технический релиз, но нет мультимодальности и высокие галлюцинации.
- OpenAI представила GPT-Image-2 - новый image-флагман с режимом thinking. Лучше рендеринг текста, верстка, мультиязычность.
- Moonshot выкатила Kimi K2.6 - семейство из четырех моделей. По SWE-bench Multilingual и BrowseComp обходит GPT-5.4 и Opus 4.6.
- Qwen выпустили сразу две модели: dense Qwen3.6-27B (топ среди не MoE) и Qwen3.6-Max-Preview с упором на agentic coding и instruction following.
- Anthropic финансово штурмует мир: акции торгуются на Forge с оценкой $1T (выше OpenAI), Google инвестирует до $40 млрд, а Amazon добавил $13 млрд.
- OpenAI представила Workspace Agents - эволюцию GPTs на базе Codex в облаке. Совместное использование внутри организации.
- OpenAI выкатили ChatGPT for Clinicians и бета-релиз аддонов ChatGPT для Excel и Google Sheets.
- WSJ расследовали что инвесторы обсуждают увольнение Сэма Альтмана. Параллельно Маск подал иск к OpenAI и Microsoft на $150 млрд.
- xAI запустили Grok Voice - голосовая модель для агентов. 25 языков включая русский, 5 голосов. Tool calling с web/x/file_search.
- OpenAI Privacy Filter - открытая легковесная модель для детекции и редакции PII в тексте. Быстрая, локальная, контекстно-зависимая.
- Google: AI Studio теперь работает с подписками Google AI Pro/Ultra (без API-ключа), запустили Workspace Intelligence - semantic layer над почтой, чатами, файлами и проектами для Gemini-агентов, и Enterprise Agent Platform - инструменты для построения корпоративных агентов + релиз Deep Research Max и опенсорнули
- Еще теперь Google свой code-red: собрали "ударную группу" внутри DeepMind по прокачке кодинга в Gemini. Триггер - свежие релизы Anthropic.
- Безос привлекает $10 млрд в свой стартап Project Prometheus. Цель - "Physical AI".
- Sakana представила Fugu - первый коммерческий продукт известной японской лабы. Маленькая LLM, обученная вызывать другие LLM. Еще предложила метод повышения "креативности" на счет рандомной строки в начале.
- Vercel взломали. Добрались до некоторых переменных окружения. Продается дамп за $2 млн.
- Маск запустил XChat - отдельный мессенджер: сквозное шифрование, без рекламы и трекинга, групповые чаты и видеозвонки.
- Claude Cowork стал доступен на сторонней инфраструктуре - AWS Bedrock, MS Foundry, Google Vertex AI или любой gateway, можно подключать не-Anthropic модели.
- Zapier показали AutomationBench - бенчмарк реальной автоматизации - ни одна модель не пересекла планку в 10%.
- Anthropic опубликовали детальный постмортем за март-апрель: рассказали как и когда они закручивали гайки для экономии компьюта (это приводило к деградации) и когда вернули как было, + как они будут предотвращать такое в будущем.
- Важный прецедент в суде США: AI-чаты не защищены адвокатской тайной - федеральный судья обязал выдать доки из чата с Claude. 12+ крупных юрфирм выпустили предупреждения клиентам.
- В Science вышла статья о том как именно AI может массово влиять на выборы угрожая демократии.
- Статья в Fortune: опросили 6000 руководителей - ИИ пока не так заметен в статистике производительности, статья склоняется что это типичный отложенный эффект (похожий на Парадокс Солоу).
- Cloudflare рассказала про свой стек AI разработки: много деталей и цифр.
Продолжаем субботнюю рубрику, тут я кратко рассказываю про новости из мира технологий и AI, которые привлекли мое внимание.
Дайджест недели:
- OpenAI выпустила GPT-5.5 - новый флагман для агентов. Цены $5/$30 за миллион токенов, контекст 1M. Заметно лучше токен-эффективность, высокие показатели terminal bench.
- DeepSeek показала V4 - Pro и Flash версии, контекст 1M токенов, расходует почти в 4 раза меньше вычислений и в 10 раз меньше памяти, чем V3.2 - сильный технический релиз, но нет мультимодальности и высокие галлюцинации.
- OpenAI представила GPT-Image-2 - новый image-флагман с режимом thinking. Лучше рендеринг текста, верстка, мультиязычность.
- Moonshot выкатила Kimi K2.6 - семейство из четырех моделей. По SWE-bench Multilingual и BrowseComp обходит GPT-5.4 и Opus 4.6.
- Qwen выпустили сразу две модели: dense Qwen3.6-27B (топ среди не MoE) и Qwen3.6-Max-Preview с упором на agentic coding и instruction following.
- Anthropic финансово штурмует мир: акции торгуются на Forge с оценкой $1T (выше OpenAI), Google инвестирует до $40 млрд, а Amazon добавил $13 млрд.
- OpenAI представила Workspace Agents - эволюцию GPTs на базе Codex в облаке. Совместное использование внутри организации.
- OpenAI выкатили ChatGPT for Clinicians и бета-релиз аддонов ChatGPT для Excel и Google Sheets.
- WSJ расследовали что инвесторы обсуждают увольнение Сэма Альтмана. Параллельно Маск подал иск к OpenAI и Microsoft на $150 млрд.
- xAI запустили Grok Voice - голосовая модель для агентов. 25 языков включая русский, 5 голосов. Tool calling с web/x/file_search.
- OpenAI Privacy Filter - открытая легковесная модель для детекции и редакции PII в тексте. Быстрая, локальная, контекстно-зависимая.
- Google: AI Studio теперь работает с подписками Google AI Pro/Ultra (без API-ключа), запустили Workspace Intelligence - semantic layer над почтой, чатами, файлами и проектами для Gemini-агентов, и Enterprise Agent Platform - инструменты для построения корпоративных агентов + релиз Deep Research Max и опенсорнули
DESIGN.md.- Еще теперь Google свой code-red: собрали "ударную группу" внутри DeepMind по прокачке кодинга в Gemini. Триггер - свежие релизы Anthropic.
- Безос привлекает $10 млрд в свой стартап Project Prometheus. Цель - "Physical AI".
- Sakana представила Fugu - первый коммерческий продукт известной японской лабы. Маленькая LLM, обученная вызывать другие LLM. Еще предложила метод повышения "креативности" на счет рандомной строки в начале.
- Vercel взломали. Добрались до некоторых переменных окружения. Продается дамп за $2 млн.
- Маск запустил XChat - отдельный мессенджер: сквозное шифрование, без рекламы и трекинга, групповые чаты и видеозвонки.
- Claude Cowork стал доступен на сторонней инфраструктуре - AWS Bedrock, MS Foundry, Google Vertex AI или любой gateway, можно подключать не-Anthropic модели.
- Zapier показали AutomationBench - бенчмарк реальной автоматизации - ни одна модель не пересекла планку в 10%.
- Anthropic опубликовали детальный постмортем за март-апрель: рассказали как и когда они закручивали гайки для экономии компьюта (это приводило к деградации) и когда вернули как было, + как они будут предотвращать такое в будущем.
- Важный прецедент в суде США: AI-чаты не защищены адвокатской тайной - федеральный судья обязал выдать доки из чата с Claude. 12+ крупных юрфирм выпустили предупреждения клиентам.
- В Science вышла статья о том как именно AI может массово влиять на выборы угрожая демократии.
- Статья в Fortune: опросили 6000 руководителей - ИИ пока не так заметен в статистике производительности, статья склоняется что это типичный отложенный эффект (похожий на Парадокс Солоу).
- Cloudflare рассказала про свой стек AI разработки: много деталей и цифр.
❤ 33
🔥 22
👍 10
👏 5
3 67 6.9K
Обсуждение 3
Обсуждение не доступно в веб-версии. Чтобы написать комментарий, перейдите в приложение Telegram.
Обсудить в Telegram