AI и грабли
@oestick
4 33 2.8K
Там есть еще несколько крутых:
- про поверхности атаки на агентные системы и способы защиты от них
- про сложности работы AI систем с русским языком от рисерчера с лингвистическим бэкграундом (мы с ней на афтерпати забрали чью-то гитару и развлекали народ песнями, хах)
- и про кастомный сетап для AI разработки от Кости Доронина
↑ Это не про субагентов, это прям полноценные чаты
↑ Я думал, что это типичный твиттер шитпостинга, но реально начал видеть вокруг себя серьезных людей, кто так считает. Мол, раз у Бориса в антропике получается, то и мы так должны делать
npm install -g pi-agent
pi install git:github.com/toolittlecakes/pi-gemini-audio-readВообще, забавно, как вдохновляют задачки, у которых в целом нет существующего решения (по крайней мере публичного). Ощущение, что оказываешься на землях, где "ни ступала нога человека"
Codex, сходи через мой браузер на hf и подними мне vLLM на h200 с <model-name> на <context-len> токенов максимального контекста с <concurrency-num> параллельных запросов. Посмотри в документации и на реддите рекомендации по конфигам и проверь, что мои требования вообще выполнимы или предложи трейдоф
scale_to_zero_timeout=20)
request_user_question. Он и раньше был, но работал только в режима планирования, которым я не пользуюсь[features]
default_mode_request_user_input = trueAGENTS.md):Ты сам автономно идешь до результата, пока путь ожидаемый. Если уперся в неожиданную проблему – не нужно скрытно костылить воркэраунд. Правильно – объяснить проблему и дать варианты ее решения (и обхода). Иначе – будем ходить костыльными путями, а пользователь даже не будет в курсе
Сделай кастомный Handy с моделью `Codex Dictation`.
Важно знать заранее:
Endpoint:
POST https://chatgpt.com/backend-api/transcribe
Auth читать кодом из локального Codex:
~/.codex/auth.json
Поля:
- tokens.access_token → `Authorization: Bearer ...`
- tokens.account_id → `ChatGPT-Account-Id: ...`, если есть
- refresh_token и id_token не использовать
Headers:
- originator: codex_desktop
- User-Agent: Codex Desktop/26.611.62324
Body:
multipart/form-data
- file: audio bytes, audio/wav, filename handy.wav
- language: optional; `auto` не отправлять; `zh-Hans/zh-Hant` → `zh`
Response:
```json
{ "text": "..." }
```
Склонируй github.com/cjpais/handy, найди, что в нем поменять, чтобы нативно встроить Codex Dictation в список моделей, собери приложение и установиDisclaimer: это может являться нарушением ToS OpenAI, хотя мы тут просто получаем сервис, который нам обещают (если используем локально)