Лечим Dictation
Мой Wispr Flow чет совсем испортился, а вот встроенный диктейшн в Codex App – очень хорош. Но сделать нормально, чтобы он работал по всей системе (
пост) у openai так и не получилось – у меня стабильно теряет результат
Психанул, раздебажил Codex App (благо написан на электроне), нашел internal url и параметры запроса, и воткнул его как
новую модель в Handy – опенсорсный аналог Wispr Flow
Кастомные эндпоинты в Handy прописывать нельзя, так что он был быстренько клонирован и запатчен
Промпт для повторения:
Сделай кастомный Handy с моделью `Codex Dictation`.
Важно знать заранее:
Endpoint:
POST https://chatgpt.com/backend-api/transcribe
Auth читать кодом из локального Codex:
~/.codex/auth.json
Поля:
- tokens.access_token → `Authorization: Bearer ...`
- tokens.account_id → `ChatGPT-Account-Id: ...`, если есть
- refresh_token и id_token не использовать
Headers:
- originator: codex_desktop
- User-Agent: Codex Desktop/26.611.62324
Body:
multipart/form-data
- file: audio bytes, audio/wav, filename handy.wav
- language: optional; `auto` не отправлять; `zh-Hans/zh-Hant` → `zh`
Response:
```json
{ "text": "..." }
```
Склонируй github.com/cjpais/handy, найди, что в нем поменять, чтобы нативно встроить Codex Dictation в список моделей, собери приложение и установи
Так Handy будет мимикрировать под вызов из Codex App
Для работы нужен аутентифицированный codex (берем его секреты)
Disclaimer: это может являться нарушением ToS OpenAI, хотя мы тут просто получаем сервис, который нам обещают (если используем локально)
@ai_grably
Обсуждение 64
Обсуждение не доступно в веб-версии. Чтобы написать комментарий, перейдите в приложение Telegram.
Обсудить в Telegram