DISCORD_TOKEN=MTMyNDA0MDI4MzkzOTE0MzY5Mg.G0HhOx.C...

Создано: 8 сентября 2026 г.

Отвечено с использованием GPT-5.6 Thinking от Chat01

Вопрос

FORK_RATIONALE.md
install.bat
README_RU.md
requirements.txt
1.py
CHANGES.md
THIRD_PARTY_MODELS.md
SECURITY.md

DISCORD_TOKEN=MTMyNDA0MDI4MzkzOTE0MzY5Mg.G0HhOx.CKmUfrMpt4DDh02xUmEpoPspekVMTh11t_5lO0
DISCORD_TOKEN1=MTM3ODMxNjk3NjI5MTU4MjAwMg.Goe5hO.g7qK2qM_oSYnMEBdCfOWYBh72K9fGdC0Tk4Vnw
DISCORD_TOKEN2=MTM3ODMyMDc2MjA0OTUyNzgzOQ.Grn7OR.uJA7fbc41AEuqGlb1ZWBB_05HD_-SaKUOn0xm0
DISCORD_TOKEN3=MTM3ODc5Nzg4MzI3MjIwMDMwNA.G6z1E4.ecwjcus9yEQLkSTaccuZbbvMO9HU63QTSax4OM
DISCORD_TOKEN4=MTM3ODc5ODk5NDA4MzU0OTIyNQ.G8BUEX.zFBDruVTuOLwz1YPaRA16i7poETKq-eFhstK9U
DISCORD_TOKEN5=MTM3ODc5OTI3Mzk5NDYxNjg3Mw.Gq2mMQ.ACx3p4DcEnc9VtjEBFGvYUhk9b4Eo138AXd0ho
DISCORD_TOKEN6=MTM3ODc5OTUxMzMyNTY2NjM1NA.GDDn74.FUM80StS_KznyNnkD1AcmqNDRmpMcP7eqAPyFc
DISCORD_TOKEN7=MTM3ODc5OTczMjA3MTMzODA5NA.Gq0LbX.rmXp5wQxOAUfZHumgb5k3E2du4kWN0780mrp8c
DISCORD_TOKEN8=MTM3ODc5OTk4Mjg1MjgzNzU5OA.GJp-dO.9Pwtmf-_1s6I1UUu0m3rW7_3S_80F9B8HyqfoQ
DISCORD_TOKEN9=MTM3ODgwMDE5NTY5Njg1MzE0NA.GcuHv5.5UP5X0LLvoFlWPYWADQa8GRHC5nbnuuiK1BaF0
DISCORD_TOKEN10=MTM3ODgwMDM4NDY1NDcwNDczMg.Gzp3JN.d5eA67qS9EDq2tv57E0VXObomOBWDy3BX29htQ
DISCORD_TOKEN11=MTM3ODgwMDY4NjEyMDE3NzcxNQ.Gss32B.dLoncwJfiysdHF_ObQmLJhrrwcKb-6XQVD-Ls
DISCORD_TOKEN12=MTM4NjEwNzMyMzk5NDYwNzY5Ng.GrWQO2.XRlkaD7LI4w0KQ-HQK69ubnPTfVqPAMFychgSA
DISCORD_TOKEN13=MTM4NjEwNzc2MDMzMjI0NzEyMA.GxtY0N.ig5AFQ1mBYHdjP9gWnIaGfUKRRpqI2KqxM7mFk
DISCORD_TOKEN14=MTM4NjEwODI0NjcwNzgwMjIzMw.GXCJiy.rSae0zn-Qu-XVD8VW8t3-GA2G8Nw99FrTj1exM
DISCORD_TOKEN15=MTM4NjEwODYzMzAyNDI5OTEwOA.GzzLqb.eoNyFge3VsyCqv0SSk06JjJ14XqGbC1_cFnsTY
DISCORD_TOKEN16=MTM4NjEwODkyMTUxMjQ2MDM0OA.GqBLoL.P1kMuze9LROzv3Zej7sOCqtt6XnsLfDqdRCbtw
DISCORD_TOKEN17=MTM4NjEwOTEwMTY3NDcyNTQyOA.GqcAFP.tUu6tKQuYflbvQZT_opDAG8YOj-JFRGqYC3zOE
DISCORD_TOKEN18=MTM4NjEwOTI5NTg3OTUyNDQ5Mg.GH4oGG.hJ2o2yQi3X7Kb_V2EWtnJud5PsUpzvRzvM1Db4
DISCORD_TOKEN19=MTM4NjEwOTUyNzAxNDg5OTgwMw.G0ORFq.A2loS_WsHfHN3ctS5Uq-XrA8yqfU42LITLJMwo
DISCORD_TOKEN20=MTM4NjEwOTY4MjA0ODgzMTYyMA.GIO0s
.Hpp7qa5quHgKg_KtZpWcSgngBR8KcjsLuLTdg8

RU / KA ASR

GENERAL_WHISPER_MODEL=large-v3
GEORGIAN_WHISPER_MODEL=LukeJacob2023/whisper-large-v3-turbo-ka-ct2-gguf
USE_GEORGIAN_FINE_TUNE=1
WHISPER_MULTILINGUAL=1
RU_KA_ONLY=1

v4 Georgian accuracy mode

GEORGIAN_AGGRESSIVE_MODE=1
USE_GEORGIAN_FASTCONFORMER=1
GEORGIAN_FASTCONFORMER_REPO=LukeJacob2023/sherpa-onnx-stt_ka_fastconformer_hybrid_large_pc
GEORGIAN_FASTCONFORMER_PROVIDER=cpu
GEORGIAN_FASTCONFORMER_THREADS=2
GEORGIAN_ENSEMBLE_MIN_CHARS=4
GEORGIAN_ENSEMBLE_MIN_SIMILARITY=0.46
GEORGIAN_ENSEMBLE_FORCE_SIMILARITY=0.64
GEORGIAN_ENSEMBLE_SINGLE_WORD_SIMILARITY=0.80

Protect good Russian recognition from false KA switching

RUSSIAN_LEXICAL_GUARD=1
RUSSIAN_LEXICAL_MIN_WORDS=2
RUSSIAN_LEXICAL_ZIPF=2.35
RUSSIAN_LEXICAL_STRONG_COVERAGE=0.67
RUSSIAN_LEXICAL_WEAK_COVERAGE=0.34

Independent language ID

USE_EXTERNAL_LID=1
EXTERNAL_LID_MODEL=speechbrain/lang-id-voxlingua107-ecapa
EXTERNAL_LID_MIN_SECONDS=0.60
EXTERNAL_LID_MAX_SECONDS=8.0
EXTERNAL_LID_FORCE_MIN=0.82
EXTERNAL_LID_GEORGIAN_MIN=0.28
EXTERNAL_LID_RUSSIAN_MIN=0.78
RU_KA_LID_MIN_TOTAL=0.035
RU_KA_KA_TRY_SHARE=0.54
RU_KA_KA_FORCE_SHARE=0.64
RU_KA_WEAK_GENERAL_QUALITY=0.08

Whisper routing

WHISPER_BEAM_SIZE=5
LANGUAGE_DETECTION_SEGMENTS=3
LANGUAGE_DETECTION_THRESHOLD=0.25
LID_PROBE_SECONDS=1.60
LID_MAX_PROBES=1
GEORGIAN_MIN_FULL_PROB=0.020
GEORGIAN_MIN_PROBE_PROB=0.035
GEORGIAN_STRONG_PROBE_PROB=0.080
GEORGIAN_MIN_WORD_PROB=0.54
GEORGIAN_MIN_LOGPROB=-0.72
GEORGIAN_MAX_NO_SPEECH=0.48
GEORGIAN_MIN_MODERN_SCRIPT_RATIO=0.90
GEORGIAN_QUALITY_MARGIN=0.18
GEORGIAN_CONFUSABLE_LANGS=fr,he,ar,fa,hy,el,tr,az
RUSSIAN_RETRY=1
RUSSIAN_RETRY_MIN_LID=0.72
RUSSIAN_RETRY_MAX_KA=0.035
RUSSIAN_RETRY_QUALITY=0.02

Voice reconnect / watchdog

VOICE_INTERNAL_RECONNECT=0
VOICE_WATCHDOG_SECONDS=2.0
VOICE_RECONNECT_COOLDOWN_SECONDS=2.0
VOICE_CONNECT_TIMEOUT_SECONDS=20.0
VOICE_DISCONNECT_TIMEOUT_SECONDS=10.0

Audio / VAD

SILENCE_SECONDS=0.80
MIN_AUDIO_SECONDS=0.28
MAX_AUDIO_SECONDS=12.0
VAD_THRESHOLD=0.64
VAD_MIN_SPEECH_MS=220
VAD_MIN_SILENCE_MS=220
VAD_SPEECH_PAD_MS=120
MIN_AUDIO_DBFS=-50.0
MIN_VOICED_SECONDS=0.24
MIN_VOICED_RATIO=0.10

ASR filtering

ASR_MIN_AVG_LOGPROB=-0.95
ASR_MAX_NO_SPEECH_PROB=0.68
ASR_MIN_WORD_PROB=0.38
SHORT_AUDIO_SECONDS=1.05
SHORT_MIN_WORD_PROB=0.58
SHORT_MAX_NO_SPEECH=0.46
SHORT_FOREIGN_MIN_LID=0.62
MAX_SUSPICIOUS_WORD_LEN=24

Translation Georgian -> Russian

NLLB_MODEL_NAME=facebook/nllb-200-distilled-600M
NLLB_MAX_INPUT_TOKENS=280
NLLB_MAX_NEW_TOKENS=420

Performance

CPU_THREAD_BUDGET_PERCENT=65
AI_PARALLELISM=2
@echo off
cd /d "%~dp0"
set HF_HUB_DISABLE_SYMLINKS=1
if not exist .env (
copy /Y .env.example .env >nul
echo Created .env from .env.example.
echo Put NEW Discord tokens into .env, then run this file again.
pause
exit /b 1
)
python 1.py
pause

это run.bat

это .env

это проект где ии бот через других чекает за голосом игрока и переводит его в логи
но у меня есть самое главное это
чтобы он умел именно распозновать грузинский (можно использовать доп базы данных только под грузинский для имбы)
щас он супер пиздато распознаёт русский но на грузинский пишет русскую транскрипцыю мб изза акцента и тд но факт остоётся что надо чтобы он понимал идиально грузинскую речь с акцентом
скинь изменёный проет чтобы он решал проблемму

щас это ьыл промт старый но ии бот не запустился чекни ошибки и есле он не будет идейно выполнять промт переделай логику коороче сделай чтобы он выполнял условия выше и работалЗагрузка локальных AI-моделей...

[VERSIONS] faster-whisper=1.2.1 | transformers=5.16.1 | discord.py=2.7.1 | torch=2.14.0+cpu
[CPU] cores=16 | budget=10/16 | whisper_threads/job=5 | torch_threads=10
[AI] General Whisper: large-v3 | device=cpu | compute=int8 | multilingual=True
[AI] Georgian fallback: LukeJacob2023/whisper-large-v3-turbo-ka-ct2-gguf
[AI] Georgian FastConformer: LukeJacob2023/sherpa-onnx-stt_ka_fastconformer_hybrid_large_pc | provider=cpu
Warning: You are sending unauthenticated requests to the HF Hub. Please set a HF_TOKEN to enable higher rate limits and faster downloads.
2026-09-08 21:34:09,042 | WARNING | huggingface_hub.utils._http | Warning: You are sending unauthenticated requests to the HF Hub. Please set a HF_TOKEN to enable higher rate limits and faster downloads.
D:\a\sherpa-onnx\sherpa-onnx\sherpa-onnx\csrc\offline-transducer-model.cc:InitDecoder:303 'vocab_size' does not exist in the metadata
во ошибка

Мысль

Packaged fixed Discord translator ZIP without cache files

Worked for 5m 40s

Ответ

Готово. Я переделал проект и собрал исправленную v5:

[Скачать discord_ru_ka_v5_fixed.zip]

Главная причина твоего падения была именно в старом Georgian FastConformer loader: 1.py пытался открыть encoder/decoder/joiner.onnx через OfflineRecognizer.from_transducer() (1.py), а этот экспорт не содержит обязательную transducer metadata vocab_size. Такой же класс ошибки зафиксирован у sherpa-onnx; причём она возникает в нативном C++ коде, поэтому обычный Python try/except не всегда спасает процесс. (GitHub)

В новой сборке:

  • полностью убран runtime-запуск сломанного FastConformer;
  • основной русский остаётся на large-v3;
  • грузинский всегда получает отдельный forced-ka проход через Georgian fine-tune;
  • добавлен независимый Omnilingual ASR CTC v2 300M INT8, который официально поддерживается через OfflineRecognizer.from_omnilingual_asr_ctc() и поддерживает Georgian kat_Geor; (GitHub)
  • Georgian Whisper + CTC сравниваются между собой;
  • если общий Whisper написал русскую фонетическую кашу, а два грузинских пути согласны — выбирается грузинский;
  • отдельно исправлен случай короткой грузинской фразы / одного слова, где старый алгоритм слишком легко оставлял кириллицу;
  • сохранён wordfreq-guard, чтобы нормальный русский не начал массово определяться как грузинский;
  • если auxiliary CTC не скачался, остаётся forced-ka fallback через обычный large-v3;
  • добавлены .env.example, исправленный run.bat, install.bat, новые диагностики и инструкция.

Проверил 1.py через py_compile, проверил структуру проекта и отдельно прогнал поиск секретов — присланных Discord-токенов в архиве нет. Полный живой Discord/ASR тест здесь выполнить не могу, потому что для него нужны твои Discord-боты и реальные RU/KA голосовые записи.

Запуск: распакуй архив → install.batrun.bat → он создаст .env → вставь туда новые токены → снова run.bat. Старые токены обязательно сбрось: сам исходный проект тоже прямо предупреждает, что опубликованный token надо ротировать. (SECURITY.md)

При нормальном старте теперь должна появиться строка примерно Georgian auxiliary CTC: READY, а старой ошибки 'vocab_size' does not exist in the metadata быть уже не должно.

SHA-256 архива: 2da0000c7c43fc8b73caa8da863d9d0157cc1764bb6184a021e8ac8b50a4bf02.

Поделиться этим Q&A