DISCORD_TOKEN=MTMyNDA0MDI4MzkzOTE0MzY5Mg.G0HhOx.C...
Created on: September 8, 2026
Answered using GPT-5.6 Thinking by Chat01
Created on: September 8, 2026
Answered using GPT-5.6 Thinking by Chat01
DISCORD_TOKEN=MTMyNDA0MDI4MzkzOTE0MzY5Mg.G0HhOx.CKmUfrMpt4DDh02xUmEpoPspekVMTh11t_5lO0
DISCORD_TOKEN1=MTM3ODMxNjk3NjI5MTU4MjAwMg.Goe5hO.g7qK2qM_oSYnMEBdCfOWYBh72K9fGdC0Tk4Vnw
DISCORD_TOKEN2=MTM3ODMyMDc2MjA0OTUyNzgzOQ.Grn7OR.uJA7fbc41AEuqGlb1ZWBB_05HD_-SaKUOn0xm0
DISCORD_TOKEN3=MTM3ODc5Nzg4MzI3MjIwMDMwNA.G6z1E4.ecwjcus9yEQLkSTaccuZbbvMO9HU63QTSax4OM
DISCORD_TOKEN4=MTM3ODc5ODk5NDA4MzU0OTIyNQ.G8BUEX.zFBDruVTuOLwz1YPaRA16i7poETKq-eFhstK9U
DISCORD_TOKEN5=MTM3ODc5OTI3Mzk5NDYxNjg3Mw.Gq2mMQ.ACx3p4DcEnc9VtjEBFGvYUhk9b4Eo138AXd0ho
DISCORD_TOKEN6=MTM3ODc5OTUxMzMyNTY2NjM1NA.GDDn74.FUM80StS_KznyNnkD1AcmqNDRmpMcP7eqAPyFc
DISCORD_TOKEN7=MTM3ODc5OTczMjA3MTMzODA5NA.Gq0LbX.rmXp5wQxOAUfZHumgb5k3E2du4kWN0780mrp8c
DISCORD_TOKEN8=MTM3ODc5OTk4Mjg1MjgzNzU5OA.GJp-dO.9Pwtmf-_1s6I1UUu0m3rW7_3S_80F9B8HyqfoQ
DISCORD_TOKEN9=MTM3ODgwMDE5NTY5Njg1MzE0NA.GcuHv5.5UP5X0LLvoFlWPYWADQa8GRHC5nbnuuiK1BaF0
DISCORD_TOKEN10=MTM3ODgwMDM4NDY1NDcwNDczMg.Gzp3JN.d5eA67qS9EDq2tv57E0VXObomOBWDy3BX29htQ
DISCORD_TOKEN11=MTM3ODgwMDY4NjEyMDE3NzcxNQ.Gss32B.dLoncwJfiysdHF_ObQmLJhrrwcKb-6XQVD-Ls
DISCORD_TOKEN12=MTM4NjEwNzMyMzk5NDYwNzY5Ng.GrWQO2.XRlkaD7LI4w0KQ-HQK69ubnPTfVqPAMFychgSA
DISCORD_TOKEN13=MTM4NjEwNzc2MDMzMjI0NzEyMA.GxtY0N.ig5AFQ1mBYHdjP9gWnIaGfUKRRpqI2KqxM7mFk
DISCORD_TOKEN14=MTM4NjEwODI0NjcwNzgwMjIzMw.GXCJiy.rSae0zn-Qu-XVD8VW8t3-GA2G8Nw99FrTj1exM
DISCORD_TOKEN15=MTM4NjEwODYzMzAyNDI5OTEwOA.GzzLqb.eoNyFge3VsyCqv0SSk06JjJ14XqGbC1_cFnsTY
DISCORD_TOKEN16=MTM4NjEwODkyMTUxMjQ2MDM0OA.GqBLoL.P1kMuze9LROzv3Zej7sOCqtt6XnsLfDqdRCbtw
DISCORD_TOKEN17=MTM4NjEwOTEwMTY3NDcyNTQyOA.GqcAFP.tUu6tKQuYflbvQZT_opDAG8YOj-JFRGqYC3zOE
DISCORD_TOKEN18=MTM4NjEwOTI5NTg3OTUyNDQ5Mg.GH4oGG.hJ2o2yQi3X7Kb_V2EWtnJud5PsUpzvRzvM1Db4
DISCORD_TOKEN19=MTM4NjEwOTUyNzAxNDg5OTgwMw.G0ORFq.A2loS_WsHfHN3ctS5Uq-XrA8yqfU42LITLJMwo
DISCORD_TOKEN20=MTM4NjEwOTY4MjA0ODgzMTYyMA.GIO0s.Hpp7qa5quHgKg_KtZpWcSgngBR8KcjsLuLTdg8
GENERAL_WHISPER_MODEL=large-v3
GEORGIAN_WHISPER_MODEL=LukeJacob2023/whisper-large-v3-turbo-ka-ct2-gguf
USE_GEORGIAN_FINE_TUNE=1
WHISPER_MULTILINGUAL=1
RU_KA_ONLY=1
GEORGIAN_AGGRESSIVE_MODE=1
USE_GEORGIAN_FASTCONFORMER=1
GEORGIAN_FASTCONFORMER_REPO=LukeJacob2023/sherpa-onnx-stt_ka_fastconformer_hybrid_large_pc
GEORGIAN_FASTCONFORMER_PROVIDER=cpu
GEORGIAN_FASTCONFORMER_THREADS=2
GEORGIAN_ENSEMBLE_MIN_CHARS=4
GEORGIAN_ENSEMBLE_MIN_SIMILARITY=0.46
GEORGIAN_ENSEMBLE_FORCE_SIMILARITY=0.64
GEORGIAN_ENSEMBLE_SINGLE_WORD_SIMILARITY=0.80
RUSSIAN_LEXICAL_GUARD=1
RUSSIAN_LEXICAL_MIN_WORDS=2
RUSSIAN_LEXICAL_ZIPF=2.35
RUSSIAN_LEXICAL_STRONG_COVERAGE=0.67
RUSSIAN_LEXICAL_WEAK_COVERAGE=0.34
USE_EXTERNAL_LID=1
EXTERNAL_LID_MODEL=speechbrain/lang-id-voxlingua107-ecapa
EXTERNAL_LID_MIN_SECONDS=0.60
EXTERNAL_LID_MAX_SECONDS=8.0
EXTERNAL_LID_FORCE_MIN=0.82
EXTERNAL_LID_GEORGIAN_MIN=0.28
EXTERNAL_LID_RUSSIAN_MIN=0.78
RU_KA_LID_MIN_TOTAL=0.035
RU_KA_KA_TRY_SHARE=0.54
RU_KA_KA_FORCE_SHARE=0.64
RU_KA_WEAK_GENERAL_QUALITY=0.08
WHISPER_BEAM_SIZE=5
LANGUAGE_DETECTION_SEGMENTS=3
LANGUAGE_DETECTION_THRESHOLD=0.25
LID_PROBE_SECONDS=1.60
LID_MAX_PROBES=1
GEORGIAN_MIN_FULL_PROB=0.020
GEORGIAN_MIN_PROBE_PROB=0.035
GEORGIAN_STRONG_PROBE_PROB=0.080
GEORGIAN_MIN_WORD_PROB=0.54
GEORGIAN_MIN_LOGPROB=-0.72
GEORGIAN_MAX_NO_SPEECH=0.48
GEORGIAN_MIN_MODERN_SCRIPT_RATIO=0.90
GEORGIAN_QUALITY_MARGIN=0.18
GEORGIAN_CONFUSABLE_LANGS=fr,he,ar,fa,hy,el,tr,az
RUSSIAN_RETRY=1
RUSSIAN_RETRY_MIN_LID=0.72
RUSSIAN_RETRY_MAX_KA=0.035
RUSSIAN_RETRY_QUALITY=0.02
VOICE_INTERNAL_RECONNECT=0
VOICE_WATCHDOG_SECONDS=2.0
VOICE_RECONNECT_COOLDOWN_SECONDS=2.0
VOICE_CONNECT_TIMEOUT_SECONDS=20.0
VOICE_DISCONNECT_TIMEOUT_SECONDS=10.0
SILENCE_SECONDS=0.80
MIN_AUDIO_SECONDS=0.28
MAX_AUDIO_SECONDS=12.0
VAD_THRESHOLD=0.64
VAD_MIN_SPEECH_MS=220
VAD_MIN_SILENCE_MS=220
VAD_SPEECH_PAD_MS=120
MIN_AUDIO_DBFS=-50.0
MIN_VOICED_SECONDS=0.24
MIN_VOICED_RATIO=0.10
ASR_MIN_AVG_LOGPROB=-0.95
ASR_MAX_NO_SPEECH_PROB=0.68
ASR_MIN_WORD_PROB=0.38
SHORT_AUDIO_SECONDS=1.05
SHORT_MIN_WORD_PROB=0.58
SHORT_MAX_NO_SPEECH=0.46
SHORT_FOREIGN_MIN_LID=0.62
MAX_SUSPICIOUS_WORD_LEN=24
NLLB_MODEL_NAME=facebook/nllb-200-distilled-600M
NLLB_MAX_INPUT_TOKENS=280
NLLB_MAX_NEW_TOKENS=420
CPU_THREAD_BUDGET_PERCENT=65
AI_PARALLELISM=2
@echo off
cd /d "%~dp0"
set HF_HUB_DISABLE_SYMLINKS=1
if not exist .env (
copy /Y .env.example .env >nul
echo Created .env from .env.example.
echo Put NEW Discord tokens into .env, then run this file again.
pause
exit /b 1
)
python 1.py
pause
это run.bat
это .env
это проект где ии бот через других чекает за голосом игрока и переводит его в логи
но у меня есть самое главное это
чтобы он умел именно распозновать грузинский (можно использовать доп базы данных только под грузинский для имбы)
щас он супер пиздато распознаёт русский но на грузинский пишет русскую транскрипцыю мб изза акцента и тд но факт остоётся что надо чтобы он понимал идиально грузинскую речь с акцентом
скинь изменёный проет чтобы он решал проблемму
[VERSIONS] faster-whisper=1.2.1 | transformers=5.16.1 | discord.py=2.7.1 | torch=2.14.0+cpu
[CPU] cores=16 | budget=10/16 | whisper_threads/job=5 | torch_threads=10
[AI] General Whisper: large-v3 | device=cpu | compute=int8 | multilingual=True
[AI] Georgian fallback: LukeJacob2023/whisper-large-v3-turbo-ka-ct2-gguf
[AI] Georgian FastConformer: LukeJacob2023/sherpa-onnx-stt_ka_fastconformer_hybrid_large_pc | provider=cpu
Warning: You are sending unauthenticated requests to the HF Hub. Please set a HF_TOKEN to enable higher rate limits and faster downloads.
2026-09-08 21:34:09,042 | WARNING | huggingface_hub.utils._http | Warning: You are sending unauthenticated requests to the HF Hub. Please set a HF_TOKEN to enable higher rate limits and faster downloads.
D:\a\sherpa-onnx\sherpa-onnx\sherpa-onnx\csrc\offline-transducer-model.cc:InitDecoder:303 'vocab_size' does not exist in the metadata
во ошибка
и главное не забуть отправить ато в прошлый раз ты просто текст отправил а не файл
Готово. Я собрал исправленный проект v5 и реально положил его в архив:
[Скачать исправленный проект ZIP]
SHA256 checksum
Главный баг был именно здесь: твой код открывал Georgian FastConformer через OfflineRecognizer.from_transducer() без model_type, поэтому sherpa-onnx использовал обычный transducer loader. (1.py) Но NVIDIA Georgian FastConformer — это NeMo Hybrid RNNT/CTC-модель, а sherpa-onnx для NeMo требует model_type="nemo_transducer". Именно отсутствие этого параметра связано с ошибкой vocab_size does not exist in the metadata. (Hugging Face) Причём твоя закреплённая версия sherpa-onnx==1.13.7 уже поддерживает параметр model_type. (requirements.txt) (raw.githubusercontent.com)
В архиве я сделал следующее:
model_type=nemo_transducer.greedy_search — для NeMo transducer это более безопасный вариант.0.42 / 0.60 / 0.72 вместо 0.46 / 0.64 / 0.80..env.example.run.bat.self_test.py, который до загрузки тяжёлых моделей проверяет Python-файл и поддержку model_type в sherpa.FIX_NOTES_RU.txt с объяснением фикса.1.py через py_compile — синтаксических ошибок нет.Запускай так: распакуй архив → install.bat → run.bat → он создаст .env → вставь новые Discord-токены → снова run.bat. При нормальном старте должна появиться строка вроде Georgian FastConformer ... model_type=nemo_transducer, а старой ошибки с vocab_size уже быть не должно.
Очень важно: все Discord-токены, которые ты прислал выше, теперь нужно перевыпустить. Не используй их повторно — токен, попавший в чат, надо считать скомпрометированным. Это же правило уже было указано в твоём проекте. (SECURITY.md)
Полный запуск моделей в моей среде проверить невозможно, потому что здесь не установлены твои sherpa-onnx, faster-whisper и discord.py; поэтому я проверил код статически и сверил конкретный фикс с API именно sherpa-onnx 1.13.7.