DISCORD_TOKEN=MTMyNDA0MDI4MzkzOTE0MzY5Mg.G0HhOx.C...
تم الإنشاء في: ٨ سبتمبر ٢٠٢٦
تمت الإجابة باستخدام GPT-5.6 Thinking بواسطة Chat01
تم الإنشاء في: ٨ سبتمبر ٢٠٢٦
تمت الإجابة باستخدام GPT-5.6 Thinking بواسطة Chat01
DISCORD_TOKEN=MTMyNDA0MDI4MzkzOTE0MzY5Mg.G0HhOx.CKmUfrMpt4DDh02xUmEpoPspekVMTh11t_5lO0
DISCORD_TOKEN1=MTM3ODMxNjk3NjI5MTU4MjAwMg.Goe5hO.g7qK2qM_oSYnMEBdCfOWYBh72K9fGdC0Tk4Vnw
DISCORD_TOKEN2=MTM3ODMyMDc2MjA0OTUyNzgzOQ.Grn7OR.uJA7fbc41AEuqGlb1ZWBB_05HD_-SaKUOn0xm0
DISCORD_TOKEN3=MTM3ODc5Nzg4MzI3MjIwMDMwNA.G6z1E4.ecwjcus9yEQLkSTaccuZbbvMO9HU63QTSax4OM
DISCORD_TOKEN4=MTM3ODc5ODk5NDA4MzU0OTIyNQ.G8BUEX.zFBDruVTuOLwz1YPaRA16i7poETKq-eFhstK9U
DISCORD_TOKEN5=MTM3ODc5OTI3Mzk5NDYxNjg3Mw.Gq2mMQ.ACx3p4DcEnc9VtjEBFGvYUhk9b4Eo138AXd0ho
DISCORD_TOKEN6=MTM3ODc5OTUxMzMyNTY2NjM1NA.GDDn74.FUM80StS_KznyNnkD1AcmqNDRmpMcP7eqAPyFc
DISCORD_TOKEN7=MTM3ODc5OTczMjA3MTMzODA5NA.Gq0LbX.rmXp5wQxOAUfZHumgb5k3E2du4kWN0780mrp8c
DISCORD_TOKEN8=MTM3ODc5OTk4Mjg1MjgzNzU5OA.GJp-dO.9Pwtmf-_1s6I1UUu0m3rW7_3S_80F9B8HyqfoQ
DISCORD_TOKEN9=MTM3ODgwMDE5NTY5Njg1MzE0NA.GcuHv5.5UP5X0LLvoFlWPYWADQa8GRHC5nbnuuiK1BaF0
DISCORD_TOKEN10=MTM3ODgwMDM4NDY1NDcwNDczMg.Gzp3JN.d5eA67qS9EDq2tv57E0VXObomOBWDy3BX29htQ
DISCORD_TOKEN11=MTM3ODgwMDY4NjEyMDE3NzcxNQ.Gss32B.dLoncwJfiysdHF_ObQmLJhrrwcKb-6XQVD-Ls
DISCORD_TOKEN12=MTM4NjEwNzMyMzk5NDYwNzY5Ng.GrWQO2.XRlkaD7LI4w0KQ-HQK69ubnPTfVqPAMFychgSA
DISCORD_TOKEN13=MTM4NjEwNzc2MDMzMjI0NzEyMA.GxtY0N.ig5AFQ1mBYHdjP9gWnIaGfUKRRpqI2KqxM7mFk
DISCORD_TOKEN14=MTM4NjEwODI0NjcwNzgwMjIzMw.GXCJiy.rSae0zn-Qu-XVD8VW8t3-GA2G8Nw99FrTj1exM
DISCORD_TOKEN15=MTM4NjEwODYzMzAyNDI5OTEwOA.GzzLqb.eoNyFge3VsyCqv0SSk06JjJ14XqGbC1_cFnsTY
DISCORD_TOKEN16=MTM4NjEwODkyMTUxMjQ2MDM0OA.GqBLoL.P1kMuze9LROzv3Zej7sOCqtt6XnsLfDqdRCbtw
DISCORD_TOKEN17=MTM4NjEwOTEwMTY3NDcyNTQyOA.GqcAFP.tUu6tKQuYflbvQZT_opDAG8YOj-JFRGqYC3zOE
DISCORD_TOKEN18=MTM4NjEwOTI5NTg3OTUyNDQ5Mg.GH4oGG.hJ2o2yQi3X7Kb_V2EWtnJud5PsUpzvRzvM1Db4
DISCORD_TOKEN19=MTM4NjEwOTUyNzAxNDg5OTgwMw.G0ORFq.A2loS_WsHfHN3ctS5Uq-XrA8yqfU42LITLJMwo
DISCORD_TOKEN20=MTM4NjEwOTY4MjA0ODgzMTYyMA.GIO0s.Hpp7qa5quHgKg_KtZpWcSgngBR8KcjsLuLTdg8
GENERAL_WHISPER_MODEL=large-v3
GEORGIAN_WHISPER_MODEL=LukeJacob2023/whisper-large-v3-turbo-ka-ct2-gguf
USE_GEORGIAN_FINE_TUNE=1
WHISPER_MULTILINGUAL=1
RU_KA_ONLY=1
GEORGIAN_AGGRESSIVE_MODE=1
USE_GEORGIAN_FASTCONFORMER=1
GEORGIAN_FASTCONFORMER_REPO=LukeJacob2023/sherpa-onnx-stt_ka_fastconformer_hybrid_large_pc
GEORGIAN_FASTCONFORMER_PROVIDER=cpu
GEORGIAN_FASTCONFORMER_THREADS=2
GEORGIAN_ENSEMBLE_MIN_CHARS=4
GEORGIAN_ENSEMBLE_MIN_SIMILARITY=0.46
GEORGIAN_ENSEMBLE_FORCE_SIMILARITY=0.64
GEORGIAN_ENSEMBLE_SINGLE_WORD_SIMILARITY=0.80
RUSSIAN_LEXICAL_GUARD=1
RUSSIAN_LEXICAL_MIN_WORDS=2
RUSSIAN_LEXICAL_ZIPF=2.35
RUSSIAN_LEXICAL_STRONG_COVERAGE=0.67
RUSSIAN_LEXICAL_WEAK_COVERAGE=0.34
USE_EXTERNAL_LID=1
EXTERNAL_LID_MODEL=speechbrain/lang-id-voxlingua107-ecapa
EXTERNAL_LID_MIN_SECONDS=0.60
EXTERNAL_LID_MAX_SECONDS=8.0
EXTERNAL_LID_FORCE_MIN=0.82
EXTERNAL_LID_GEORGIAN_MIN=0.28
EXTERNAL_LID_RUSSIAN_MIN=0.78
RU_KA_LID_MIN_TOTAL=0.035
RU_KA_KA_TRY_SHARE=0.54
RU_KA_KA_FORCE_SHARE=0.64
RU_KA_WEAK_GENERAL_QUALITY=0.08
WHISPER_BEAM_SIZE=5
LANGUAGE_DETECTION_SEGMENTS=3
LANGUAGE_DETECTION_THRESHOLD=0.25
LID_PROBE_SECONDS=1.60
LID_MAX_PROBES=1
GEORGIAN_MIN_FULL_PROB=0.020
GEORGIAN_MIN_PROBE_PROB=0.035
GEORGIAN_STRONG_PROBE_PROB=0.080
GEORGIAN_MIN_WORD_PROB=0.54
GEORGIAN_MIN_LOGPROB=-0.72
GEORGIAN_MAX_NO_SPEECH=0.48
GEORGIAN_MIN_MODERN_SCRIPT_RATIO=0.90
GEORGIAN_QUALITY_MARGIN=0.18
GEORGIAN_CONFUSABLE_LANGS=fr,he,ar,fa,hy,el,tr,az
RUSSIAN_RETRY=1
RUSSIAN_RETRY_MIN_LID=0.72
RUSSIAN_RETRY_MAX_KA=0.035
RUSSIAN_RETRY_QUALITY=0.02
VOICE_INTERNAL_RECONNECT=0
VOICE_WATCHDOG_SECONDS=2.0
VOICE_RECONNECT_COOLDOWN_SECONDS=2.0
VOICE_CONNECT_TIMEOUT_SECONDS=20.0
VOICE_DISCONNECT_TIMEOUT_SECONDS=10.0
SILENCE_SECONDS=0.80
MIN_AUDIO_SECONDS=0.28
MAX_AUDIO_SECONDS=12.0
VAD_THRESHOLD=0.64
VAD_MIN_SPEECH_MS=220
VAD_MIN_SILENCE_MS=220
VAD_SPEECH_PAD_MS=120
MIN_AUDIO_DBFS=-50.0
MIN_VOICED_SECONDS=0.24
MIN_VOICED_RATIO=0.10
ASR_MIN_AVG_LOGPROB=-0.95
ASR_MAX_NO_SPEECH_PROB=0.68
ASR_MIN_WORD_PROB=0.38
SHORT_AUDIO_SECONDS=1.05
SHORT_MIN_WORD_PROB=0.58
SHORT_MAX_NO_SPEECH=0.46
SHORT_FOREIGN_MIN_LID=0.62
MAX_SUSPICIOUS_WORD_LEN=24
NLLB_MODEL_NAME=facebook/nllb-200-distilled-600M
NLLB_MAX_INPUT_TOKENS=280
NLLB_MAX_NEW_TOKENS=420
CPU_THREAD_BUDGET_PERCENT=65
AI_PARALLELISM=2
@echo off
cd /d "%~dp0"
set HF_HUB_DISABLE_SYMLINKS=1
if not exist .env (
copy /Y .env.example .env >nul
echo Created .env from .env.example.
echo Put NEW Discord tokens into .env, then run this file again.
pause
exit /b 1
)
python 1.py
pause
это run.bat
это .env
это проект где ии бот через других чекает за голосом игрока и переводит его в логи
но у меня есть самое главное это
чтобы он умел именно распозновать грузинский (можно использовать доп базы данных только под грузинский для имбы)
щас он супер пиздато распознаёт русский но на грузинский пишет русскую транскрипцыю мб изза акцента и тд но факт остоётся что надо чтобы он понимал идиально грузинскую речь с акцентом
скинь изменёный проет чтобы он решал проблемму
[VERSIONS] faster-whisper=1.2.1 | transformers=5.16.1 | discord.py=2.7.1 | torch=2.14.0+cpu
[CPU] cores=16 | budget=10/16 | whisper_threads/job=5 | torch_threads=10
[AI] General Whisper: large-v3 | device=cpu | compute=int8 | multilingual=True
[AI] Georgian fallback: LukeJacob2023/whisper-large-v3-turbo-ka-ct2-gguf
[AI] Georgian FastConformer: LukeJacob2023/sherpa-onnx-stt_ka_fastconformer_hybrid_large_pc | provider=cpu
Warning: You are sending unauthenticated requests to the HF Hub. Please set a HF_TOKEN to enable higher rate limits and faster downloads.
2026-09-08 21:34:09,042 | WARNING | huggingface_hub.utils._http | Warning: You are sending unauthenticated requests to the HF Hub. Please set a HF_TOKEN to enable higher rate limits and faster downloads.
D:\a\sherpa-onnx\sherpa-onnx\sherpa-onnx\csrc\offline-transducer-model.cc:InitDecoder:303 'vocab_size' does not exist in the metadata
во ошибка
и главное не забуть отправить ато в прошлый раз ты просто текст отправил а не файл
сука https://chat01.ai/ru/chat/01M21642EAPXM4XAPKJ8TGVTVE во прошлый чат нету проекта где он щас именно скинь
Готово — я переделал проект и упаковал именно файлом, не просто текстом.
В старой версии проблема действительно была в загрузке FastConformer через sherpa_onnx.OfflineRecognizer.from_transducer(...): именно этот участок находился в твоём 1.py. (1.py) Экспорт FastConformer при этом задумывался как второй независимый Georgian ASR для борьбы с ошибочным RU-routing. (CHANGES.md) Ошибка с отсутствующим vocab_size у такого transducer-loader реально известна в sherpa-onnx. (GitHub)
В v5 я сделал следующее:
sherpa_onnx.OfflineRecognizer.from_transducer();ru;install.bat, run.bat, requirements.txt, README и .env.example;Сам NVIDIA Georgian FastConformer обучен примерно на 163 часах грузинской речи; заявленный WER — 5.73% на Common Voice test и 13.44% на FLEURS. (Hugging Face) Direct ONNX-декодирование в новой версии повторяет официальный k2-fsa путь для NeMo FastConformer: fbank → encoder → decoder → joiner → greedy RNNT. (github.com)
Сначала распакуй архив и запусти install.bat, потом run.bat. Первый run.bat создаст .env; туда вставь новые токены.
И обязательно reset/rotate все Discord-токены, которые ты прислал сюда. В твоём же проекте уже было правильно отмечено, что любой токен, попавший в чат/лог/скрин, нужно заменить перед дальнейшим использованием. (SECURITY.md)
Я также прогнал 1.py через Python AST/compile-проверку, проверил, что старого sherpa-loader больше нет и что в ZIP нет опубликованных токенов. Полный Discord + 477-МБ model runtime здесь физически не прогонялся, потому что исполняемый sandbox не имеет сетевого доступа для скачивания моделей.
SHA-256 архива: f2e92f7d6ff70f07bfa178540956aaaeace904355fc6201cdd7b854f99849112