From b4e335d72022d884e070012ea34387809e695cb1 Mon Sep 17 00:00:00 2001 From: avi Date: Tue, 22 Sep 2026 10:38:34 -0500 Subject: [PATCH] Model registry: Large v3 speed label corrected to measured ~0.3-0.4x real-time (CPU int8 quiet-machine benchmark Sep 22: 0.27x on 300s, 0.43x on 1200s; prior '~1x' was optimistic) --- backend/shonar/services/ai/model_registry.py | 2 +- 1 file changed, 1 insertion(+), 1 deletion(-) diff --git a/backend/shonar/services/ai/model_registry.py b/backend/shonar/services/ai/model_registry.py index f12ca7a..0d42420 100644 --- a/backend/shonar/services/ai/model_registry.py +++ b/backend/shonar/services/ai/model_registry.py @@ -53,7 +53,7 @@ SUPPORTED_TRANSCRIPTION_MODELS: dict[str, TranscriptionModelInfo] = { "~3 GB once; slow on CPU — best on machines with 16 GB+ RAM.", params="~1.5B", approx_memory="~10 GB RAM", - relative_speed="~1x real-time (CPU)", + relative_speed="~0.3–0.4x real-time (CPU)", ), }