PROJEKTY / Timbre
Timbre
KLIENT
Timbre
ROK
2026
USŁUGI
Projektowanie produktu
CZAS TRWANIA
1 miesiąc
Timbre to infrastruktura głosowego AI, synteza mowy i głosowi agenci czasu rzeczywistego, z warstwą obserwowalności pod spodem. Klienci to zespoły inżynierskie wdrażające produkty głosowe, agentów wsparcia, IVR i narrację długoformatową, którym zależy na szybkim dźwięku i wiedzy, dlaczego czasem go zabraknie.
PROBLEM
Produkty głosowe zawodzą przez opóźnienia, nie funkcje
Nikt nie rezygnuje z powodu brakującego ustawienia, tylko przez ciszę, zanim odezwie się agent. A opóźnienie trafia do panelu jako jedna uśredniona liczba, p50, która mówi, że coś jest wolne, ale nie mówi co.
- Brak nagrania do odsłuchania, brak czasów poszczególnych etapów, brak sposobu, by przypisać opóźnienie do kolejki, modelu czy sieci
- p50 na dashboardzie to wyrok bez dowodów, więc inżynier musi zgadywać
- Kolor dobierano pod nastrój, więc każdy wykres i przebieg fali niósł barwy pozbawione znaczenia
- Marka i dane rozjeżdżały się przy każdej zmianie jednego z nich, bez legendy, która pozwoliłaby je odczytać
PODEJŚCIE
Spraw, by paleta stała się legendą
System kolorystyczny to jedna, chłodna rodzina barw rozpisana na dziesięć kroków, od głębokiego granatu po blady aqua, gdzie pozycja na skali koduje natężenie. Te same tokeny, które budują markę, renderują każdy przebieg fali, spektrogram i wykres w produkcie. Kolor przestaje być ozdobą i staje się kluczem do danych. Na tej podstawie czas do pierwszego dźwięku rozbito na pięć mierzonych etapów w każdej odpowiedzi, zamiast uśredniać go w jedną liczbę. Każdy głos ma swój sygnaturowy odcisk generowany z własnej nazwy, dzięki czemu czternaście głosów pozostaje rozróżnialnych na pierwszy rzut oka i każdy jest śledzony osobno. Aplikacja mobilna została ograniczona do dwóch rzeczy, w których telefon jest lepszy od desktopu, alertów i odsłuchu, zamiast być portem z dashboardu.
WPŁYW
Od liczby do przyczyny
76%
Udziału opóźnienia namierzonego do jednego etapu, widoczny od razu
100%
Wizualizacji w produkcie tworzonych na bazie tokenów marki
0%
Rozbieżności pomiędzy danymi na ośmiu powierzchniach produktu
Miarą takiego systemu jest to, do czego pozwala dojść. Sesja oznaczona jako 604 ms sama w sobie nic nie mówi. Rozbita na pięć etapów, od razu się wyjaśnia, kolejka 38, normalizacja 22, inferencja 421, wokoder 96, wyjście 27. Wobec mediany 148 ms, której etapy sumują się do 12, 18, 74, 33 i 11, inferencja modelu działa 5,7 raza wolniej niż zwykle i odpowiada za 76 procent nadwyżki. Ponieważ każdy słupek, komórka i wypełnienie renderują się przez tę samą skalę, zmiana jednego elementu przesuwa markę, stronę marketingową i każdą wizualizację razem. Paleta została przebudowana w połowie projektu, z ciepłego spektrum na chłodne, i ani jeden wykres nie wymagał przerysowania.






