Analiza rozmów¶
Cel¶
Moduł zamienia rozmowę głosową lub spotkanie w sprawdzalne rezultaty: transkrypt, notatkę, decyzje, zobowiązania, pytania otwarte, sygnały jakości i zadania. Nie jest narzędziem do rzekomego „czytania emocji” ani automatycznej oceny wartości pracownika.
Karta modułu¶
| Pole | Kontrakt |
|---|---|
| Odpowiedzialności | segmentacja, diarization, transkrypcja, redakcja, ekstrakcja faktów/decyzji/tasks, QA i follow-up draft. |
| Wejścia | audio/video artifact, roster/consent metadata, agenda, słownik domenowy, polityka retencji. |
| Wyjścia | transcript versions, speaker map, summary, actions, uncertainty report, quality scorecard. |
| Zależności | ASR, vision opcjonalnie, Memory Core, Artifact Store, Calendar/Task adapters. |
| Uprawnienia | analiza artefaktu; zapis tasków, wysłanie notatki i pamięć długoterminowa osobno. |
| Autonomia | może tworzyć drafty i kandydackie zadania; nie przypisuje konsekwencji HR bez człowieka. |
| Walidacja | timestamp sampling, names/amounts/dates, source links, consent scope, human correction loop. |
| Awaria | zachowanie audio według polityki, oznaczenie fragmentów niepewnych, brak fałszywego kompletnego protokołu. |
Pipeline¶
Audio jest normalizowane bez nadpisania źródła. VAD i diarization tworzą segmenty. ASR generuje transcript z confidence i alternatywami dla nazw/liczb. Redaktor danych maskuje ustalone klasy. Ekstraktor tworzy kandydackie obiekty: decision, action, question, risk i fact. Każdy obiekt linkuje do zakresu czasu w źródle. Summarizer pracuje na zwalidowanym transkrypcie, nie na samym audio bez możliwości śledzenia.
Rozmowy telefoniczne¶
Analiza może mierzyć: powód kontaktu, czas do rozwiązania, liczbę transferów, zgodność wymaganych informacji, źródło odpowiedzi, wynik i follow-up. Nie należy automatycznie wnioskować cech wrażliwych, stanu zdrowia psychicznego ani „kłamstwa” z tonu głosu. Sentiment jest słabym sygnałem kontekstowym i powinien być prezentowany jako niepewna heurystyka, nie fakt.
Spotkania¶
Przed spotkaniem Norbi może przygotować agendę i kontekst. W trakcie zapisuje znaczniki i pytania, jeśli uzyskano zgodę. Po spotkaniu tworzy dwa widoki: krótki dla uczestników i operacyjny z zadaniami. Właściciele i terminy są wydobywane tylko wtedy, gdy padły jasno; w przeciwnym razie mają stan proposed.
Przykładowe polecenia¶
- „Wyciągnij decyzje i zadania z rozmowy, ale nie zapisuj ich jeszcze w systemie projektowym.”
- „Sprawdź, czy konsultant podał obowiązkowe informacje i wskaż dokładne momenty.”
- „Porównaj najczęstsze powody telefonów z ostatnich czterech tygodni po anonimizacji.”
- „Usuń surowe nagranie po zatwierdzeniu notatki, jeśli polityka retencji na to pozwala.”
Pełny przebieg¶
Po rozmowie sprzedażowej powstaje transcript candidate. Walidator zaznacza nazwę firmy, kwoty i terminy o confidence poniżej progu. Człowiek poprawia dwa pola; powstaje nowa wersja. Ekstraktor tworzy trzy zadania i jedną decyzję. System wykrywa, że „wyślę jutro” nie ma przypisanego autora, więc nie tworzy aktywnego taska. Po review zadania są zapisane osobnym adapterem, a e-mail follow-up pozostaje draftem.
Walidacja¶
Kontrola obejmuje losowe próbki audio, wszystkie liczby/datę/nazwy, zgodność diarization, kompletność required disclosures, source linking i brak treści spoza nagrania. W analizie jakości zespół stosuje minimalną liczebność grupy i agregację, aby nie tworzyć ukrytego monitoringu jednostki. Użytkownik może zgłosić korektę; stara wersja pozostaje w lineage.
Ryzyka i scenariusz awaryjny¶
Ryzyka: błędny mówca, halucynowana decyzja, brak zgody, nadmierna retencja, bias akcentowy, wykorzystanie wskaźników do automatycznej kary. Ograniczenia to source timestamps, progi confidence, review, polityka celu i zakaz consequential HR decisions bez człowieka.
Jeśli audio jest nieczytelne albo diarization zawodzi, moduł zwraca częściowy transkrypt i listę niepewnych odcinków. Nie generuje „pełnej notatki” udającej brakujące fragmenty. Przy konflikcie zgód wstrzymuje analizę lub stosuje najbardziej restrykcyjną politykę i eskaluje do administratora danych.