Szpieg+. Od nagrania do publikacji
Przewodnik po warsztacie, w którym transkrypcja pozostaje połączona z nagraniem. Dla redaktorów, realizatorów i liderów organizacji, którzy chcą zrozumieć cały proces — od znalezienia wypowiedzi po zatwierdzenie materiału.
Wydanie 1.0 · · PL / EN · 17 rozdziałów
01 / SZPIEG+
Najważniejsze: zachować drogę do źródła
W radiu zdanie ma głos, czas i kontekst. Sam tekst tego nie zachowuje. Szpieg+ łączy nagranie, transkrypcję ze znacznikami słów oraz metadane: mówców, rozdziały, encje i oznaczenia muzyki. Dzięki temu można przejść od znalezionego zdania do jego odsłuchu, sprawdzić sens wypowiedzi i wyznaczyć fragment do dalszej pracy.
Ta sama oś czasu służy redaktorowi i aplikacji. Człowiek sprawdza wypowiedź w odsłuchu; kod przenosi jej zakres i metadane do następnego etapu. Transkrypcja jest roboczym opisem nagrania. W razie rozbieżności wracamy do nagrania, a nie uznajemy płynnie brzmiącego tekstu za dowód.

W tym przewodniku HITL oznacza udział człowieka w sprawdzeniu i zatwierdzeniu wyniku. Samo wyświetlenie przycisku akceptacji nie dowodzi, że odsłuch lub weryfikacja już się odbyły.Link do sekcji ↗
02 / SZPIEG+
Pierwszy materiał w sześciu krokach
- Znajdź audycję w RAMÓWCE albo godzinny plik w ARCHIWUM. Sprawdź datę, godzinę i nazwę nagrania.
- Zajrzyj do GOTOWYCH TRANSKRYPCJI. Jeżeli materiał już opracowano, otwórz istniejący wynik zamiast ponownie zlecać rozpoznawanie mowy.
- Kliknij słowo i odsłuchaj wypowiedź. Sprawdź nazwiska, liczby i początek oraz koniec interesującego fragmentu.
- Ustal IN i OUT w transkrypcji lub na fali. Gdy rozmowa przekracza granicę pliku, dołącz potrzebny odcinek następnej godziny.
- Przygotuj wycinek, tekst, napisy albo szkic artykułu. Zachowaj informację o źródle i zakresie czasu.
- Odsłuchaj wynik i zatwierdź go redakcyjnie. Wysyłka do zewnętrznej usługi jest osobną czynnością, zależną od uprawnień i konfiguracji wdrożenia.
Do pracy potrzebne są dostęp do konkretnej instalacji, współczesna przeglądarka i słuchawki. Publiczne demo na stronie L00P.AI jest lekką imitacją interfejsu: nie daje dostępu do produkcyjnego archiwum ani kont redakcji.
Link do sekcji ↗03 / SZPIEG+
Znalezienie właściwego nagrania
RAMÓWKA pomaga wejść przez nazwę audycji; ARCHIWUM — przez datę i godzinę pliku. GOTOWE TRANSKRYPCJE pokazują pracę już wykonaną. To trzy punkty wejścia do materiału, a nie trzy różne źródła prawdy. Przed montażem porównaj wskazany plik z tym, co słychać w odtwarzaczu.
Statusy mają znaczenie. Plik obecny w archiwum nie musi mieć transkrypcji, rozpoznanych mówców czy rozdziałów. Brak metadanych nie oznacza braku nagrania. Bieżąca godzina może jeszcze rosnąć, dlatego jej długości i kompletności nie należy traktować tak samo jak pliku zamkniętego.
W kokpicie obserwowanym 25.09.2026 są również RAPORT DZIENNY, DZISIAJ, JĘZYK UTWORÓW, ŻYRAFA i MROWISKO. Pokazują kolejne warstwy monitoringu i przetwarzania. Obecność panelu nie oznacza, że każdy dzień lub każda godzina mają już komplet wyników. Komunikat „brak potwierdzenia” pozostaje brakiem potwierdzenia.
Link do sekcji ↗04 / SZPIEG+
Metoda A: transkrypcja karaoke
Karaoke oznacza synchronizację odtwarzania z tekstem na poziomie słów. Kliknięcie słowa przenosi odsłuch do przypisanego miejsca; podświetlenie pomaga śledzić wypowiedź. To wygodny sposób znalezienia argumentu, cytatu lub początku rozmowy bez wielokrotnego przesuwania się po całej godzinie.
W udokumentowanym interfejsie użycie Alt albo Ctrl/Cmd przy kliknięciu słowa wywołuje wybór granicy; dostępne są oznaczenia IN i OUT. Początek oraz koniec zaznaczenia trzeba odsłuchać. Znacznik wyznaczony przez rozpoznawanie mowy może wymagać korekty, zwłaszcza przy nakładających się głosach, krótkich słowach lub muzyce.

- Sprawdź kilka sekund przed i po wybranej wypowiedzi. Zdanie wyrwane z pytania lub odpowiedzi może zmienić sens.
- Zapis tekstowy poprawiaj po odsłuchu. Wygładzenie języka do artykułu oznacz jako redakcję, nie dosłowny cytat.
- Jeżeli nie można rozstrzygnąć słowa, zachowaj niepewność i wróć do materiału. Model nie powinien uzupełniać brakującej treści domysłem.
- Przy innym układzie klawiatury lub urządzeniu korzystaj z widocznych przycisków granic i pomocy instalacji. Skrót nie zastępuje sprawdzenia ustawionego czasu.
05 / SZPIEG+
Mówcy: podział głosów a tożsamość
Diaryzacja odpowiada na pytanie, kiedy mówi dany głos. Identyfikacja przypisuje temu głosowi osobę. Podział na „Mówca 1” i „Mówca 2” może być użyteczny także wtedy, gdy nazwisk jeszcze nie ustalono. Nie zamieniamy podobieństwa głosu w pewną tożsamość.
Instrukcja opisuje podpowiedzi z Głosoteki i z przedstawienia na antenie, a także stany niepewności lub konfliktu. Przed zmianą nazwy odsłuchaj właściwy segment. Sprawdź zakres korekty: pojedynczą wypowiedź, kolejne wystąpienia albo wszystkie segmenty danego mówcy. Zbyt szeroka zmiana może przypisać cudzą wypowiedź niewłaściwej osobie.
Głosoteka wymaga dobrych próbek i kontroli człowieka. Próbka z muzyką, drugim głosem albo zakłóceniami może pogorszyć identyfikację. Zarządzanie wzorcami głosu oraz dostępem do nich należy do zasad konkretnego wdrożenia; nie wynika automatycznie z publicznego charakteru audycji.
Link do sekcji ↗06 / SZPIEG+
Rozdziały, encje i muzyka
Rozdział wskazuje odcinek tematyczny; encja porządkuje osoby, organizacje, miejsca lub inne obiekty wymienione w wypowiedzi. Te warstwy pomagają nawigować, wyszukiwać i przygotowywać kolejne formaty. Nie są niezależnym potwierdzeniem prawdziwości tego, co powiedziano.
Oznaczenia muzyki pomagają zorientować się w strukturze godziny. Po usunięciu muzyki z wejścia do transkrypcji znaczniki trzeba nadal odnieść do oryginalnego nagrania. Bez takiego mapowania tekst mógłby wskazywać niewłaściwe miejsce. W zrzucie dołączenia następnej godziny interfejs wyraźnie zastrzega, że mapa muzyki obejmuje tylko zbadany zakres.
Nazwy utworów, język, rozdziały i encje traktuj jako dane wymagające sprawdzenia przed publikacją lub raportowaniem. Szczególnie łatwo pomylić nazwiska o podobnym brzmieniu i tytuły odczytane w zapowiedzi. Weryfikacja konkretnego pola nie oznacza automatycznej akceptacji całego materiału.
Link do sekcji ↗07 / SZPIEG+
Metoda B: edytor fali
Fala pokazuje przebieg nagrania i pozwala wybrać odcinek również bez gotowej transkrypcji. Jest przydatna do pracy z przerwami, muzyką, wejściami antenowymi i stykiem plików. Transkrypcja pomaga wybrać sens wypowiedzi; fala pomaga dopracować jej granice dźwiękowe. Obie metody mogą prowadzić do tego samego wycinka.

- Otwórz właściwy plik w edytorze fali. Sprawdź nazwę i pełną długość.
- Zaznacz zakres oraz ustaw IN i OUT. Użyj powiększenia lub precyzyjnego przesunięcia, jeśli dostępne w danym widoku.
- Odsłuchaj wejście i wyjście. Nie odcinaj pierwszej spółgłoski ani końcówki ostatniego słowa.
- Jeżeli materiał kończy się za granicą godziny, dołącz dalszą część przed ustaleniem ostatecznego OUT.
- Pobierz wycinek albo odłóż go do rejestru fragmentów, zależnie od celu pracy.
Widok z 24.09 pokazuje pięć oznaczonych odcinków muzycznych. Liczba ta dotyczy konkretnego materiału; nie jest stałą właściwością każdej godziny.
Link do sekcji ↗08 / SZPIEG+
Dogrywka z następnej godziny i bezstratne cięcie
Rozmowa nie musi kończyć się razem z plikiem rejestratora. Edytor udostępnia dołączenie 15, 30 lub 45 minut albo godziny. Wybierz tyle, ile potrzebujesz, i sprawdź styk obu nagrań. Pliki mogą zawierać powtórzony odcinek; jego pozostawienie spowodowałoby podwójne odtworzenie tych samych słów.

W obserwowanym przykładzie z plików 12.09.2026, godz. 10:00 i 11:00, interfejs dołączył 15 minut, wskazał szew na 60:05 i pominięcie zakładki 5,43 s. To odczyt jednego przypadku, a nie domyślna poprawka, którą należy stosować do innych nagrań.

Bezstratność dotyczy ścieżki cięcia lub łączenia zgodnych danych skompresowanego audio bez ponownego kodowania. Taki wycinek można przygotować bez renderowania dźwięku od nowa. Granica MP3 zależy jednak od ramek kodeka; interfejs badanego przykładu podaje około 26 ms. Nie jest to dowolna dokładność co do próbki.
Normalizacja głośności, efekty, zmiana kodeka albo niektóre operacje montażowe mogą wymagać renderowania. Nie przenosimy określenia „bezstratne” na każdy eksport. Po dołączeniu kolejnej godziny sprawdź też kompletność transkrypcji, mapy muzyki i pozostałych metadanych dla nowego zakresu.
Link do sekcji ↗09 / SZPIEG+
Rejestr fragmentów i montaż
Rejestr odkłada wybrane fragmenty do dalszej pracy. Nadaj im tytuły, które pozwolą zrozumieć zawartość bez ponownego otwierania całej godziny. Zachowaj identyfikator źródła, IN, OUT i kolejność wykorzystania. Przy kilku źródłach godzina rozpoczęcia jednego pliku nie jest wspólnym zegarem całego montażu.
Dokumentacja opisuje składanie fragmentów oraz zadania montażowe wykonywane w tle. Złożenie koszyka nie oznacza zakończenia przetwarzania. Sprawdź status zadania, wynikowy plik i jego długość. Odsłuchaj przejścia, a nie tylko pierwsze sekundy materiału.
Automatycznie przygotowany opis lub proponowana kolejność są propozycją redakcyjną. Ostateczna odpowiedzialność za sens zestawienia wypowiedzi, skróty i kolejność pozostaje po stronie osoby zatwierdzającej materiał.
Link do sekcji ↗10 / SZPIEG+
Eksport: audio, tekst, napisy i dane
- TXT — prosty tekst do czytania i dalszego opracowania; zachowaj dostępne czasy i oznaczenia mówców.
- Markdown — dokument z nagłówkami i metadanymi, wygodny jako kontekst dla agenta lub baza dalszej redakcji.
- HTML i wydruk do PDF — forma do czytania lub udostępnienia osobie, która nie pracuje w aplikacji.
- SRT i VTT — napisy oparte na czasach segmentów. Zawsze sprawdź synchronizację z tym samym plikiem audio lub wideo, do którego zostaną dołączone.
- ninjs / dane strukturalne — przekazanie treści i metadanych do kolejnego systemu. To format wymiany, nie gotowy artykuł ani dowód redakcyjnego zatwierdzenia.
- Audio — wycinek lub wynik montażu. Przy doborze formatu uwzględnij to, czy dana operacja zachowuje oryginalny strumień, czy koduje dźwięk ponownie.
Zakres formatów pochodzi z instrukcji wdrożenia; nie wykonywaliśmy w tej publikacji ponownego testu każdego eksportu. Przenosząc materiał między narzędziami, zachowaj źródło, datę nagrania i informację o korektach. Wycinek audio i tekst muszą opisywać ten sam zakres.
Link do sekcji ↗11 / SZPIEG+
Korpus: wyszukaj, zapytaj, wróć do nagrania
Wyszukiwanie tekstowe odnajduje zapisane słowa. Filtry zawężają materiał według danych, które rzeczywiście istnieją w korpusie: dat, audycji, mówców czy encji. Brak wyniku może oznaczać inne brzmienie transkrypcji, niepełne opracowanie godziny albo zbyt wąski filtr; nie dowodzi, że temat nigdy nie pojawił się na antenie.
Pytanie do korpusu korzysta z pobranego kontekstu i modelu językowego. Odpowiedź powinna prowadzić do pliku, segmentu i czasu. Otwórz wskazany fragment, sprawdź, czy rzeczywiście wspiera twierdzenie, i posłuchaj kontekstu. RAG pomaga sięgnąć do źródeł; nie usuwa ryzyka błędnej syntezy.
Jeżeli źródła nie wystarczają, poprawnym wynikiem jest informacja o braku podstaw. Wypowiedź gościa audycji, parafraza redaktora i ustalenie potwierdzone dokumentami to różne rodzaje informacji. Zachowuj to rozróżnienie także w dossier, notatkach i odpowiedziach agentów.
Link do sekcji ↗12 / SZPIEG+
Od transkrypcji do szkicu artykułu
Studio Artykułu przyjmuje wybrane fragmenty lub pomaga zaplanować wątki całej godziny. Najpierw określ temat i źródła, potem buduj tytuł, lead i układ tekstu. Model może przygotować warianty, ale nie powinien dopisywać faktów tylko po to, by domknąć narrację.
- Wybierz zakres, z którego powstaje artykuł. Jeżeli łączysz kilka rozmów, zachowaj pochodzenie każdej z nich.
- Oddziel cytaty od parafraz. Sprawdź nazwiska, funkcje, liczby, daty i tezy wymagające dodatkowego źródła.
- Przejrzyj oznaczenia wierności lub brakującego oparcia w materiale. Brak ostrzeżenia nie zwalnia z czytania i odsłuchu.
- Zatwierdź redakcję, obejrzyj podgląd i dopiero wtedy wyślij szkic do skonfigurowanego systemu publikacji.
W zaobserwowanym menu ARTYKUŁ jest opisany jako osobne studio z wysyłką szkicu na portal. Szkic nie jest opublikowanym artykułem. Proces zatwierdzenia treści i uprawnienia wydawcy pozostają osobnym etapem.
Link do sekcji ↗13 / SZPIEG+
Publikacja jest decyzją
Instrukcja opisuje integracje z WordPressem, Transistor i Mixcloud. Ich dostępność zależy od konfiguracji, kont i uprawnień. Nie uruchamialiśmy tych integracji podczas przygotowania przewodnika. Przed wysyłką sprawdź odbiorcę, kanał, widoczność, tytuł, opis i ostateczny plik.
Rozróżniaj szkic, materiał niepubliczny oraz materiał publiczny. Link nieindeksowany lub nieumieszczony w katalogu nie musi oznaczać kontroli dostępu. Zakres udostępnienia należy sprawdzić w usłudze docelowej.
Metadane utworów i automatyczny opis nie rozstrzygają uprawnień do ich wykorzystania. Podobnie architektura oparta na bibliotece standardowej, określana jako stdlib, dotyczy zależności kodu; nie nadaje praw do nagrań, muzyki, modeli ani danych. Warunki wdrożenia i wykorzystania materiałów ustala się osobno.
Link do sekcji ↗14 / SZPIEG+
Kontrola kosztów i danych
Otwieranie istniejącej transkrypcji i zlecenie nowego rozpoznawania mowy to różne operacje. Przed płatnym zleceniem sprawdź dostępne wyniki, wybrany model, zakres nagrania i komunikat o kosztach. Nie powtarzaj zlecenia tylko dlatego, że wynik nie pojawił się od razu: najpierw sprawdź kolejkę i status poprzedniej pracy.
Wdrożenie może łączyć modele lokalne i usługi zewnętrzne. Przetwarzanie w pełni lokalne wymaga dobrania oraz sprawdzenia całej ścieżki, w tym transkrypcji, modelu językowego i integracji. Sama lokalizacja interfejsu na komputerze nie oznacza, że żaden etap nie wysyła danych poza organizację.
W przewodniku nie utrwalamy cenników ani nazw „najlepszych modeli”. Zmieniają się szybciej niż podstawowy warsztat. Decyzja powinna wynikać z jakości na własnych materiałach, zasobów sprzętu, czasu pracy i zasad dostępu do danych. Konta i klucze usług pozostają poza publicznymi dokumentami.
Link do sekcji ↗15 / SZPIEG+
Gdy coś nie pasuje
- Słowo prowadzi do złego miejsca: sprawdź zgodność pliku, zakresu i osi czasu; odsłuchaj sąsiednie zdania. Nie uznawaj samego podświetlenia za pomiar dokładności.
- Brakuje transkrypcji po dołączeniu następnej godziny: dodatkowe audio nie gwarantuje dodatkowych metadanych. Sprawdź opracowanie tego pliku.
- Głos ma niewłaściwe nazwisko: wróć do odsłuchu i źródła identyfikacji; ogranicz korektę do właściwego zakresu.
- Na styku słychać powtórzenie lub urwanie: sprawdź zakładkę i granice obu plików. Nie kopiuj wartości poprawki z przykładu w instrukcji.
- Zadanie długo trwa: sprawdź jego status i komunikat o błędzie, zanim uruchomisz ponownie płatną operację.
- Odpowiedź modelu brzmi przekonująco, ale cytat nie pasuje: zachowaj źródło, zaznacz problem i popraw albo odrzuć wynik.
Przy zgłoszeniu problemu wystarczą na początek identyfikator materiału, czas fragmentu, wykonana czynność oraz oczekiwany i faktyczny wynik. Udostępniaj tylko materiał, do którego odbiorca zgłoszenia powinien mieć dostęp.
Link do sekcji ↗16 / SZPIEG+
Z radia do warsztatu agentowego
To podejście wyrasta z pracy z rozmową: słuchania, znajdowania fragmentów, sprawdzania cytatów i układania opowieści. Poniższe fotografie MEDIA WNET dokumentują plenerowe audycje z 2013 i 2014 roku. Pokazują radiowy kontekst tej pracy, nie ówczesne użycie Szpiega+ ani test obecnej aplikacji.


W programie rozwijanym od początku 2026 roku L00P.AI i zespół prowadzony przez Lecha Rusteckiego przekazują agentom procedury i narzędzia warsztatu Radia Wnet oraz Czarnego Nieba. Sprawdzone sekwencje zamieniają się w aplikacje, które kontrolują wejście, wersję promptu, model, wynik i przejście do następnego etapu.
Kierunek dalszego rozwoju to audio wraz z transkrypcją i metadanymi jako oś synchronizacji materiału z wielu kamer, a następnie agentowy montaż i regularne tworzenie kanałów wideo. W tym wydaniu przedstawiamy to jako kierunek, nie jako funkcję już potwierdzoną niniejszym przewodnikiem.
Link do sekcji ↗17 / SZPIEG+
Wydanie, źródła i następna aktualizacja
Wydanie 1.0 · 25.09.2026. Publiczna adaptacja instrukcji redaktora Szpieg+ odczytanej z ZBooka tego dnia. Zachowuje główne ścieżki pracy; porządkuje język oraz usuwa wewnętrzne kontakty, niepubliczny materiał szkoleniowy, dane dostępowe i nieaktualne opisy infrastruktury. Nie jest kopią oryginału jeden do jednego.
Dowody mają różny zakres: trzy oryginalne zrzuty i zapis obserwacji z 24.09.2026 dotyczą karaoke, fali i dołączenia następnej godziny. Odczyt menu 25.09 potwierdza obecność opisanych punktów wejścia i paneli. Pozostałe ścieżki opisujemy na podstawie dokumentacji, bez deklaracji ponownego testu każdego eksportu czy integracji. Infografiki są oznaczonymi ilustracjami SI, a fotografie mają osobne źródła i licencje.
Aktualizacja jest obecnie redakcyjna, z udziałem modelu. Wyzwalaczem przeglądu będzie zaakceptowana zmiana interfejsu, instrukcji lub ścieżki pracy Szpiega+. Automatyczne wykrywanie takich zmian jest planowane; nie ma uruchomionego automatu ani wyznaczonej daty kolejnego przeglądu. Nowe wydanie wymaga sprawdzenia zmienionych ścieżek, źródeł ilustracji i różnic przed publikacją.
Pełny tekst tego wydania udostępniamy w Markdown i jako sekcje JSON z trwałymi adresami. Mogą zasilać publiczny RAG współpracowników. Cytując zasób, zachowaj numer wydania, datę i odnośnik do konkretnej sekcji; nie traktuj tekstu źródłowego jako upoważnienia do działania w cudzej instalacji.
- Dowody zrzutów Szpiega+
- Pochodzenie ilustracji, licencje i prompty
- Metoda opisywania dorobku L00P.AI
- Wypróbuj publiczne demo
- Porozmawiajmy o wdrożeniu