Klonowanie głosu AI w sprzedaży przyprawia o ciarki, kiedy coś ukrywa, i jest zupełnie w porządku, kiedy nie ukrywa niczego. Klonowanie głosu obcej osoby, podawanie wygenerowanego nagrania za nagrane ręcznie albo ukrywanie, że jakikolwiek software dotknął wiadomości: tu zaczyna się sztuczka.
Twój własny głos, sklonowany z twojego własnego demo, który mówi prawdziwe zdanie o prawdziwej osobie, na nagraniu, na którym naprawdę jesteś ty, wysłany z twojego własnego konta, to nie sztuczka. To ta sama wiadomość, co wysłana ręcznie, tylko zrobiona szybciej. Dyskomfort należy do oszustwa, nie do technologii.
Mój własny cold outreach wychodzi w sklonowanej wersji mojego głosu, więc znam ten niepokój od środka. Za pierwszym razem, kiedy usłyszałem zdanie moim głosem, którego nigdy nie wypowiedziałem na głos, nie było to przyjemne.
Nie będę ci więc wmawiał, że ta obawa jest irracjonalna. Większość tego, co poniżej, jest prawdą niezależnie od tego, czy kiedykolwiek dotkniesz narzędzia takiego jak to, które buduję. Produkt pojawia się raz, pod koniec.
Czy klonowanie głosu AI w sprzedaży przyprawia o ciarki?
Ten odruch warto traktować poważnie, bo zwykle wskazuje na coś prawdziwego. To, od czego ludzi przechodzą ciarki, prawie nigdy nie jest jakością dźwięku. Chodzi o poczucie, że ktoś tobą manipuluje. Ktoś poświęcił ci zero sekund, ale tak to ustawił, żeby wyglądało na dziesięć minut.
Wysiłek był udawany, a udawany wysiłek to małe kłamstwo o tym, jak bardzo liczysz się dla nadawcy.
Uczciwe pytanie nie brzmi więc „czy maszyna pomogła to zrobić”. Maszyna pomogła zrobić prawie wszystko w twojej skrzynce. Pytanie brzmi: „czy ta wiadomość udaje coś, czym nie jest”.
Cold mail napisany w edytorze tekstu też powstał z pomocą maszyny i nikt nie uważa tego za złowrogie, bo nie udaje, że został napisany odręcznie. Klonowanie głosu zaczyna przyprawiać o ciarki dopiero wtedy, gdy służy do wyprodukowania bliskości, której nigdy nie było.
Czy potencjalni klienci nienawidzą wideo AI, czy tylko złego wideo AI?
Potencjalni klienci nienawidzą, kiedy się ich oszukuje, i nienawidzą nudy. Większość tego, co nazywa się „nienawiścią do wideo AI”, to jedno z tych dwóch w przebraniu. Syntetyczny awatar osoby, która nie istnieje, czytający ci skrypt, nie jest nielubiany dlatego, że użył AI.
Jest nielubiany, bo nie ma za nim prawdziwej osoby, więc nie ma komu zaufać i nie ma komu odpisać.
Krótkie wideo prawdziwego foundera, który pokazuje prawdziwy produkt i wita oglądającego po imieniu własnymi słowami, nie wywołuje takiej reakcji, bo to, co jest personalizowane, jest prawdziwe. Na nagraniu jest prawdziwy człowiek. Słowa są foundera.
Jedyne, co wyprodukowano na skalę, to praca, nie uczciwość. Ludzie nie mają pretensji o wydajną uczciwość. Mają pretensje o wydajną nieuczciwość, a te dwie rzeczy w ogóle nie wyglądają podobnie, kiedy już oglądasz.
Dlaczego outreach z AI wydaje się fałszywy, nawet gdy wiadomość jest prawdziwa?
Mnóstwo cold outreachu jest technicznie w porządku, a mimo to wydaje się fałszywe. Gramatyka czysta, oferta prawdziwa, a coś nadal nie gra. Zwykle część osobista wcale nie jest osobista. Wstawione pole, w które pasowałoby dowolne imię, sygnalizuje, że nikt nie poświęcił prawdziwej uwagi, a ludzie wyczuwają to niemal natychmiast.
Wiadomość brzmi fałszywie, bo wysiłek za nią był udawany.
Ten błąd nie ma nic wspólnego z klonowaniem ani kamerami. Możesz wysłać zwykły mail tekstowy i udawać wysiłek, i możesz wysłać wyprodukowane wideo i go nie udawać. Decyduje to, czy konkretne zdanie jest naprawdę konkretne.
Jeśli wymienia ich firmę, to powinna to być ich prawdziwa firma i powód, który jest naprawdę prawdziwy, a nie szablon z pustym polem. Spraw, żeby część osobista była prawdziwa, a fałszywe wrażenie nie ma już gdzie się schować.
Czy klonowanie głosu AI w sprzedaży jest etyczne?
Granica przestaje być rozmyta, kiedy ją nazwiesz. Leży między używaniem swojego prawdziwego „ja” na skalę a fabrykowaniem „ja”, którego nigdy nie było w pokoju. Oto ta sama technologia użyta na dwa sposoby.
| Przekracza granicę | Pozostaje uczciwe |
|---|---|
| Klonowanie cudzego głosu albo głosu, który nie należy do prawdziwej osoby | Klonowanie własnego głosu z własnego nagrania |
| Syntetyczny awatar twarzy, która nie istnieje | Twoje prawdziwe nagranie, osoba na ekranie to ty |
| Twierdzenie albo sugerowanie, że nagrano to ręcznie specjalnie dla nich | Nigdy nie udajesz, że to było na żywo, to po prostu prawdziwa wiadomość zrobiona na skalę |
| „Osobiste” zdanie, które jest wstawionym polem pasującym do każdego imienia | Konkretne, prawdziwe zdanie, które ma sens tylko dla tej jednej osoby |
| Software wysyła to z puli kont, które nie są twoje | Wychodzi z twojego konta, pod twoim nazwiskiem, i bierzesz za to odpowiedzialność |
| Oglądający czułby się oszukany, gdyby zobaczył, jak to powstało | Oglądający mógłby patrzeć, jak to robisz, i nic by się nie zmieniło |
Ostatni wiersz to cały test. Jeśli potencjalny klient zaglądający ci przez ramię czułby się naciągnięty, jesteś po złej stronie. Jeśli zobaczyłby po prostu foundera, który sprawnie robi swój outreach, wszystko jest w porządku.
Klonowanie głosu nie jest oszustwem. Oszustwem jest ukrywanie, kim jesteś, albo udawanie kogoś, kim nie jesteś. Twój własny głos mówiący prawdę nie jest ani jednym, ani drugim.
Wszystko powyżej sprowadza się do jednego zdania, które łatwo zapamiętać. Osoba musi być prawdziwa i twierdzenie musi być prawdziwe. Klonuj tylko własny głos, z nagrania, na którym naprawdę jesteś ty, i wkładaj sobie w usta tylko słowa, które bez oporów powiesz tej osobie na głos.
Rób tak, a klonowanie głosu przestaje być problemem etycznym i wraca do bycia narzędziem produkcyjnym, jak kamera czy mikrofon. O tym, czy uczciwa wersja faktycznie daje odpowiedzi, pisałem osobno w tekście czy spersonalizowane wideo daje więcej odpowiedzi.
Gdzie w tym jest Personade, a gdzie nie
Wszystko powyżej to argument. Personade to automatyzacja outreachu na LinkedInie, a spersonalizowane wideo to dodatek, który robimy za ciebie. Ten dodatek to moja próba budowania po uczciwej stronie tego argumentu. Głos pochodzi z jednego wideo, które nagrywasz, niczyjego innego, a osoba na ekranie to za każdym razem twoje własne nagranie. Nie ma w nim nigdzie awatara ani pożyczonego głosu.
Każdy lead dostaje własną wersję, z otwarciem, które wymienia go z imienia, twoim głosem, na wideo, które już masz nagrane. Reszta wideo to dokładnie twoje nagranie.
Tu chcę być jasny, bo to tekst o zaufaniu. Personade nie umieszcza na stronie leada niczego, co ogłaszałoby, że użyto software’u. Uczciwość nie siedzi w plakietce. Siedzi w tym, że wiadomość jest prawdziwa i że pochodzi od ciebie.
Wideo wychodzą w ramach twoich własnych kampanii na LinkedInie, z twojego własnego profilu, do ludzi, których wybierasz ty. To całe rozwiązanie kwestii etycznej zamienione w proces.
Osoba jest prawdziwa, bo to twoje nagranie, twierdzenie musi być prawdziwe, bo wychodzi pod twoim nazwiskiem, a to nadal twój outreach, bo wychodzi z twojego konta. Jeśli chcesz zobaczyć, jak to wszystko do siebie pasuje, przeprowadzi cię przez to kompletny przewodnik po spersonalizowanym wideo w outreachu.
Częste pytania
Czy trzeba mówić potencjalnym klientom, że wideo zrobiono z AI? Nie musisz, a etykieta nie jest tym, co czyni outreach uczciwym. Uczciwość bierze się z tego, że wiadomość jest prawdziwa: twój prawdziwy głos, twoje prawdziwe nagranie, prawdziwy powód, dla którego się odzywasz, wysłane z twojego własnego konta. Jeśli to się zgadza, zastrzeżenie niewiele dodaje. Jeśli nie, żadne zastrzeżenie tego nie uratuje. Informuj, jeśli chcesz, ale nie traktuj tego jako testu.
Czym różni się spersonalizowane wideo od deepfake’a? Deepfake fabrykuje osobę, której nigdy nie było: cudzy głos albo twarz, która nie należy do żadnej prawdziwej osoby. Spersonalizowane wideo to twoje własne nagranie z prawdziwym pierwszym zdaniem dla każdego oglądającego. Osoba jest prawdziwa i twierdzenie jest prawdziwe. Na skalę produkowana jest tylko praca, nie osoba i nie prawdziwość tego, co zostało powiedziane.
Dlaczego wideo z syntetycznymi awatarami wywołuje tak złe reakcje? Bo nie ma za nimi prawdziwej osoby. Awatar czytający skrypt nie daje nikogo, komu można zaufać, i nikogo, komu można odpisać, więc wydaje się pusty, niezależnie od tego, jak jest dopracowany. Prawdziwy founder na prawdziwym nagraniu, witający oglądającego po imieniu własnymi słowami, nie wywołuje takiej reakcji, bo personalizowana jest właśnie prawdziwość osoby.
Technologia jest neutralna. Sklonowany głos może nieść kłamstwo albo prawdę, dokładnie tak jak twój zwykły głos. Jedyne, co decyduje, które z nich robisz, to czy osoba jest prawdziwa, a twierdzenie prawdziwe.
Zachowaj uczciwość w obu, wysyłaj z własnego konta, a nigdy nie będziesz się zastanawiać, czy to od twojej wiadomości ktoś dostaje ciarki, bo nie dostanie.




