15.ai
15.ai사이트종류 | 인공지능, 음성합성, 기계학습, 딥러닝 |
|---|---|
| 에서 사용 가능 | 영어 |
| 설립자 | 15 |
| URL | 15 |
| 상업의 | 아니요. |
| 등록. | 없음. |
| 런칭 | 초기 릴리스:2020년 3월; 안정적 출시 : v24.2.1 / 2021년 9월; |
| 현황 | 정비안내 |
| 시리즈의 일부(on) |
| 인공지능 |
|---|
15.ai 은 다양한 미디어 소스의 가상 캐릭터 모음에서 자연스러운 감성적인 고 fidelity 텍스트 대 speech 음성을 생성하는 비상업적인 프리웨어 인공지능 웹 애플리케이션입니다.가명 MIT 연구원이 15라는 이름으로 개발한 이 프로젝트는 오디오 합성 알고리즘, 음성 합성 딥 뉴럴 네트워크, 감정 분석 모델을 조합해 실시간보다 빠르게 감정적인 캐릭터 음성을 생성하고 서비스하며, 특히 훈련 가능한 데이터의 양이 매우 적은 것을 특징으로 합니다.
2020년 초 출시된 15.ai 은 기술을 활용한 목소리 연기와 더빙의 민주화 개념 증명으로 시작되었습니다.그 무상적이고 비상업적인 성격(프로젝트를 사용할 때 제대로 된 인정을 받아야 한다는 규정만 있음), 사용 편의성, 사용자 계정 등록 요건 없음 및 기존 텍스트-투-스피치 구현에 대한 상당한 개선 사항에 대해 사용자들은 찬사를 보내고 있지만,[5][9][4][6]일부 비평가들과 성우들은 그러한 기술을 공개적으로 이용할 수 있고 쉽게 접근할 수 있도록 하는 것의 합법성과 윤리성에 의문을 제기했습니다.[8][10][11]
콘텐츠 제작에 있어서 인공지능 음성 복제(오디오 딥페이크라고도 함)의 대중화 뒤에 있는 자극제로 인정받고 있으며, 기존의 인기 있는 허구적 캐릭터들의 사용을 포함하는 최초의 공개적인 인공지능 음성 합성 프로젝트로서 15.ai 은 여러 인터넷 팬덤, 특히 My Little Pony: Friend에 상당한 영향을 미쳤습니다.배는 마법, 팀 포트리스 2, 스폰지밥 네모바지 팬덤.게다가, 15.ai 은 다른 인공지능 생성 프로젝트에서 4chan의 포니 보존 프로젝트의 사용에 영감을 주었습니다.
15.ai 의 인기가 높아짐에 따라 여러 상업적 대안들이 생겨나고 있으며, 이로 인해 잘못된 귀속과 도용 사례가 발생하고 있습니다.2022년 1월, 성우 트로이 베이커(Troy Baker)가 플랫폼의 일부로 15.ai 의 작업을 표절했다는 사실이 밝혀졌습니다.
2022년 9월 8일, 15.ai 은 마지막으로 안정적인 릴리스(v24.2.1) 이후 1년 만에 다음 업데이트를 준비하기 위해 일시적으로 다운되었습니다.2023년 9월 현재 일시적으로 오프라인 상태입니다.[17]
특징들

이용 가능한 캐릭터는 포털의 GLaDOS와 휘틀리, 팀 포트리스 2의 캐릭터, 트와일라잇 스파클과 마이 리틀 포니의 다수의 주, 부, 조연 캐릭터: 우정은 마법, 스폰지밥 네모바지의 스폰지밥, 닥터 후의 열 번째 의사, 2001년의 HAL 9000: 스페이스 오디세이, 스탠리 우화, Wii U/3DS/스위치 슈퍼 스매시 브라더스의 내레이터.아나운서(이전), 아쿠아 틴 헝거 포스의 칼 브루타나딜레우스키, 스티븐 유니버스의 스티븐 유니버스,[13][12][18][19] 댄 VS.의 댄, 언더테일의 산스.
응용 프로그램이 사용하는 딥 러닝 모델은 비결정적입니다: 동일한 텍스트 문자열에서 스피치가 생성될 때마다 스피치의 억양이 조금씩 다릅니다.또한 이 애플리케이션은 추론 중에 모델의 가이드 역할을 하는 테이크의 감정을 전달하는 문장 또는 구인 감정 컨텍스트라이저(이 프로젝트에서 만든 용어)를 사용하여 생성된 라인의 감정을 수동으로 변경할 수 있습니다.[9][12][13]감정 문맥화기는 2017년 MIT 미디어 랩이 개발한 심층 신경망 감정 분석 알고리즘인 딥모지를 사용하여 전송 학습 이모지 임베딩을 통해 추론한 문장의 감정 내용을 표현한 것입니다.[20][21]DeepMoji는 2013년부터 2017년까지 트위터 데이터에서 12억 건의 이모지 발생에 대해 교육을 받았으며, 트윗 및 기타 온라인 커뮤니케이션 모드에서 풍자를 정확하게 식별하는 데 있어 인간 피실험자보다 성능이 우수한 것으로 확인되었습니다.[22][23][24]
15.ai 은 다중 speaker 모델을 사용합니다. hundreds의 목소리가 순차적이 아닌 동시에 훈련되기 때문에 필요한 훈련 시간을 단축할 수 있으며, 그러한 감정적 맥락에 노출되지 않은 목소리에 대해서도 모델이 공유된 감정적 맥락을 학습하고 일반화할 수 있습니다.따라서, 애플리케이션의 전체 캐릭터 라인업은 서로 다른 데이터 세트에서 훈련된 여러 단일 스피커 모델과 달리 단일 훈련된 모델로 구동됩니다.[26]15.ai 에서 사용하는 어휘록은 옥스포드 사전, 위키사전, CMU 발음 사전, 4chan, Reddit 및 Twitter를 포함한 다양한 인터넷 소스에서 스크랩되었습니다.생소한 단어의 발음은 딥러닝 모델에 의해 학습된 음운 규칙을 이용하여 자동으로 추론됩니다.[12]
이 응용 프로그램은 잘못된 발음을 수정하거나 이질적인 용어를 설명하기 위해 ARPABET으로 알려진 일련의 영어 음성 표기의 단순화된 버전을 지원합니다(예를 들어 철자는 같지만 발음이 다른 단어는 시제에 따라 / ˈr ɛd/ 또는 / ˈri ːd/로 발음될 수 있습니다).1970년대에 Advanced Research Projects Agency에 의해 개발된 오리지널 ARPABET 코드는 영어 음소를 지정하고 구별하기 위해 50개의 고유 기호를 지원하는 반면, CMU Prencing Dictionary의 ARPABET 규약(문자 코드 집합 뒤에 15.ai 이 오는 것)은 알로포닉 phone을 결합함으로써 기호 집합을 39개의 음소로 줄였습니다.하나의 표준으로 하나의 깨달음(예:AXR/ER;UX/UW) 및 음절 자음을 대체하기 위해 여러 개의 공통 기호를 함께 사용합니다(예:EN/AH0 NARPABET 문자열은 입력 상자 내에서 음소 문자열을 곱슬곱슬한 괄호로 감싸서 응용 프로그램에서 호출할 수 있습니다([28][29]예:{AA1 R P AH0 B EH2 T}/ ˈɑːrp əˌb ɛt/, ARPABET)의 발음을 나타냅니다.
다음은 15.ai 과 CMU 발음 사전에서 사용하는 음소 표입니다.
| 아르파벳 | Rspl. | IPA | 예 |
|---|---|---|---|
AA | 아. | ɑ | 괴상한 |
AE | a | æ | 에 |
AH0 | ə | ə | 에 대하여 |
AH | u, 어 | ʌ | 오두막집 |
AO | 오. | ɔ | 당연한 |
AW | 으으으 | 가 | 소를 |
AY | 눈을 | 가 | 숨다 |
EH | e, 에 | ɛ | 에드 |
| 아르파벳 | Rspl. | IPA | 예 |
|---|---|---|---|
ER | ur, ə르 | ɝ, , | 상처입은 |
EY | 에이 | e | 먹은 |
IH | i, ih | ɪ | 그것을 |
IY | 이 | i | 먹다 |
OW | 오호 | o | 귀리 |
OY | 오이를 | ɔɪ | 장난감을 |
UH | uu | ʊ | 후드 |
UW | oo | u | 두개의 |
| AB | 묘사 |
|---|---|
| 0 | 스트레스없음 |
| 1 | 일차응력 |
| 2 | 이차응력 |
| 아르파벳 | Rspl. | IPA | 예 |
|---|---|---|---|
B | b | b | 가 |
CH | ch, 따끔따끔 | t | 치즈 |
D | d | d | 디 |
DH | dh | ð | 그대를 |
F | f | f | 수수료 |
G | g | ɡ | 녹색의 |
HH | h | h | 그는 |
JH | j | 라 | 이런 |
| 아르파벳 | Rspl. | IPA | 예 |
|---|---|---|---|
K | k | k | 열쇠를 |
L | l | l | 이 |
M | m | m | 나를 |
N | n | n | 무릎을 |
NG | ng | ŋ | 핑 |
P | p | p | 오줌을 싸다 |
R | r | r | 읽다 |
S | s, ss | s | 바다를 |
| 아르파벳 | Rspl. | IPA | 예 |
|---|---|---|---|
SH | 쉬 | ʃ | 그녀는 |
T | t | t | 차 |
TH | th의 | θ | 세타 |
V | v | v | Vee |
W | w, 뭐 | w | 우리들 |
Y | y | j | 수확을 거두다 |
Z | z | z | 지 |
ZH | zh | ʒ | 발작적인 |
배경
음성합성

2016년 DeepMind의 WaveNet의 제안으로 음성 합성을 위한 딥러닝 기반 모델이 파형을 모델링하고 사람과 같은 음성을 생성하는 방법으로 인기를 얻기 시작했습니다.[31][32][3][8]구글 AI가 개발한 음성합성용 신경망 아키텍처인 타코트론2는 2018년에 발표되었으며, 지능적인 음성을 생성하기 위해 수십 시간의 오디오 데이터가 필요했습니다. 2시간의 음성에 대해 훈련했을 때 모델은 평범한 품질로 지능적인 음성을 생성할 수 있었고, 36분의 음성에 대해 훈련했을 때,모델은 이해할 수 있는 말을 할 수 없었습니다.[33][34]
수년 동안 현실적인 고품질 텍스트 음성 변환 모델을 훈련하는 데 필요한 데이터의 양을 줄이는 것은 딥 러닝 음성 합성 분야의 과학 연구자들의 주요 목표였습니다.[35][36]15.ai 의 개발자는 인간 표준에 맞게 목소리를 복제하기에 15초 정도의 데이터만으로도 충분하며, 이는 필요한 데이터 양을 크게 감소시킨다고 주장합니다.
딥러닝에서 저작권이 있는 자료
2013년 Google과 저작자 조합 간의 획기적인 사건은 저작권이 있는 인쇄된 책의 전문을 검색하는 서비스인 Google Books가 혁신적이며 공정한 사용을 위한 모든 요구 사항을 충족한다고 판결했습니다.[38]이 사건은 딥러닝과 인공지능 분야에 중요한 법적 선례를 남겼는데, 저작권이 있는 자료를 이용하여 차별적 모델이나 비상업적 생성 모델을 훈련하는 것은 합법적인 것으로 보았기 때문입니다.[39]저작권 보호를 받는 자료를 사용하여 훈련된 상업적 생성 모델의 합법성은 여전히 논의 중에 있습니다. 머신 러닝 모델의 블랙박스 특성 때문에 직접 경쟁을 통한 저작권 침해 주장은 입증하기 어려울 것입니다.[39]
발전
15.ai 은 15라는 가명으로 알려진 매사추세츠 공과대학교 소속의 익명의 연구 과학자에 의해 설계되고 만들어졌습니다.이 프로젝트는 개발자가 학부생일 때 개발을 시작했습니다.개발자는 사이트를 운영하는 데 드는 높은 비용을 지불할 수 있다고 말했습니다.[9]
Hacker News의 개발자에 의해 만들어진 게시물에 따르면, 15.ai 은 운영하는데 매달 수천 달러의 비용이 듭니다; 그들은 성공적인 스타트업 종료로 인해 프로젝트를 지원할 수 있습니다.개발자는 MIT에서 학부 생활을 하는 동안 결국 15.ai 로 발전한 관련 프로젝트(매사추세츠 주에서는 시간당 약 14달러)에 참여할 수 있는 최소 시간당 요금을 받았다고 말했습니다.그들은 또한 음성 복제 기술의 민주화가 웹사이트의 유일한 기능은 아니라고 말했습니다; 한 사용자가 연구가 공개 웹사이트 없이 수행될 수 있는지에 대한 질문에 대해 개발자는 다음과 같이 썼습니다.
[...] 웹사이트는 다양한 목적을 가지고 있습니다.프로젝트의 목소리를 낼 사람을 고용할 수 없더라도 누구나 콘텐츠를 만들 수 있는 플랫폼의 개념 증명 역할을 합니다.
또한 실제 모델을 사용할 수 있게 됨으로써 저도 몰랐던 부분을 발견할 수 있습니다(특정 음소 사이에 쉼표를 넣어 캐릭터가 헐떡거리는 소리나 신음소리를 내도록 하는 것 등).
또한 최고의 결과를 선택하고 선택하여 효과가 있는 결과만을 보여주는 것에서 벗어나지 못합니다(오늘날 ML의 큰 문제라고 생각합니다. 이는 솔직하지 못하고 오해의 소지가 있습니다).필터 없이 모델과 상호 작용할 수 있기 때문에 사용자는 현재 작업이 액면가로 얼마나 우수한지 정확하게 판단할 수 있습니다.
— 15ai, Hacker News[41]
최소한의 실행 가능한 데이터로 음성을 복제하는 것을 용이하게 하기 위해 프로젝트에서 사용된 알고리즘은 DeepThroat[43](딥 뉴럴 네트워크를 사용한 음성 합성과 딥 쓰로링의 성적 행위를 참조하는 이중 엔트렌더)로 명명되었습니다.처음에 MIT의 학부 연구 기회 프로그램의 일부로 구상된 이 프로젝트와 알고리즘은 애플리케이션이 처음 출시되기 전까지 수년 동안 개발 중이었습니다.[9][12]

또한 개발자는 마이 리틀 포니 보드인 /mlp/의 포니 보존 프로젝트와도 긴밀하게 협력했습니다.2019년부터 시작된 포니 보존 프로젝트는 인공지능에서 응용 프로그램을 개발하는 것을 목표로 "포니 데이터셋을 구축하고 큐레이션하기 위한 /mlp/의 공동 노력"입니다.[44][45][46]Friendship Is Magic 15.ai 의 목소리는 Pony Preservation Project에 의해 크라우드소싱된 대규모 데이터 세트에 대해 훈련되었습니다. Friendship Is Magic의 9개 시즌, 2017년 영화, 분할, 유출 및 동일한 성우가 목소리를 낸 다양한 콘텐츠를 포함한 쇼와 관련 미디어의 오디오 및 대화가 구문 분석되고 수기로 작성되었습니다.배경 소음을 제거하기 위해 처리됩니다.개발자에 따르면, 포니 보존 프로젝트의 집단적인 노력과 건설적인 비판이 15.ai 의 개발에 필수적인 요소라고 합니다.
게다가, 개발자는 로봇 Twilight Sparkle이 특징인 15.ai 의 로고는 (원래 Tara Strong에 의해 묘사된) 그녀의 목소리가 감정적 맥락화의 구현에 필수 불가결하다는 사실에 대한 오마주라고 말했습니다.
접수처

15.ai 은 대체로 긍정적인 반응을 얻었습니다.Game Informer의 Liana Ruppert는 15.ai 을 " simpl적으로 훌륭하다"고 묘사했습니다. Rock, Paper, Shotgon의 Lauren Morton과 PCGamer의 Natalia Clayton은 그것을 " fasc"이라고 불렀고 LaPS4의 José Villalobos는 그것이 "보이는 것만큼 쉽게 작동한다"고 썼습니다.사용자들은 목소리가 인공지능에 의해 합성되었다는 것을 모르는 사람들에게 믿을 수 있는 인기 있는 캐릭터의 오디오를 쉽게 만들 수 있는 능력을 칭찬했습니다. 코타쿠의 잭 즈위젠은 "[그의] 여자친구는 그것이 GLaDOS의 성우인 엘렌 맥레인의 새로운 음성 라인이라고 확신했다"[4]고 보고했고, 토워드 D의 리오날디 찬드라세타는 말했습니다.사이언스는 15.ai 에서 생성된 인기 캐릭터 목소리를 담은 유튜브 비디오를 보고 "[그의] 첫 번째 생각은 비디오 제작자가 원래 성우들의 새로운 대화에 대한 비용을 지불하기 위해 cameo.com 을 사용했다는 것이었다"고 썼습니다. "15.ai 에서 수행하는 목소리의 품질은 [경쟁사]보다 몇 마일 앞서 있습니다."[9]
리셉션은 해외, 특히 일본에서도 큰 호평을 받고 있습니다.Den Fami Nico Gamer의 Takayuki Furushima는 15.ai 을 "마법과 같다"고 묘사했고, Automaton Media의 Yuki Kurosawa는 그것을 "혁명적"이라고 불렀습니다.
컴퓨터 과학자이자 기술 사업가인 Andrew Ng는 그의 뉴스레터 The Batch에서 15.ai 뒤에 있는 기술이 " enorm으로 생산적"일 수 있고 "가상 배우의 사용을 혁신할 수 있다"고 언급했습니다.그는 또한 "동의 없이 인간 배우의 목소리를 synthes하는 것은 거의 틀림없이 비윤리적이고 불법적일 수 있다"고 언급했고, 사칭과 사기 사건에 잠재적으로 노출될 수 있습니다.경제학자 타일러 코웬(Tyler Cowen)은 자신의 블로그 한계 혁명에서 15명을 "인공지능과 기계 학습 분야에서 가장 과소평가된 인재" 중 한 명으로 꼽았습니다.[47]
영향
팬덤 컨텐츠 생성
15.ai 은 My Little Pony: Friendship Is Magic 팬덤, 팀 포트리스 2 팬덤, 포털 팬덤 및 스폰지밥 네모바지 팬덤을 포함한 다양한 팬덤에서 콘텐츠 제작에 자주 사용되었습니다.15.ai 의 연설을 담은 수많은 비디오와 프로젝트가 입소문을 타고 있습니다.그러나 non-15.ai 에서 생성된 연설을 포함하는 일부 비디오와 프로젝트도 입소문이 났고, 많은 비디오가 그들에게 등장하는 합성 연설의 출처를 제대로 인정하지 않습니다.결과적으로, 다른 음성 합성 소프트웨어로 만들어진 많은 비디오와 프로젝트가 15.ai 로 만들어진 것으로 잘못 인식되어 왔으며, 그 반대의 경우도 마찬가지입니다.이러한 잘못된 비난과 적절한 신용 부재로 인해 15.ai 의 서비스 약관에는 15.ai-and-non-15.ai 에서 생성한 연설을 동일한 비디오 및 프로젝트에서 사용할 수 없도록 하는 규정이 있습니다.
마이 리틀 포니: 우정은 마법입니다 팬덤은 직접적인 결과로 영상과 뮤지컬 콘텐츠 제작에서 부활을 경험했고, 인공지능에 의해 도움을 받는 새로운 장르의 팬 창작 콘텐츠에 영감을 주었습니다.일부 팬픽션은 완전한 목소리의 "에피소드"로 각색되었습니다.Tax Breaks는 2014년에 출판된 팬이 쓴 이야기를 17분 동안 애니메이션으로 제작한 것으로 사운드 이펙트와 오디오 편집과 함께 15.ai 에서 생성된 목소리를 사용하여 Friendship Is Magic의 초기 시즌의 에피소드 스타일을 모방합니다.
15.ai 의 목소리를 특징으로 하는 팀 포트리스 2 팬덤의 바이럴 비디오에는 Spy is a Furry (여러 비디오에서 유튜브에서 총 300만 뷰 이상의 조회수를 기록함)와 The RED Bread Bank가 포함되어 있으며, 둘 다 소스 필름 제작자의 애니메이션 비디오 제작에 영감을 주었습니다.다른 팬덤들은 15.ai 의 목소리를 이용해 바이러스성 비디오를 제작했습니다.2022년 7월 현재, 바이러스성 비디오 어몽 어스 스트러글(Friendship Is Magic의 목소리를 사용하는)은 유튜브에서 550만 건 이상의 조회수를 기록하고 있습니다. 유튜버, 틱토커 및 트위치 스트리머는 마인크래프트 서버 중 가장 오래된 서버 중 하나인 2b2t의 역사에 대한 핏엠씨의 비디오와 다음을 특징으로 하는 datpon3의 틱톡 비디오와 같은 비디오에 15.ai 을 사용하기도 했습니다.'우정은 마술'의 주인공들은 각각 140만 뷰와 51만 뷰를 기록했습니다.[yt 5][tt 1]
일부 사용자들은 15.ai 과 외부 음성 제어 소프트웨어를 사용하여 인공지능 가상 비서를 만들었습니다.Twitter의 한 사용자는 VoiceAttack이라는 음성 제어 시스템을 사용하여 자신의 개인 GLaDOS 데스크톱 비서를 만들었는데, 이것은 응용 프로그램을 부팅하고, 그에 상응하는 무작위 대화를 하고, 행동에 대한 사용자에게 감사를 표할 수 있습니다.[12][13]
트로이 베이커 / 보이스버스 NFT 표절 스캔들
트로이 베이커 트위터 @트로이베이커VA @Voiceverse와 파트너 관계입니다.NFT는 새로운 창작자에게 새로운 도구를 제공하여 새로운 것을 만들 수 있는 방법을 모색하고, 모든 사람이 자신이 만든 IP를 소유하고 투자할 수 있는 기회를 제공합니다.우리는 모두 할 이야기가 있습니다.미워해도 돼요.아니면 창조할 수도 있습니다.무엇을 주문하시겠습니까?
2022년1월14일[tweet 1]
2021년 12월, 15.ai 의 개발자는 트위터에 fung 불가능 토큰(NFT)을 작업에 통합하는 데 관심이 없다고 게시했습니다.
2022년 1월 14일, 비디오 게임 및 애니메이션 더빙 성우 트로이 베이커(Troy Baker)가 마케팅 캠페인의 일환으로 15.ai 에서 생성된 음성 라인을 표절했다는 사실이 밝혀졌습니다.로그 파일에 따르면 Voiceverse는 My Little Pony: Friendship Is Magic(15.ai 을 사용하여 Twilight Sparkle(트와일라잇 스파클)과 Rainbow Dash(레인보우 대시)의 오디오를 생성하여 원래 목소리에서 알아볼 수 없게 만들고 적절한 크레딧 없이 자신의 플랫폼을 허위로 마케팅하기 위해 도용한 것으로 나타났습니다. 이는 15를 위반한 것입니다.ai의 서비스 조건.[37][11][16]
15 트위터 @fifteen라이 앞서 언급한 NFT 보컬 합성이 자신들의 이익을 위해 내 작업을 적극적으로 수용하려고 시도하고 있다는 소식을 들었습니다.로그 파일을 샅샅이 뒤지고 보니, 그들이 공을 들이고 있는 몇몇 목소리들이 정말로 내 사이트에서 만들어졌다는 증거가 있습니다.
2022년1월14일[tweet 3]
보이스버스 오리진 트위터 @보이스버스NFT 안녕하세요 @15ai 우리는 이것에 대해 매우 유감입니다.그 목소리는 우리 마케팅팀이 제대로 된 신용을 주지 않고 사용한 당신의 플랫폼에서 가져온 것입니다.Chubbiverse 팀은 이것에 대해 알지 못합니다.다시는 이런 일이 없도록 하겠습니다.
2022년1월14일[tweet 4]
Voiceverse는 Baker와의 파트너십 발표 일주일 전에 (현재 삭제된)Voiceverse가 제휴한 NFT 플랫폼인 Chubbiverse가 게시한 (현재 삭제된) 비디오에 직접 응답하는 트위터 게시물은 AI가 생성한 음성을 보여주며 Voiceverse의 플랫폼을 사용하여 생성되었다고 주장하며 "이것을 위한 음성을 누가 만들었는지 궁금합니다;"[14][tweet 6]라고 말했습니다. 제휴 소식이 전해지고 몇 시간 후 개발자 of 15.ai - 제휴에 대한 의견을 묻는 다른 트위터 사용자에 의해 경고를 받은 후, 그는 "스캠처럼 sounds"라고 추측했습니다. posted 로그 파일의 스크린샷은 웹사이트의 사용자가 (IP 주소가 수정된) Chubbiverse가 게시한 비디오에서 AI 음성이 말한 정확한 단어를 입력했음을 증명했습니다.그 후 보이스버스의 주장에 직접적인 반응을 보이며 "확실히 당신은 아닙니다 :)"[37][15][tweet 9]라는 트윗을 올렸습니다.
트윗 이후, 보이스버스는 15.ai 의 목소리를 자신들의 플랫폼으로 표절했다는 것을 인정하면서, 그들의 마케팅 팀이 적절한 신용을 주지 않고 프로젝트를 사용했고, "츄비버스 팀은 이것을 알지 못했습니다"라고 주장했습니다.입학 허가에 대해, 15명은 트위터에 "가서 엿이나 먹어"라고 썼습니다.[14][15][16][37]최종 트윗은 여러 게시물에 걸쳐 총 좋아요 75,000개 이상과 총 리트윗 13,000개를 기록하며 입소문이 났습니다.[tweet 10][tweet 11][tweet 12]
Baker와 Voiceverse의 초기 협력 관계는 심각한 반발과 전반적으로 부정적인 반응에 부딪혔습니다.[14]비평가들은 NFT 판매와 관련된 퇴출 사기의 환경적 영향과 잠재력을 강조했습니다.[51]논평가들은 또한 파트너십을 발표한 베이커의 첫 번째 트윗에서 아이러니를 지적했고, "당신은 미워할 수 있습니다.아니면 창조할 수도 있습니다.문제의 업체가 자체 제품을 만드는 대신 절도에 의존했다는 사실이 공개되기 몇 시간 전.베이커는 사람들이 그들의 생각을 공유하는 것에 감사하다고 대답했고 그들의 대답은 "그에게 많은 생각을 주었다"고 대답했습니다.[52][53]그는 또한 그의 첫 번째 트윗에서 "혐오/창조" 부분이 "약간 적대적"이었을 수도 있음을 인정하고 소셜 미디어의 팬들에게 자신을 용서해달라고 요청했습니다.[15][54]2주 후인 1월 31일, 베이커는 보이스버스와의 파트너십을 중단한다고 발표했습니다.[55][56][57]
성우 반응
일부 성우들은 음성 복제 기술의 사용을 공개적으로 비난했습니다.그 이유로는 가장과 사기에 대한 우려, 포르노에 배우의 목소리를 무단으로 사용하는 것, AI가 성우를 쓸모없게 만드는 데 사용될 수 있는 가능성 등이 있습니다.[8][10][11]
참고 항목
메모들
참고문헌
- 메모들
- ^ Kong, Jungil (2020). "HiFi-GAN: Generative Adversarial Networks for Efficient and High Fidelity Speech Synthesis". arXiv:2010.05646v2 [cs].
- ^ Binkowski, Mikołaj (2019). "High Fidelity Speech Synthesis with Adversarial Networks". arXiv:1909.11646v2 [cs].
- ^ a b c van den Oord, Aäron; Li, Yazhe; Babuschkin, Igor (November 12, 2017). "High-fidelity speech synthesis with WaveNet". DeepMind. Archived from the original on June 18, 2022. Retrieved June 5, 2022.
- ^ a b c d e Zwiezen, Zack (January 18, 2021). "Website Lets You Make GLaDOS Say Whatever You Want". Kotaku. Kotaku. Archived from the original on January 17, 2021. Retrieved January 18, 2021.
- ^ a b c d Ruppert, Liana (January 18, 2021). "Make Portal's GLaDOS And Other Beloved Characters Say The Weirdest Things With This App". Game Informer. Game Informer. Archived from the original on January 18, 2021. Retrieved January 18, 2021.
- ^ a b c Clayton, Natalie (January 19, 2021). "Make the cast of TF2 recite old memes with this AI text-to-speech tool". PC Gamer. PC Gamer. Archived from the original on January 19, 2021. Retrieved January 19, 2021.
- ^ a b Morton, Lauren (January 18, 2021). "Put words in game characters' mouths with this fascinating text to speech tool". Rock, Paper, Shotgun. Rock, Paper, Shotgun. Archived from the original on January 18, 2021. Retrieved January 18, 2021.
- ^ a b c d e Ng, Andrew (April 1, 2020). "Voice Cloning for the Masses". The Batch. The Batch. Archived from the original on August 7, 2020. Retrieved April 5, 2020.
- ^ a b c d e f g Chandraseta, Rionaldi (January 19, 2021). "Generate Your Favourite Characters' Voice Lines using Machine Learning". Towards Data Science. Archived from the original on January 21, 2021. Retrieved January 23, 2021.
- ^ a b c Ng, Andrew (March 7, 2021). "Weekly Newsletter Issue 83". The Batch. The Batch. Archived from the original on February 26, 2022. Retrieved March 7, 2021.
- ^ a b c d Lopez, Ule (January 16, 2022). "Troy Baker-backed NFT firm admits using voice lines taken from another service without permission". Wccftech. Wccftech. Archived from the original on January 16, 2022. Retrieved June 7, 2022.
- ^ a b c d e f g h i j Kurosawa, Yuki (January 19, 2021). "ゲームキャラ音声読み上げソフト「15.ai」公開中。『Undertale』や『Portal』のキャラに好きなセリフを言ってもらえる". AUTOMATON. AUTOMATON. Archived from the original on January 19, 2021. Retrieved January 19, 2021.
- ^ a b c d e Yoshiyuki, Furushima (January 18, 2021). "『Portal』のGLaDOSや『UNDERTALE』のサンズがテキストを読み上げてくれる。文章に込められた感情まで再現することを目指すサービス「15.ai」が話題に". Denfaminicogamer. Archived from the original on January 18, 2021. Retrieved January 18, 2021.
- ^ a b c d e Williams, Demi (January 18, 2022). "Voiceverse NFT admits to taking voice lines from non-commercial service". NME. NME. Archived from the original on January 18, 2022. Retrieved January 18, 2022.
- ^ a b c d e f Wright, Steve (January 17, 2022). "Troy Baker-backed NFT company admits to using content without permission". Stevivor. Archived from the original on January 17, 2022. Retrieved January 17, 2022.
- ^ a b c d Henry, Joseph (January 18, 2022). "Troy Baker's Partner NFT Company Voiceverse Reportedly Steals Voice Lines From 15.ai". Tech Times. Archived from the original on January 26, 2022. Retrieved February 14, 2022.
- ^ "15 on Twitter: "(I probably won't open Twitter again until I finally get this up and running.)" / Twitter". Twitter. Retrieved June 6, 2023.
- ^ a b c Villalobos, José (January 18, 2021). "Descubre 15.AI, un sitio web en el que podrás hacer que GlaDOS diga lo que quieras". LaPS4. LaPS4. Archived from the original on January 18, 2021. Retrieved January 18, 2021.
- ^ Moto, Eugenio (January 20, 2021). "15.ai, el sitio que te permite usar voces de personajes populares para que digan lo que quieras". Yahoo! Finance. Yahoo! Finance. Archived from the original on March 8, 2022. Retrieved January 20, 2021.
- ^ Felbo, Bjarke (2017). "Using millions of emoji occurrences to learn any-domain representations for detecting sentiment, emotion and sarcasm". Proceedings of the 2017 Conference on Empirical Methods in Natural Language Processing. pp. 1615–1625. arXiv:1708.00524. doi:10.18653/v1/D17-1169. S2CID 2493033.
- ^ Corfield, Gareth (August 7, 2017). "A sarcasm detector bot? That sounds absolutely brilliant. Definitely". The Register. The Register. Archived from the original on June 2, 2022. Retrieved June 2, 2022.
- ^ "An Algorithm Trained on Emoji Knows When You're Being Sarcastic on Twitter". MIT Technology Review. MIT Technology Review. August 3, 2017. Archived from the original on June 2, 2022. Retrieved June 2, 2022.
- ^ "Emojis help software spot emotion and sarcasm". BBC. BBC. August 7, 2017. Archived from the original on June 2, 2022. Retrieved June 2, 2022.
- ^ Lowe, Josh (August 7, 2017). "Emoji-Filled Mean Tweets Help Scientists Create Sarcasm-Detecting Bot That Could Uncover Hate Speech". Newsweek. Newsweek. Archived from the original on June 2, 2022. Retrieved June 2, 2022.
- ^ Valle, Rafael (2020). "Mellotron: Multispeaker expressive voice synthesis by conditioning on rhythm, pitch and global style tokens". arXiv:1910.11997 [eess].
- ^ Cooper, Erica (2020). "Zero-Shot Multi-Speaker Text-To-Speech with State-of-the-art Neural Speaker Embeddings". arXiv:1910.10838 [eess].
- ^ Klautau, Aldebaro (2001). "ARPABET and the TIMIT alphabet" (PDF). Archived from the original (PDF) on June 3, 2016. Retrieved September 8, 2017.
- ^ "Phonetics" (PDF). Columbia University. Columbia University. 2017. Archived (PDF) from the original on June 19, 2022. Retrieved June 11, 2022.
- ^ Loots, Linsen (March 2010). Data-Driven Augmentation of Pronunciation Dictionaries (MSc). Stellenbosch University, Department of Electrical & Electronic Engineering. CiteSeerX 10.1.1.832.2872. Archived from the original on June 11, 2022. Retrieved June 11, 2022.
Table 3.2
- ^ "The CMU Pronouncing Dictionary". CMU Pronouncing Dictionary. CMU Pronouncing Dictionary. July 16, 2015. Archived from the original on June 3, 2022. Retrieved June 4, 2022.
- ^ Hsu, Wei-Ning (2018). "Hierarchical Generative Modeling for Controllable Speech Synthesis". arXiv:1810.07217 [cs.CL].
- ^ Habib, Raza (2019). "Semi-Supervised Generative Modeling for Controllable Speech Synthesis". arXiv:1910.01709 [cs.CL].
- ^ "Audio samples from "Semi-Supervised Training for Improving Data Efficiency in End-to-End Speech Synthesis"". August 30, 2018. Archived from the original on November 11, 2020. Retrieved June 5, 2022.
- ^ Shen, Jonathan; Pang, Ruoming; Weiss, Ron J.; Schuster, Mike; Jaitly, Navdeep; Yang, Zongheng; Chen, Zhifeng; Zhang, Yu; Wang, Yuxuan; Skerry-Ryan, RJ; Saurous, Rif A.; Agiomyrgiannakis, Yannis; Wu, Yonghui (2018). "Natural TTS Synthesis by Conditioning WaveNet on Mel-Spectrogram Predictions". arXiv:1712.05884 [cs.CL].
- ^ Chung, Yu-An (2018). "Semi-Supervised Training for Improving Data Efficiency in End-to-End Speech Synthesis". arXiv:1808.10128 [cs.CL].
- ^ Ren, Yi (2019). "Almost Unsupervised Text to Speech and Automatic Speech Recognition". arXiv:1905.06791 [cs.CL].
- ^ a b c d Phillips, Tom (January 17, 2022). "Troy Baker-backed NFT firm admits using voice lines taken from another service without permission". Eurogamer. Eurogamer. Archived from the original on January 17, 2022. Retrieved January 17, 2022.
- ^ - F.2d – (2d Cir, 2015).(임시 인용: 2015 U.S. App. LEXIS 17988; Slip openion (2015. 10. 16)
- ^ a b Stewart, Matthew (October 31, 2019). "The Most Important Court Decision For Data Science and Machine Learning". Towards Data Science. Archived from the original on February 21, 2022. Retrieved February 21, 2022.
- ^ "15". Twitter. June 9, 2022. Retrieved June 9, 2022.
- ^ a b c "15.ai". Hacker News. June 12, 2022. Archived from the original on June 13, 2022. Retrieved June 13, 2022.
- ^ "Pay, Credit & Volunteer". MIT UROP. Archived from the original on June 19, 2022. Retrieved June 13, 2022.
- ^ "15.ai – About". 15.ai. February 20, 2022. Retrieved February 20, 2022.
- ^ a b c Branwen, Gwern (March 6, 2020). ""15.ai" , 15, Pony Preservation Project". Gwern.net. Gwern. Archived from the original on March 18, 2022. Retrieved June 17, 2022.
- ^ Scotellaro, Shaun (March 14, 2020). "Neat "Pony Preservation Project" Using Neural Networks to Create Pony Voices". Equestria Daily. Equestria Daily. Archived from the original on June 23, 2021. Retrieved June 11, 2022.
- ^ "Pony Preservation Project (Thread 108)". 4chan. Desuarchive. February 20, 2022. Retrieved February 20, 2022.
- ^ Cowen, Tyler (May 12, 2022). "The most underrated talent in AI?". Marginal Revolution (blog). Marginal Revolution (blog). Archived from the original on June 19, 2022. Retrieved June 16, 2022.
- ^ "15.ai – FAQ". 15.ai. January 18, 2021. Retrieved January 18, 2021.
- ^ Scotellaro, Shaun (May 15, 2022). "Full Simple Animated Episode – The Tax Breaks (Twilight)". Equestria Daily. Equestria Daily. Archived from the original on May 21, 2022. Retrieved May 28, 2022.
- ^ "The Terribly Taxing Tribulations of Twilight Sparkle". Fimfiction.net. April 27, 2014. Archived from the original on June 30, 2022. Retrieved April 28, 2022.
- ^ Phillips, Tom (January 14, 2022). "Video game voice actor Troy Baker is now promoting NFTs". Eurogamer. Eurogamer. Archived from the original on January 14, 2022. Retrieved January 14, 2022.
- ^ McWhertor, Michael (January 14, 2022). "The Last of Us voice actor wants to sell 'voice NFTs,' drawing ire". Polygon. Archived from the original on January 14, 2022. Retrieved January 14, 2022.
- ^ "Last Of Us Voice Actor Pisses Everyone Off With NFT Push". Kotaku. January 14, 2022. Archived from the original on January 14, 2022. Retrieved January 14, 2022.
- ^ Purslow, Matt (January 14, 2022). "Troy Baker Is Working With NFTs, but Fans Are Unimpressed". IGN. Archived from the original on January 14, 2022. Retrieved January 14, 2022.
- ^ Strickland, Derek (January 31, 2022). "Last of Us actor Troy Baker heeds fans, abandons NFT plans". Tweaktown. Archived from the original on January 31, 2022. Retrieved January 31, 2022.
- ^ Peterson, Danny (January 31, 2022). "'The Last of Us' actor Troy Baker reverses course on NFTs amid fan backlash". We Got This Covered. Archived from the original on February 14, 2022. Retrieved February 14, 2022.
- ^ Peters, Jay (January 31, 2022). "The voice of Joel from The Last of Us steps away from NFT project after outcry". The Verge. Archived from the original on February 4, 2022. Retrieved February 4, 2022.
- 트윗
- ^ @TroyBakerVA (January 14, 2022). "I'm partnering with @VoiceverseNFT to explore ways where together we might bring new tools to new creators to make new things, and allow everyone a chance to own & invest in the IP's they create. We all have a story to tell. You can hate. Or you can create. What'll it be?" (Tweet) – via Twitter.
- ^ @fifteenai (December 12, 2021). "I have no interest in incorporating NFTs into any aspect of my work. Please stop asking" (Tweet) – via Twitter.
- ^ @fifteenai (January 14, 2022). "I've been informed that the aforementioned NFT vocal synthesis is actively attempting to appropriate my work for their own benefit. After digging through the log files, I have evidence that some of the voices that they are taking credit for were indeed generated from my own site" (Tweet) – via Twitter.
- ^ @VoiceverseNFT (January 14, 2022). "Hey @fifteenai we are extremely sorry about this. The voice was indeed taken from your platform, which our marketing team used without giving proper credit. Chubbiverse team has no knowledge of this. We will make sure this never happens again" (Tweet) – via Twitter.
- ^ @fifteenai (January 14, 2022). "Go fuck yourself" (Tweet) – via Twitter.
- ^ @VoiceverseNFT (January 7, 2022). "I wonder who created the voice for this? ;)" (Tweet). Archived from the original on January 7, 2022 – via Twitter.
- ^ @fifteenai (January 14, 2022). "Sounds like a scam" (Tweet) – via Twitter.
- ^ @fifteenai (January 14, 2022). "Give proper credit or remove this post" (Tweet) – via Twitter.
- ^ @fifteenai (January 14, 2022). "Certainly not you :)" (Tweet) – via Twitter.
- ^ @fifteenai (January 14, 2022). "Go fuck yourself" (Tweet) – via Twitter.
- ^ @yongyea (January 14, 2022). "The NFT scheme that Troy Baker is promoting is already finding itself in trouble after stealing and profiting off of somebody else's work. Who could've seen this coming" (Tweet) – via Twitter.
- ^ @BronyStruggle (January 15, 2022). "actual" (Tweet) – via Twitter.
- YouTube (뷰 수 및 15.ai 사용에 대해서만 referen)
- ^ "SPY IS A FURRY". YouTube. Archived from the original on June 13, 2022. Retrieved June 14, 2022.
- ^ "Spy is a Furry Animated". YouTube. Archived from the original on June 14, 2022. Retrieved June 14, 2022.
- ^ "[SFM] – Spy's Confession – [TF2 15.ai]". YouTube. Archived from the original on June 30, 2022. Retrieved June 14, 2022.
- ^ "Among Us Struggles". YouTube. Retrieved July 15, 2022.
- ^ "The UPDATED 2b2t Timeline (2010–2020)". YouTube. Archived from the original on June 1, 2022. Retrieved June 14, 2022.
- 틱톡
- ^ "She said " 👹 "". TikTok. Retrieved July 15, 2022.




