Abstract
Kentaro Seki, Shinnosuke Takamichi, Takaaki Saeki, Hiroshi Saruwatari
Abstract
Authors
Institutions
No ROR-resolved institution is linked to this work yet.
Provenance
crossref
Confidence 100%
unpaywall
Confidence 95%
datacite
Confidence 0%
No local reference links have been materialized yet.
No local citing links have been materialized yet.
10.1109/icassp.2018.8461368
10.1109/icassp.2018.8461368
10.21437/interspeech.2019-2441
10.21437/interspeech.2019-2441
10.1109/icassp49357.2023.10095161
10.1109/icassp49357.2023.10095161
J-CHAT: Japanese large-scale spoken dialogue corpus for spoken dialogue language modeling
2024
10.1109/slt61566.2024.10832365
10.1109/slt61566.2024.10832365
10.1109/apsipaasc65261.2025.11249057
10.1109/apsipaasc65261.2025.11249057
10.1109/access.2025.3645005
10.1109/access.2025.3645005
10.1016/0167-6393(90)90011-w
10.1016/0167-6393(90)90011-w
Active learning for convolutional neural networks: A core-set approach
2017
Coresets for data-efficient training of machine learning models
Kept as external metadata until matched
10.1007/978-3-031-12423-5_14
10.1007/978-3-031-12423-5_14
A coreset selection of coreset selection literature: Introduction and recent advances
2025
10.21437/interspeech.2021-1965
10.21437/interspeech.2021-1965
JTubeSpeech: Corpus of Japanese speech collected from YouTube for speech recognition and speaker verification
2021
10.1109/asru57964.2023.10389689
10.1109/asru57964.2023.10389689
10.1109/taslp.2017.2688585
10.1109/taslp.2017.2688585
10.21437/interspeech.2018-1313
10.21437/interspeech.2018-1313
10.21437/interspeech.2020-2567
10.21437/interspeech.2020-2567
10.21437/interspeech.2019-2190
10.21437/interspeech.2019-2190
10.1109/icspcc55723.2022.9984283
10.1109/icspcc55723.2022.9984283
10.21437/interspeech.2016-502
10.21437/interspeech.2016-502
10.21437/interspeech.2022-294
10.21437/interspeech.2022-294
10.1609/aaai.v37i11.26488
10.1609/aaai.v37i11.26488
Rep2wav: Noise robust text-to-speech using self-supervised representations
2023
10.1007/s11042-020-09783-9
10.1007/s11042-020-09783-9
Fast greedy map inference for determinantal point process to improve recommendation diversity
Kept as external metadata until matched
10.1145/1526709.1526761
10.1145/1526709.1526761
10.21437/interspeech.2021-299
10.21437/interspeech.2021-299
10.1109/taslpro.2025.3633089
10.1109/taslpro.2025.3633089
10.18653/v1/n19-1423
10.18653/v1/n19-1423
Wav2vec 2.0: A framework for self-supervised learning of speech representations
Kept as external metadata until matched
10.1109/icassp.2018.8461375
10.1109/icassp.2018.8461375
10.1145/290941.291025
10.1145/290941.291025
10.1145/3086464
10.1145/3086464
10.1109/access.2018.2850935
10.1109/access.2018.2850935
10.52202/068431-0201
10.52202/068431-0201
10.1109/tkde.2024.3382262
10.1109/tkde.2024.3382262
JVS corpus: Free Japanese multi-speaker voice corpus
2019
10.21437/interspeech.2021-755
10.21437/interspeech.2021-755
10.21437/interspeech.2023-1584
10.21437/interspeech.2023-1584
10.1109/taslp.2021.3122291
10.1109/taslp.2021.3122291 · doi-reference
10.1109/icassp48485.2024.10448291
10.1109/icassp48485.2024.10448291 · doi-reference
10.1109/jstsp.2022.3188113
10.1109/jstsp.2022.3188113 · doi-reference
10.21437/interspeech.2022-439
10.21437/interspeech.2022-439 · doi-reference
10.1109/icassp.2015.7178964
10.1109/icassp.2015.7178964 · doi-reference