SIGNFY AI: ZAMONAVIY BOT TEXNOLOGIYASI VA INKLYUZIV MULOQOTNING YANGI IMKONIYATLARI SIGNFY AI: MODERN BOT TECHNOLOGY AND NEW OPPORTUNITIES FOR INCLUSIVE COMMUNICATION
DOI:
https://doi.org/10.65164/szvgk127Kalit so‘zlar:
SIGNFY AI, inklyuzivlik, sun'iy intellekt, nutqni matnga aylantirish, o'zbek tili, muloqot to'siqlari, real vaqt rejimi, ijtimoiy integratsiya, texnologik innovatsiya, Markaziy Osiyo.Abstrak
21-asrda inklyuziv texnologiyalarni rivojlantirish insonlarning jamiyatga integratsiyalashuvi va muloqot to'siqlarini bartaraf etishning muhim omiliga aylandi. Raqamli texnologiyalarning ta'limdan tortib xizmat ko'rsatish sohasigacha keng joriy etilishi barcha uchun qulay va teng imkoniyatli tizimlarni yaratishni talab qilmoqda. Ushbu maqola SIGNFY AI loyihasining kar va zaif eshituvchi insonlar hayotidagi o'rnini tahlil qiladi hamda sun'iy intellekt va insoniy muloqot o'rtasidagi o'zaro bog'liqlikni yoritadi. Tadqiqotda real vaqt rejimida ovozni matnga aylantirish, mahalliy tilni qo'llab-quvvatlash va samarali sun'iy intellekt modellarini ishlab chiqishning ahamiyati ko'rsatib berilgan. Bundan tashqari, maqolada zamonaviy tendensiyalar, 0.5–1 soniya kechikish ko'rsatkichlari va biznes modeli tahlil qilinib, SIGNFY AI'ning raqamli jamiyatda inklyuzivlikni oshirishdagi roli yoritilgan. Tadqiqot natijalari texnologiyaning ta'lim, ish va ijtimoiy sohalarda sezilarli ijobiy ta'sir ko'rsatayotganini isbotlaydi.
Havolalar
[1]. Baevski, A., Zhou, Y., Mohamed, A., & Auli, M. (2020). wav2vec 2.0: A framework for self-supervised learning of speech representations. Advances in Neural Information Processing Systems, 33, 12449–12460.
[2]. Graves, A., Mohamed, A., & Hinton, G. (2013). Speech recognition with deep recurrent neural networks. IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), 6645–6649. https://doi.org/10.1109/ICASSP.2013.6638947
[3]. Hinton, G., Deng, L., Yu, D., Dahl, G., Mohamed, A., Jaitly, N., ... & Kingsbury, B. (2012). Deep neural networks for acoustic modeling in speech recognition. IEEE Signal Processing Magazine, 29(6), 82–97. https://doi.org/10.1109/MSP.2012.2205597
[4]. International Labour Organization. (2020). Disability and work. ILO. https://www.ilo.org/global/topics/disability-and-work
[5]. Kak, M., West, S. M., & Myers, A. (2021). Disability, bias, and AI. AI Now Institute. https://ainowinstitute.org/disabilitybiasai-2019.pdf
[6]. Musaev, M., & Yusupov, S. (2022). Uzbek speech recognition: Challenges and prospects. Central Asian Journal of Computer Science, 4(1), 12–19.
[7]. Rabiner, L. R. (1989). A tutorial on hidden Markov models and selected applications in speech recognition. Proceedings of the IEEE, 77(2), 257–286. https://doi.org/10.1109/5.18626
[8]. Radford, A., Kim, J. W., Xu, T., Brockman, G., McLeavey, C., & Sutskever, I. (2022). Robust speech recognition via large-scale weak supervision. arXiv preprint arXiv:2212.04356. https://doi.org/10.48550/arXiv.2212.04356
[9]. Shannon, C. E. (1948). A mathematical theory of communication. Bell System Technical Journal, 27(3), 379–423. https://doi.org/10.1002/j.1538-7305.1948.tb01338.x
[10]. UNESCO. (2009). Policy guidelines on inclusion in education. UNESCO. https://unesdoc.unesco.org/ark:/48223/pf0000177849
1767
[11]. Vaswani, A., Shazeer, N., Parmar, N., Uszkoreit, J., Jones, L., Gomez, A. N., ... & Polosukhin, I. (2017). Attention is all you need. Advances in Neural Information Processing Systems, 30. https://doi.org/10.48550/arXiv.1706.03762
[12]. World Health Organization. (2021). World report on hearing. WHO Press. https://www.who.int/publications/i/item/world-report-on-hearing
[13]. Zhang, Y., Park, D. S., Han, W., Qin, J., Gulati, A., Shor, J., ... & Le, Q. (2022). BigSSL: Exploring the frontier of large-scale semi-supervised learning for automatic speech recognition. IEEE Journal of Selected Topics in Signal Processing, 16(6), 1519–1532. https://doi.org/10.1109/JSTSP.2022.3182537
[14]. Zhu, X., & Ghahramani, Z. (2022). Semi-supervised learning literature survey. University of Wisconsin-Madison, Computer Sciences Technical Report, 1530.
[15]. Panayotov, V., Chen, G., Povey, D., & Khudanpur, S. (2015). LibriSpeech: An ASR corpus based on public domain audio books. IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), 5206–5210. https://doi.org/10.1109/ICASSP.2015.7178964