人工智能(AI)现在可以做到只参考一小段音频,就能生成一个人面部的数字图像。
据美国趣味科学网站6月11日报道,科学家用网上数百万段教学视频,对这种名为“讲话到面孔”的神经网络——以类似人脑方式“思考”的计算机——进行了训练,视频内容是10万多个不同面孔讲话的场景。
研究人员在一项新的研究结果中写道,通过这些数据集,“讲话到面孔”掌握了声音信息与人脸某些特征之间存在的关联。然后,人工智能会利用一段音频来塑造与语音匹配的拟真面孔。
这一研究结果5月23日发表在阿奇夫论文预印本网站上,尚未接受同行评议。
报道称,值得庆幸的是,人工智能(尚)不能仅凭一个人的声音就知道他到底长什么样。研究报告的撰写者说,该神经网络会识别讲话中指向性别、年龄和种族的一些标记,这些特征是许多人共有的。
科学家在研究报告中写道:“如此一来,该模型只会形成普通长相的面孔。它不会形成特定个人的形象。”
人工智能已经证明,它可以生成准确度高得惊人的人脸,不过坦率地讲,它所塑造的猫脸有点恐怖。
报道称,“讲话到面孔”生成的人脸——都是面朝前方,没什么表情——与声音背后的人并不严格匹配。不过研究结果表明,它生成的形象确实经常捕捉到了讲话者正确的年龄段、种族和性别。
然而,这种算法对声音信息的解读还远未达到完美。在面对不同的语言时,“讲话到面孔”表现得好坏参半。例如,人工智能在听了一段亚洲人讲中文的音频后,相关程序形成了一个亚洲人的面孔。然而,据科学家说,当同一个人在另一段音频中用英语说话时,人工智能生成了一个白人的面孔。
该算法还显示出性别上的偏见,将低沉的声音与男性面孔联系起来,将尖细的嗓音与女性面孔联系起来。研究人员在报告中写道,由于用来训练人工智能的数据集只是YouTube网站上的教学视频,因此“不能代表全世界的人口”。
特别声明:
转载上述内容请注明出处并加链接。上述内容仅代表作者或发布者的观点,与中国电子商会官网的立场无关。如有任何疑问或了解更多,请与我们联系。电话:4008 900 668 邮箱:service@cecc.org.cn
随着人工智能大模型的加速发展,智能手机正在拥抱这一新机遇。苹果、三星、华为、荣耀、vivo、OPPO、小米、魅族等企业纷纷布局AI(人工智能)手机,推动AI技术在手机行业快速发展和广泛应用。...
2024-03-20中央经济工作会议明确提出,“发展数字经济”“加快推动人工智能发展”。人工智能已经成为经济社会发展的驱动力量,加快发展新一代人工智能是我们赢得全球科技竞争主动权的重要战略抓手。必须抓住新一轮科技革命和产业变革的战略机遇,充分发挥我国超大规模市场应用场景丰富的独特优势,加快人工智能领域的科学技术创新,以人工智能高质量发展和高水平应用培育经济发展新动能。...
2024-03-20