别人做PPT
加班!加班!加班!
我做PPTAI自动生成!轻松下班!
tome
beautiful ai
Mdourr
ChatGPT
ChatGPT 是 OpenAI 公开的一款人工智能聊天机器人它基于 GPT-3 这个大规模的语言模型,可以与用户进行自然而有趣的对话。ChatGPT 可以回答用户的问题
份PPT制作流程
以下是一份PPT制作流程,供参考:
1。确定主题和目标受众:确定你要展示的主题和目标受众是谁
2收集资料:根据主颖和目标受众收集资料,包括文本、图像、视频等
3制作大纲:根据资料制作大纲,确定PPT的结构和内容。
4.设计布局:根据主题和目标受众选择适合的PPT横板和布局,并进行适当的修改和调整。
5.添加内容: 将大纲中的内容逐步添加到PPT中,注意文字的排版和图像的使
用。
6.优化排版:对文字和图像进行调整,保持整体的美观和清晰。
7.添加动画和转场效果:根据需要添加动画和转场效果,使PPT更生动有趣8.预览和修改:预览整个PPT,并对其中的内容、排版、动画等进行必要的修改和调整。
9.演示:在演示前检查一遍,确保所有内容和效果都正常运行,然后进行演
示。
山4
Midjourney
绘画AI,效果超赞,海报、写实图片轻松生成
Midjourney 生成超清晰图像的倾向增加了整体的真实感,只需输入文字就会自动产生图像~
Tome
一款 AI 驱动、自动生成 PPT 内容生成工具,可以帮助我们快速生成创意丰富、逻辑清晰、视觉美观的PPT内容,每页 PPT 内容支持添加视频解说,也提供异步视频协同沟通哦~
beautiful.ai
Beautiful.ai 是一个在线的PPT生成AI其界面设计非常简单明了,很容易上手~而且可以将数据通过图表和图形的形式展示出来,让人一目了然
AutoDraw
这款软件拥有非常强大的自动识别功能,我们只需要通过鼠标来绘制一部分的图形内容,这款软件就可以通过你绘制的内容来进行自动匹配,让你找到自己想要的图画,从而大大提高你的绘画效率
ITDaily & AI 中国每日最新 IT 圈 AI 圈新鲜事吐槽 给你想看的想象一下,在选举前几天,一个候选人的视频被发布,显示他们使用仇恨言论,种族污蔑,以及削弱他们作为亲少数族裔的形象。想象一下,一个十几岁的孩子看着一段令人尴尬的露骨视频在社交媒体上传播。想象一下,一个CEO在筹集资金的路上,当一段陈述她对产品的恐惧和焦虑的音频片段被发送给投资人时,毁掉了她成功的机会。以上所有的场景都是假的、编造的,并不是真实的,但可以通过人工智能生成的合成媒体,也就是所谓的DeepFake[1],使之成为现实。同样的技术,可以让一位因卢伽雷氏病而失声的母亲用合成语音与家人对话,也可以用来生成政治候选人的假演讲,以损害其名誉。同样的技术,可以让老师使用合成视频与学生进行有效的互动,也可以用来制作一个青少年的假视频来损害其声誉。人工智能(AI)和云计算技术、GPU虚拟机和平台服务的进步,使得音频、视频和图像处理技术的复杂性得到了快速发展。商品化云计算的接入、公共研究的人工智能算法,以及丰富的数据和多样化海量媒体的可用性,为合成媒体的创作民主化创造了一场完美的风暴。这种人工智能生成的合成媒体被称为深层假造。通过社交平台,合成媒体的传播实现了规模化的民主化。GAN技术的创新和研究,加上计算的日益普及,使得合成数据的质量以惊人的速度提高。新的工具,其中许多是公开的,可以以越来越可信的方式操纵媒体,例如创建一个公众人物的声音副本或将一个人的脸叠加到另一个人的身体上。GAN和deepfakes已经从研究和学术课题发展到企业创新、 娱乐 和参与 社会 活动的实际应用。Cheapfake是通过简单的常规编辑技术,如加速、减速、剪切等,以及非技术性的操作,如重新编排或重构现有媒体。廉价伪造的一个例子是 "醉酒的佩洛西 "视频[2]。我们看到一些政治广告中使用了重新着色和修饰的手法,这也是一种廉价的假货[3]。Deepfakes已经成为换脸和对口型的代名词。还有很多其他类型的基于人工智能的音频、视频和图像的操作都可以被称为Deepfakes。换脸是指一个人的脸被另一个人的脸或另一张脸的关键特征所取代或重构。脸部交换或用滤镜进行操作,几乎是所有社交媒体、视频聊天应用的常见功能。从2014年开始,社交媒体应用Snapchat就有了增强人脸的滤镜。利用人脸检测镜头技术,你可以让自己变老,添加美颜滤镜,或者给自己装上猫耳朵和胡须。这些应用和技术的输出将被定性为AI-Generated合成媒体或deepfakes。大量的免费和付费应用和在线工具让两个人的换脸变得超级简单。开发者可以使用GitHub上的Faceswap和DeepFaceLab的开源代码来创建非常复杂的deepfakes,并在定制代码和训练AI模型方面做出一些努力。操控术是用人工智能渲染操纵的全身动作和行为。它是一种在视频中创建目标脸部和身体的3D模型来作为木偶人的行为和说的技术。它也被称为全身深度假动作。2018年8月,加州大学伯克利分校发表了一篇名为《Everybody Dance Now》的论文[4]。这是研究人工智能如何将专业舞者的动作转移到业余爱好者的身上。日本人工智能公司Data Grid创造了一个AI引擎,可以自动生成广告和 时尚 的虚拟模型。唇语同步是一种渲染嘴部动作和面部表情的技术,让目标人物用声音和正确的语气和音调说事情。AI算法可以将一个人说话的现有视频,改变视频中的唇部动作,以匹配新的音频。这些音频可能是断章取义的旧讲话,也可能是模仿者说话或合成的讲话。演员和导演乔丹-皮尔就用这种技术制作了奥巴马的病毒视频。Voice Coning是一种深度学习的算法,它可以接收个人的语音记录,生成与原声过分相似的合成语音。它是一种创建个人的自定义语音字库,然后用字库来生成语音的技术。开发合成语音的应用和云服务有很多,微软定制语音、Lyrebird AI、iSpeech和VOCALiD,个人和企业都可以使用这样的技术来提高自己的机构。图像生成或图像合成是一种利用计算机视觉技术、深度学习和生成式对抗网络(GANs)来合成新图像的技术。它可以生成计算机生成的人或任何非真实物体的图像。英伟达的一个团队用从Flickr上提取的人脸图片训练了一台计算机,创建了网站ThisPersonDoesnotExist.com。在网站ThisXDoesnotExist.com上还有其他例子。文本生成是利用人工智能技术进行文本和深度学习,自动生成文本,写故事、散文和诗歌,创建长文档的摘要,以及综合的方法。使用RNN(循环神经网络)和现在的GANs,文本生成有很多实际的使用案例。文本生成可以帮助行业中新的自动化新闻或机器人新闻工作。OpenAI的GPT-3可以生成任何文本,包括吉他标签或计算机代码。技术能够增强人们的能力,是一个很好的推动力。技术可以让人们有话语权,有目标,有能力大规模、快速地产生影响。由于数据科学和人工智能的进步,出现了新的赋能理念和能力。人工智能合成媒体有很多积极的应用案例。技术可以为所有人创造可能性和机会,不管他们是谁,也不管他们如何听、如何说、如何沟通。深假技术的进步在某些领域有明显的好处,比如无障碍、教育、电影制作、刑事取证和艺术表达。[我将在以后的文章中探讨积极的使用案例]。与任何新技术一样,邪恶的行为者会利用这种创新并为他们的利益服务。GAN和Deepfakes已经不仅仅是研究课题或工程玩具。从一个创新的研究概念开始,现在它们可以作为一种通信武器使用。Deepfakes正变得容易创造,甚至更容易在政策和立法真空中传播。Deepfakes使编造媒体--换脸、对口型和木偶人--成为可能,大多数情况下,无需同意,并给心理安全、政治稳定和商业干扰带来威胁。深度造假可以用来损害名誉、捏造证据、欺骗公众、破坏对民主体制的信任。近两年,利用生成式人工智能模型创建的合成数据被恶意使用的可能性开始引起人们的警惕。该技术现在已经发展到可能被武器化,对个人、 社会 、机构和民主制度进行破坏和伤害。Deepfakes可以促进事实相对主义,并使专制领导人得以发展。Deepfakes不仅会造成伤害,还将进一步侵蚀人们对媒体已经下降的信任。它还可以帮助公众人物将自己的不道德行为隐藏在Deepfakes和假新闻的面纱中,将他们的实际危害行为称为虚假行为,也就是所谓的骗子红利。非国家行为者,如叛乱组织和恐怖组织,可以利用Deepfakes来代表他们的对手发表煽动性言论或从事挑衅性行动,以煽动人们的反国家情绪。一个恐怖组织可以很容易地制作一个假视频,显示士兵对宗教场所的不敬,以点燃现有的反国家情绪,造成进一步的不和谐。国家可以使用类似的策略来传播针对少数族裔社区或另一个国家的计算宣传,一个假视频显示一个警察高喊反宗教的污言秽语,或者一个政治活动家呼吁暴力。所有这些都可以用较少的资源、互联网规模和速度来实现,甚至可以通过微目标来激发支持。[我将在今后的文章中探讨深层伪装的负面使用案例和危害]为了捍卫真相和保障言论自由,我们需要采取多利益攸关方和多模式的方法。任何减轻恶意深层造假的 社会 负面影响的对策,其主要目标必须是双重的。其一,减少恶意深层造假的风险,其二,将其可能造成的损失降到最低。恶意深造的有效对策可分为立法行动与法规、平台政策与治理、技术干预和媒介素养四大类。笔者将在以后的文章中探讨有效的对策。
chatGPT是由OpenAI开发的。OpenAI是一家人工智能研究实验室,成立于2015年,总部位于美国旧金山。OpenAI的目标是推动人工智能的发展,使之有利于全人类的利益。chatGPT是OpenAI旗下的一个项目,主要目的是创建一个强大的对话生成模型,能够与用户进行自然而流畅的对话。chatGPT使用了大规模的预训练模型和增强学习技术,经过大量的数据训练和优化,以提供更好的对话体验。OpenAI致力于不断改进和发展chatGPT,以满足不断增长的人工智能应用需求。
2023年最火爆华语歌手是谁?不是周杰伦,也不是孙燕姿,而是“AI孙燕姿”。近期,在各大视频平台上,“冷门歌手孙燕姿”靠着各种各样的AI“分身”翻唱不同曲风的歌曲,营业时长感人,作品出圈火爆。从流行、到摇滚、再到“魔性”,没有AI孙燕姿驾驭不了的曲风。有人说,本来以为AI最不能替代的是艺术类,结果AI就往艺术上发展。当AI技术“盯上”歌手后,会产生怎样的化学反应?“UP主”子鱼(化名),至今只做了4个“AI孙燕姿”的音频,但在B站总播放数已超过150万次。其中《下雨天》单曲播放数超过100万次,收藏人数近2万人。当下的AI歌手尽管只是高度“模仿”了歌手的音色及演唱风格,但这对于期待歌手营业的粉丝们来说已经相当兴奋。不少粉丝听后表示,“还原得有点可怕了”“这简直就是科技与狠活!”这不禁让人想起前段时间,孙燕姿在海潮宇宙音乐节演出结束后被粉丝追问何时开演唱会的那句打趣——“再不开演唱会就要被AI取代了!”B站上AI孙燕姿翻唱《爱在西元前》图片来源:视频截图AI歌手真的能取代真人歌手吗?AI技术在唱片工业上有着怎样的发展足迹?在AI技术“狂飙突进”的背后,又有哪些问题浮出水面?火热近两个月,借由AI分身,陈奕迅、周杰伦、披头士等知名歌手及乐队纷纷在B站“复出”并发表“新歌”。周杰伦唱日语歌、邓丽君演唱《反方向的钟》......一切看似不可能的事情,在AI歌手这里都能实现。孙燕姿因其独具辨识度的音色与唱腔,成为AI宠儿,每天都有十数首“新作”面世。有人调侃,“孙燕姿不营业,粉丝便替她营业。”于是,大家耳熟能详的《一直很安静》《岁月神偷》《红豆》,以及《好汉歌》《火红的萨日朗》等歌曲都在AI孙燕姿的演绎下有了别样的色彩。AI孙燕姿翻唱走红B站 图片来源:B站截图按照目前的技术,歌手的唱腔、技巧和风格还很难完全模仿,但音色已经基本能1:1复制了。而我们也发现,AI孙燕姿用的核心技术主要来自于一个叫做So-vits的开源项目。这个项目已经迭代到了4.0版本。相较于以往VITS、soft-vc、VISinger2等项目,So-vits的使用大大简化,仅凭数段音频,就可用一个生成式模型来合成目标音色的音频,训练出用户想要的声学模型。这个模型可以保留音高和音调,也可以用不同的语言来翻唱。笔者观察到,虽然当前AI技术在音乐工业的使用仍大面积停留在调教、翻唱等方面,但AI技术与音乐创作、音乐表演的结合已成为一个显著的趋势。像是此前为了纪念邓丽君逝世22周年,日本节目《金SMA》利用全息投影技术,令一代歌后“复活”。粉丝们自行训练张国荣、姚贝娜等故去歌手的模型,让故人以“数字生命”的形式重现,透过这些久违的声音,让听众在互联网的一片喧嚣之中,感受到独有的人文主义温暖。今年3月,歌手陈珊妮发布新歌《教我如何做你的爱人》,粉丝听完新歌后几乎都在称赞这首歌的演唱水准一如以往。但一周后,陈珊妮发表长文表示,她的新歌其实是由“AI模型”演唱,就连单曲封面也是AIGC生成。在歌曲制作过程中,她为调教AI演唱做了充足的工作,这些工作量不低于乃至远高于亲自演唱。而陈珊妮也表示,期望透过这首歌,促动所有关心艺术创作的人思考——如果 AI 的时代必将到来,身为创作人该在意的或许不是“我们是否会被取代”,而是“我们还可以做些什么”。陈珊妮发布新歌《教我如何做你的爱人》图片来源:微博趋势AI在音乐领域能“发挥”的作用越来越多。虽然总AI的声音没有感情,无法代替人的艺术性创作。但不可否认,AI的能力早已慢慢“渗透”进音乐产业的诸多方面。早在2007年,虚拟歌手初音未来就面世了。后来“二次元形象+语音合成引擎”的虚拟歌手层出不穷,B站的洛天依,LOL推出的K/DA女团都属于此类。目前AI对于音乐行业的介入除了AI翻唱外,还有AI音乐制作。像是早期Korg、Yamaha、Roland品牌的高端自动伴奏合成器,Band in a Box自动编曲软件等都已成为许多知名音乐人的“左膀右臂”。而基于AI技术的母带制作服务(例如LANDR),则为音乐人们提供了一种成本远低于传统母带制作服务的替代性方案,已经有超过200万音乐家利用它制作出1000万余首歌曲。LANDR官网 图片来源:LANDR官网截图笔者观察到,2015年,AI音乐初创公司Juckdeck成立,各类相关公司和音乐作品进入集中爆发阶段。2016年,鼎鼎大名的AIVA成立,其创作的音乐作品开始被电影导演、广告公司、游戏工作室使用。而国内第一家AI音乐初创公司DeepMusic则出现于2017年。AI对于音乐制作的介入正在变得越来越深入和广泛。在ChatGPT爆火后,越来越多的生成式AI工具被快速推出。去年年底出现的开源AI翻唱项目Diffsvc和So-vits,从出现到发展至普通人难以辨别的地步,只用了几个月时间。今年初,谷歌宣布开发了一款名为MusicLM的人工智能工具,可以从文本中直接生成音乐。而B站官方也在积极鼓励AI创作,推出了名叫“虚拟之声创作计划”的主题活动。B站推出“虚拟之声创作计划” 图片来源:B站截图目前看来,在对原创性需求不高的商业音乐应用场景上,AI音乐有着更广的发展空间和更快的发展速度。以游戏场景为例,业内人士指出,音乐作为游戏画面的相关载体,游戏对音乐的需求量极大但要求并不算高。AI音乐的出品速度和处于中游水平的质感,能够完美适应游戏行业需求。隐忧围绕“AI克隆”是否涉及侵权,争议一直存在。AI玩家们认为训练AI仅为娱乐而非商用,并未损害歌手们的权益。但版权方认定使用未经授权的歌手或作品的数据集来训练AI是一种侵权行为。曾就职于多家音乐流媒体平台版权部的李强在接受媒体采访时表示,“在未获得歌手授权下,AI对歌手声音的模拟甚至公开展示,应属于对歌手表演者权的侵权行为。”也有人指出,“在鼓励AI创作的语境里,所有试图绕过版权谈创新都是耍流氓。”AI孙燕姿翻唱《我记得》图片来源:B站截图鉴于此,在海外包括环球音乐在内的版权方纷纷向Spotify和Apple music等流媒体平台施压,要求下架AI克隆歌曲。在环球唱片执行副总裁迈克尔·纳什(Michael Nash)看来,人工智能音乐正在“稀释”市场,使原创作品更难找到,并侵犯了艺术家获得作品报酬的合法权利。3月16日,美国唱片业协会(RIAA)联合美国独立音乐协会、美国音乐家联合会、美国出版商协会、国际唱片业协会等30余个社会团体组建了一个广泛的音乐人和艺术家联盟,共同发起了“人类艺术运动”,以保证AI不会取代或“侵蚀”人类文化和艺术。整体来看,对音乐工业来说,数字音乐版权的规范化、数字音乐制作的人工智能化是大势所趋,但也面临巨大的现实复杂性。当前,AI的“介入”无疑让新的、老的问题加速浮出水面,流媒体UGC创作、翻唱侵权、短视频和直播侵权等话题再一次成为平台方、版权方、制作方角力的焦点,而新的行业规则也亟待建立。也有音乐人对于“AI克隆”持开放的态度,比如加拿大歌手Grimes就公开表示欢迎大家使用AI模仿她的声音进行创作,版税五五分成。而说唱歌手小老虎则表示,如果有人克隆了自己的声音去演唱另一首歌,“不是坏事,也许多交个朋友。”加拿大创作歌手Grimes在推特发文 图片来源:网页截图如果平台规则可以解决创作者使用AI歌手翻唱带来的收入分配问题,不断返回版税给原唱歌手和被翻唱的版权方,AI在音乐工业的想象空间或将进一步被打开。与此对音乐工业大大小小的制作公司来说,AI语音生成和AI创作已成为重要发力方向,不仅能提高传统的音乐创作效率,还能打造虚拟偶像,开辟新的商业场景。
ChatGPT技术是一种新兴的技术,它被用来开发自动聊天机器人,使其能够以更自然的方式与人类交流。业界已经开发出使用ChatGPT技术的自动聊天机器人,其聊天内容可以像人类一样完全、有趣、真实,从而提高用户的体验感和满意度。从长期来看,ChatGPT技术的出现让人们的工作变得更轻松,但也会导致传统行业的大量裁员和失业。
一方面,由于ChatGPT技术的引入,可以做到代表人工智能的自动聊天机器人可以保持和人类的一致性,从而可以取代人类的工作,从而使传统行业的大量员工被裁员或失去工作。有些客服岗位需要大量员工来承担,而ChatGPT技术可以取代人类客服答复服务提问,也就意味着公司可以节省人力成本,从而导致这些传统行业的大量员工被裁员或失去工作。在一定程度上技术发展也会导致一些行业的发展缓慢,也有可能会进一步导致失业。
另一方面,ChatGPT技术的出现也可以给传统行业的技术发展带来一些变化和进步。传统行业的技术发展变得更加快速,更加稳定,从而使传统行业的复苏更加迅速。ChatGPT技术的出现也为传统行业的新兴行业创造了更多的机遇,随着自动聊天机器人的出现,需要技术人员来设计和维护自动聊天机器人,从而使得一些新兴行业更有机会获得大量就业岗位。
ChatGPT技术对传统业务的影响依然存在,它可能会造成一定程度的失业,但它的出现也会为一些新兴行业带来新的就业机会,未来传统行业的发展将得到更加平衡的技术发展和就业机会,从而不会因ChatGPT技术的出现而造成大量裁员和失业。
原文链接:抒怀驿站
别人做PPT
加班!加班!加班!
我做PPTAI自动生成!轻松下班!
tome
beautiful ai
Mdourr
ChatGPT
ChatGPT 是 OpenAI 公开的一款人工智能聊天机器人它基于 GPT-3 这个大规模的语言模型,可以与用户进行自然而有趣的对话。ChatGPT 可以回答用户的问题
份PPT制作流程
以下是一份PPT制作流程,供参考:
1。确定主题和目标受众:确定你要展示的主题和目标受众是谁
2收集资料:根据主颖和目标受众收集资料,包括文本、图像、视频等
3制作大纲:根据资料制作大纲,确定PPT的结构和内容。
4.设计布局:根据主题和目标受众选择适合的PPT横板和布局,并进行适当的修改和调整。
5.添加内容: 将大纲中的内容逐步添加到PPT中,注意文字的排版和图像的使
用。
6.优化排版:对文字和图像进行调整,保持整体的美观和清晰。
7.添加动画和转场效果:根据需要添加动画和转场效果,使PPT更生动有趣8.预览和修改:预览整个PPT,并对其中的内容、排版、动画等进行必要的修改和调整。
9.演示:在演示前检查一遍,确保所有内容和效果都正常运行,然后进行演
示。
山4
Midjourney
绘画AI,效果超赞,海报、写实图片轻松生成
Midjourney 生成超清晰图像的倾向增加了整体的真实感,只需输入文字就会自动产生图像~
Tome
一款 AI 驱动、自动生成 PPT 内容生成工具,可以帮助我们快速生成创意丰富、逻辑清晰、视觉美观的PPT内容,每页 PPT 内容支持添加视频解说,也提供异步视频协同沟通哦~
beautiful.ai
Beautiful.ai 是一个在线的PPT生成AI其界面设计非常简单明了,很容易上手~而且可以将数据通过图表和图形的形式展示出来,让人一目了然
AutoDraw
这款软件拥有非常强大的自动识别功能,我们只需要通过鼠标来绘制一部分的图形内容,这款软件就可以通过你绘制的内容来进行自动匹配,让你找到自己想要的图画,从而大大提高你的绘画效率
2023年最火爆华语歌手是谁?不是周杰伦,也不是孙燕姿,而是“AI孙燕姿”。近期,在各大视频平台上,“冷门歌手孙燕姿”靠着各种各样的AI“分身”翻唱不同曲风的歌曲,营业时长感人,作品出圈火爆。从流行、到摇滚、再到“魔性”,没有AI孙燕姿驾驭不了的曲风。有人说,本来以为AI最不能替代的是艺术类,结果AI就往艺术上发展。当AI技术“盯上”歌手后,会产生怎样的化学反应?“UP主”子鱼(化名),至今只做了4个“AI孙燕姿”的音频,但在B站总播放数已超过150万次。其中《下雨天》单曲播放数超过100万次,收藏人数近2万人。当下的AI歌手尽管只是高度“模仿”了歌手的音色及演唱风格,但这对于期待歌手营业的粉丝们来说已经相当兴奋。不少粉丝听后表示,“还原得有点可怕了”“这简直就是科技与狠活!”这不禁让人想起前段时间,孙燕姿在海潮宇宙音乐节演出结束后被粉丝追问何时开演唱会的那句打趣——“再不开演唱会就要被AI取代了!”B站上AI孙燕姿翻唱《爱在西元前》图片来源:视频截图AI歌手真的能取代真人歌手吗?AI技术在唱片工业上有着怎样的发展足迹?在AI技术“狂飙突进”的背后,又有哪些问题浮出水面?火热近两个月,借由AI分身,陈奕迅、周杰伦、披头士等知名歌手及乐队纷纷在B站“复出”并发表“新歌”。周杰伦唱日语歌、邓丽君演唱《反方向的钟》......一切看似不可能的事情,在AI歌手这里都能实现。孙燕姿因其独具辨识度的音色与唱腔,成为AI宠儿,每天都有十数首“新作”面世。有人调侃,“孙燕姿不营业,粉丝便替她营业。”于是,大家耳熟能详的《一直很安静》《岁月神偷》《红豆》,以及《好汉歌》《火红的萨日朗》等歌曲都在AI孙燕姿的演绎下有了别样的色彩。AI孙燕姿翻唱走红B站 图片来源:B站截图按照目前的技术,歌手的唱腔、技巧和风格还很难完全模仿,但音色已经基本能1:1复制了。而我们也发现,AI孙燕姿用的核心技术主要来自于一个叫做So-vits的开源项目。这个项目已经迭代到了4.0版本。相较于以往VITS、soft-vc、VISinger2等项目,So-vits的使用大大简化,仅凭数段音频,就可用一个生成式模型来合成目标音色的音频,训练出用户想要的声学模型。这个模型可以保留音高和音调,也可以用不同的语言来翻唱。笔者观察到,虽然当前AI技术在音乐工业的使用仍大面积停留在调教、翻唱等方面,但AI技术与音乐创作、音乐表演的结合已成为一个显著的趋势。像是此前为了纪念邓丽君逝世22周年,日本节目《金SMA》利用全息投影技术,令一代歌后“复活”。粉丝们自行训练张国荣、姚贝娜等故去歌手的模型,让故人以“数字生命”的形式重现,透过这些久违的声音,让听众在互联网的一片喧嚣之中,感受到独有的人文主义温暖。今年3月,歌手陈珊妮发布新歌《教我如何做你的爱人》,粉丝听完新歌后几乎都在称赞这首歌的演唱水准一如以往。但一周后,陈珊妮发表长文表示,她的新歌其实是由“AI模型”演唱,就连单曲封面也是AIGC生成。在歌曲制作过程中,她为调教AI演唱做了充足的工作,这些工作量不低于乃至远高于亲自演唱。而陈珊妮也表示,期望透过这首歌,促动所有关心艺术创作的人思考——如果 AI 的时代必将到来,身为创作人该在意的或许不是“我们是否会被取代”,而是“我们还可以做些什么”。陈珊妮发布新歌《教我如何做你的爱人》图片来源:微博趋势AI在音乐领域能“发挥”的作用越来越多。虽然总AI的声音没有感情,无法代替人的艺术性创作。但不可否认,AI的能力早已慢慢“渗透”进音乐产业的诸多方面。早在2007年,虚拟歌手初音未来就面世了。后来“二次元形象+语音合成引擎”的虚拟歌手层出不穷,B站的洛天依,LOL推出的K/DA女团都属于此类。目前AI对于音乐行业的介入除了AI翻唱外,还有AI音乐制作。像是早期Korg、Yamaha、Roland品牌的高端自动伴奏合成器,Band in a Box自动编曲软件等都已成为许多知名音乐人的“左膀右臂”。而基于AI技术的母带制作服务(例如LANDR),则为音乐人们提供了一种成本远低于传统母带制作服务的替代性方案,已经有超过200万音乐家利用它制作出1000万余首歌曲。LANDR官网 图片来源:LANDR官网截图笔者观察到,2015年,AI音乐初创公司Juckdeck成立,各类相关公司和音乐作品进入集中爆发阶段。2016年,鼎鼎大名的AIVA成立,其创作的音乐作品开始被电影导演、广告公司、游戏工作室使用。而国内第一家AI音乐初创公司DeepMusic则出现于2017年。AI对于音乐制作的介入正在变得越来越深入和广泛。在ChatGPT爆火后,越来越多的生成式AI工具被快速推出。去年年底出现的开源AI翻唱项目Diffsvc和So-vits,从出现到发展至普通人难以辨别的地步,只用了几个月时间。今年初,谷歌宣布开发了一款名为MusicLM的人工智能工具,可以从文本中直接生成音乐。而B站官方也在积极鼓励AI创作,推出了名叫“虚拟之声创作计划”的主题活动。B站推出“虚拟之声创作计划” 图片来源:B站截图目前看来,在对原创性需求不高的商业音乐应用场景上,AI音乐有着更广的发展空间和更快的发展速度。以游戏场景为例,业内人士指出,音乐作为游戏画面的相关载体,游戏对音乐的需求量极大但要求并不算高。AI音乐的出品速度和处于中游水平的质感,能够完美适应游戏行业需求。隐忧围绕“AI克隆”是否涉及侵权,争议一直存在。AI玩家们认为训练AI仅为娱乐而非商用,并未损害歌手们的权益。但版权方认定使用未经授权的歌手或作品的数据集来训练AI是一种侵权行为。曾就职于多家音乐流媒体平台版权部的李强在接受媒体采访时表示,“在未获得歌手授权下,AI对歌手声音的模拟甚至公开展示,应属于对歌手表演者权的侵权行为。”也有人指出,“在鼓励AI创作的语境里,所有试图绕过版权谈创新都是耍流氓。”AI孙燕姿翻唱《我记得》图片来源:B站截图鉴于此,在海外包括环球音乐在内的版权方纷纷向Spotify和Apple music等流媒体平台施压,要求下架AI克隆歌曲。在环球唱片执行副总裁迈克尔·纳什(Michael Nash)看来,人工智能音乐正在“稀释”市场,使原创作品更难找到,并侵犯了艺术家获得作品报酬的合法权利。3月16日,美国唱片业协会(RIAA)联合美国独立音乐协会、美国音乐家联合会、美国出版商协会、国际唱片业协会等30余个社会团体组建了一个广泛的音乐人和艺术家联盟,共同发起了“人类艺术运动”,以保证AI不会取代或“侵蚀”人类文化和艺术。整体来看,对音乐工业来说,数字音乐版权的规范化、数字音乐制作的人工智能化是大势所趋,但也面临巨大的现实复杂性。当前,AI的“介入”无疑让新的、老的问题加速浮出水面,流媒体UGC创作、翻唱侵权、短视频和直播侵权等话题再一次成为平台方、版权方、制作方角力的焦点,而新的行业规则也亟待建立。也有音乐人对于“AI克隆”持开放的态度,比如加拿大歌手Grimes就公开表示欢迎大家使用AI模仿她的声音进行创作,版税五五分成。而说唱歌手小老虎则表示,如果有人克隆了自己的声音去演唱另一首歌,“不是坏事,也许多交个朋友。”加拿大创作歌手Grimes在推特发文 图片来源:网页截图如果平台规则可以解决创作者使用AI歌手翻唱带来的收入分配问题,不断返回版税给原唱歌手和被翻唱的版权方,AI在音乐工业的想象空间或将进一步被打开。与此对音乐工业大大小小的制作公司来说,AI语音生成和AI创作已成为重要发力方向,不仅能提高传统的音乐创作效率,还能打造虚拟偶像,开辟新的商业场景。