微信公众号悄悄上线AI音色克隆,微信的一小步,却是AI的一大步。
这篇文章,可能是我有史以来最特殊的一篇文章。
因为当你点开右上角的三个点,点击听全文的时候。
可能你会发现,你听到的不再是那个永远跟其他人一样,相同的男声。
而是,AI克隆的我的声音。
此时,微信可能会用我的声音,来为你朗读出这篇文章。
之所以,我一直在说可能,是因为我虽然在后台设置好了,但是只有这篇新发的文章,我才能知道,我的声音到底有没有生效。
不过,再怎么说,这都是微信的一小步,却是AI的一大步,真的。
这个周末,在登录手机端公众号后台的时候。
意外的发现公众号版本又更新了,更新到了2.29.1,当然版本号无所谓,重要的是,这个设置里面的新功能:朗读音色。
以前是绝对没有这个功能的,作为一个几乎以公众号为生的我,对公众号后台的一点点变动,都会非常的敏感。
点开以后,会有一个系统默认的音色,你可以,创建自己的音色。
点击创建新的音色,就会进入到一个新页面,会让你现场朗读一句话。
甚至会从你的实际文章中,抽取一些片段,来让你读,非常的有意思。
这里我正好也解释一下,为啥现在微信、豆包、kimi等等产品,在做AI音色克隆的时候,都要让你现场读一段文本,再用这段音频去做音色克隆,而不是让你随便上传一段音频呢?
原因很简单,因为合规和风控。
前段时间三只羊AI音频事件,还有AI雷军国庆节在微博上骂了7天等等,我想大家应该都能感受到,AI克隆音色这玩意一旦放开,会有多少跟诈骗相关的风险。
一旦放开,可以随便上传一段音频,最开心的不是你我他,而是骗子。
看我号的读者,应该尚且知道AI音频的东西,在收到一些身边亲近人的语音的时候会产生一些警惕,但是我们家里的老人呢?他们很多人对现在的AI并不是很了解,一旦AI音色克隆放开,很容易就是骗子拿着你4、5秒的音频去发给你的爷爷奶奶舅舅舅妈,骗取他们的信任。
且万一有一些人,如果真的石乐志,克隆一些官员的声音,那...后果基本不敢设想。
所以,现在基本清一色都是这种方式,让你用实时录制的方式,念出文本上的随机的话,还不能念错。
用这种方式,来证明你是你。
尽最大的可能,提高门槛,降低风险。
在你读完这段话后,就会嘟嘟嘟的进入克隆的步骤,速度很快,大概十几秒就能完全搞定。
然后,你就可以听到,克隆好的声音示例了。音色基本很完美,跟我声音一样,情绪是TTS的老问题了,不说了,整体质听感上,是还算OK的。
最后,就可以应用了。
我测试了一下,老的文章还是不会变的,可能只有新的文章,才能支持我的音色。
所以只有这篇发出来,我才能知道,我的音色,来听全文,到底是个什么感觉,以及,到底会不会用我的音色。。。
其实,我脑子里幻想过,公众号到底会怎么接入AI,来帮这个可能是最大的长图文平台赋能。
想过AI创作,想过AI起标题,想过AI搜索,想过AI总结,但是没想到的是,来的第一个,居然是AI音色克隆。
不过其实细想想,也合理。
公众号这个载体,我一直调侃说,我可能是最后给公众号送终的那一批人。
短视频俯瞰众生,短图文在侧不断侵蚀羽翼,身后还有播客虎视眈眈。
长图文,变的越来越像一个日落西山的老人,守着自己的一亩三分地,尽可能的给大家种出最好的果实。
而公众号,作为长图文领域无与伦比的王者,非常坦率的讲,一直有一个在我看来很大的问题,过往很难解决,就是IP化很难。
我说的难,是它天然的隔离感。
短视频为什么做一个人的IP,比公众号简单很多?是因为内容载体。
在公众号上,你看到的永远是冷冰冰的文字,即使作者把这段话,写的登峰造极,写的舌灿莲花,你能看到的也依然是文字,是神交。
而短视频呢?你看到的不是文字,是一个具象化的人,你知道他长什么样,哦这个人有点长的有点潦草头发看着总是好久不洗,哦还有一个人带着眼镜总是说话的时候张不开嘴。
而那些内容,更是他亲口念出来的,你看到所有的文字,不是冷冰冰的文字,而是他在读,你听到的除了信息,还有情绪,还有他的笑与泪。
这是声音的力量。
在上古时期,没有文字,本就一直以声音传递智慧。
先民口耳相传,吟游四方。
这就是为啥,在短视频上做IP,要比公众号,简单的多。
而这一次更新,我觉得很有趣的一点是,微信公众号这一次的更新,他们把声音,给补上了。
你不仅可以看到我的文字,更可以听到,我的声音。
在过往,我们用文字表达思想,用图片传递视觉,现在又多了一个维度,可以用我们自己的的声音来传递情感。
声音终于成为了我们这群做图文内容的人的有机组成部分,而不在只是,机械的朗读。
我乐意看到微信的每一次变化,特别是跟AI有关的更新。
这是微信的一小步,却也是AI的一大步。
AI,很多时候就像空气一样,只有当你感受不到它,觉得他是我们生活中理所应当的一部分,这时候,AI就算是真正的成功进入每个你我一样的普通人的生活中了。
微信,作为可能是我们国内,最大的超级APP,没有什么,比他跟AI的结合,影响范围更广了。
以后的某一天,可能所有的公众号,都有了自己的专属声音。
那时候,还会有谁在乎,这是不是AI呢?
这一切,难道不是本来就这样的嘛。
直播中!蔚来李斌实测150kWh电池包续航:百公里能耗14.7kWh
快科技12月17日消息,蔚来汽车创始人、CEO李斌日前表示,他将自己开车测试150度电池的高速续航表现,与腾讯新闻的黄晨霞老师,驾乘搭载150kWh电池包的蔚来ET7,从上海出发,看到底能够开多远。目前,直播已经开始,截止发稿,李斌已经行驶154公里,剩余电量85%,百公里综合电耗14.6kWh,而当前车内温度24℃,车外环境温度1℃。(直播点此观看)000114 Ultra同款!小米Civi 4 Pro升级AI影像大脑3.0
小米Civi4Pro在影像硬件方面的出色表现已经备受瞩目,而官方最新宣布的消息更是让这款手机的摄影能力再上新台阶——它将搭载与小米14Ultra相同的影像大脑3.0,即XiaomiAISP,这款AI大模型计算摄影平台为手机的影像性能提供了强大的支持。站长网2024-03-20 12:01:320000电商MCN的上市之路,走到哪一步了
7月11号,港股世纪睿科正式更名为“交个朋友”。早在今年5月,世纪睿科就曾发布公告,宣布已完成对交个朋友公司的全资收购,拥有其旗下的核心资产。此次改名,则意味着交个朋友正式完成了“子吞母”,顺利以其本名在港股上市。站长网2023-07-16 05:52:300000srf-attention:一个提高深度学习模型训练效率的注意力机制
注意力很有用,但计算成本很高。然而,一旦训练完成,通过一些微调计算,您可以减少SRF注意力并消除对序列长度的依赖,从而大大加快速度。srf-attention是一个PyTorch模块,用于替代传统的注意力机制,提供更高效的模型训练和推理。它的核心功能包括安装和使用简便、示例代码提供、适用于各种应用领域。这个模块有望为深度学习社区提供更高效的工具,帮助研究人员和开发者改进其模型的性能和效率。站长网2023-10-11 18:13:030000谷歌推具备空间推理能力的视觉语言模型SpatialVLM
要点:1、谷歌提出了SpatialVLM,旨在赋予视觉语言模型空间推理能力。2、研究者利用现实世界数据训练SpatialVLM,弥补了常见数据集对空间信息的限制。3、通过生成大规模空间VQA数据集,研究者成功使视觉语言模型具备直接空间推理和链式思维能力。站长网2024-02-18 15:27:180000