0

0

公众号上线声音克隆,自媒体博主未来的数字永生

花韻仙語

花韻仙語

发布时间:2024-11-26 17:36:13

|

625人浏览过

|

来源于鸟哥笔记

转载

做公众号自媒体的同学应该知道,微信公众号官方一直有为公众号博主提供了一个移动端的公众号管理工具 :「公众号订阅助手」。

可以方便公众号运营在移动端管理自己的公众号素材、发布、甚至是其他相关的账户设置。

就在最近,一个博主分享了公众号订阅助手上线的一个新功能:朗读音色设置。

作为公众号的超级管理员,你将有权限调整自己的公众号文章的朗读音色。

熟悉公众号的同学都知道,在早些时候公众号已经上线了朗读模式,你可以点击阅读全文,公众号通过音频自动播放。

公众号上线声音克隆,自媒体博主未来的数字永生

而这个音频的朗读人以前的版本是固定的,现在就朗读允许博主选择与创建了音色了。

而现在更新到2.29.1版本后,你有机会被灰度到。目前我的账户是没有被灰度到的,只有部分的公众号账户被灰度了。

比如我看到某些博主已经提前上线尝鲜,如下是公众号订阅助手的设置功能入口。

公众号上线声音克隆,自媒体博主未来的数字永生

没有被灰度到的公众号订阅助手哦

公众号上线声音克隆,自媒体博主未来的数字永生

公众号灰度支持朗读音色功能

公众号上线声音克隆,自媒体博主未来的数字永生

创建音色 图片来源:数字生命卡兹克

公众号上线声音克隆,自媒体博主未来的数字永生

试听朗读,图片来源:数字生命卡兹克

公众号上线声音克隆,自媒体博主未来的数字永生

选择创建的音频 图片来源 :数字生命卡兹克

克隆声音:Deep Fake技术

这项技术其实是AI的一个分支应用叫做deep fake,现在可以用于图像与声音上的克隆。

公众号上线声音克隆,自媒体博主未来的数字永生

图片来自网络

这项深度伪造技术的基础是GANS即Generative Adversarial Networks“生成式对抗网络”。在GitHub上有非常多的开源算法,产品经理随时可以调用与使用。

公众号上线声音克隆,自媒体博主未来的数字永生

要实现deep fake技术,首先要建立一个自己的模型,而模型训练要经历6个步骤,声音和音频是各自的模型。

  1. 数据收集:首先需要收集大量的音频数据,微信自然有天然的数据优势(每天有如此多人适用微信语音消息)

  2. 特征提取:利用深度学习算法对收集到的音频数据进行特征提取,即找出语音的各种特征,如音调、节奏、音色等

  3. 生成模型训练:通过训练生成模型,将一个人的声音转换成另一个人的声音。这一过程通常需要使用到对抗生成网络(GAN)等技术

  4. 合成音频:将生成的声音与原始的视频或音频进行合成,以生成最终的Deepfake音频

  5. 音频同步:Deepfake技术还可以将音频与伪造的音频同步,使人物在伪造音频中看似说出特定的语句。(这就是

  6. 模型调优与验证:通过超参数调优和验证数据集测试不断提升模型的生成效果。例如调整生成器和判别器的学习率,或者增大训练数据集,以提高模型的泛化能力

  7. 模型保存与部署:训练完成后,保存模型参数,便于进一步使用和优化,或将模型部署到实际应用中

    MOKI
    MOKI

    MOKI是美图推出的一款AI短片创作工具,旨在通过AI技术自动生成分镜图并转为视频素材。

    下载

有了这样的模型后,用户只需要录入自己的声音,就可以快速生成,模型越精准,那么声音越像、时间越短、生成新素材所录入的素材越少。

博主提到的合规与风控

有博主解释到公众号的声音录入需要试读是因为合规与风控。

其实不是的。

Deep fake技术生成音频,需要有对应的音频输入,由此在朗读到一定素材后才能够用模型生成

作为产品经理,我们从上面的技术角度就可以知道,AI产品经理需要提供声音录入功能、以及声音校验的功能。

所以才会有对应:试读、以及试听例句。

公众号上线声音克隆,自媒体博主未来的数字永生

户对声音的反馈,反而再来进行模型的优化。

而作为AI产品经理,要想让用户使用这个功能,就必须为模型录入素材提供音频录入功能,考虑到内容版权的问题,最好的方式是选择博主自己“原创”的公众号文章。

这些文章既可以不需要担心「素材版权问题」还能够提供足够的各种音调、声音起伏、顿挫等阅读素材。

在音频解锁、声纹解锁上,也几乎都是同理,通过录入的声音进行声纹处理,将人类特有的声音声纹进行标注

公众号上线声音克隆,自媒体博主未来的数字永生

声纹特点 图片来自网络

deep fake的AI模型,就是快速标注其声纹的各个人类声纹特点,训练deep fake模型需要大量质量好的素材,如果是音频就是音频素材,视频就是视频素材。

这就是为什么Deepfake的虚假内容最多发生在政客和演员身上,因为网上存有大量他们的图片数据。数据越多,效果越好,比如下面的刘德华、吴京、甚至是在速度与激情上使用的都是类似道理。

公众号上线声音克隆,自媒体博主未来的数字永生

速度与激情保罗沃克

不仅是声音、还有画面,当然从deep fake技术的应用实战来说,画面的处理难度要比声音更难。

公众号上线声音克隆,自媒体博主未来的数字永生

电影中deep fake技术体验

所以让用户录入自己的声音,是并不是因为合规与风控的要求。而是要使用这项技术,就需要用户录入声音。

而用户数据与训练模型都是在腾讯微信服务端上,完全不用担心别人会使用,除非有人攻击了微信腾讯服务器盗取数据。

当然还有一个方式

你可以利用第三方deep fake技术的APP,通过录入模拟的数字音频再次模拟,这在技术上可以的。

只是由于不是录入的真人声音,是再次基于deep fake技术生成的,自然会有缺失,同时你也不知道博主的家属亲戚联系方式,从理论上来说可以,实际操作上还是很难的。

今天的分享就在这里。

热门AI工具

更多
DeepSeek
DeepSeek

幻方量化公司旗下的开源大模型平台

豆包大模型
豆包大模型

字节跳动自主研发的一系列大型语言模型

通义千问
通义千问

阿里巴巴推出的全能AI助手

腾讯元宝
腾讯元宝

腾讯混元平台推出的AI助手

文心一言
文心一言

文心一言是百度开发的AI聊天机器人,通过对话可以生成各种形式的内容。

讯飞写作
讯飞写作

基于讯飞星火大模型的AI写作工具,可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

即梦AI
即梦AI

一站式AI创作平台,免费AI图片和视频生成。

ChatGPT
ChatGPT

最最强大的AI聊天机器人程序,ChatGPT不单是聊天机器人,还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

相关专题

更多
github中文官网入口 github中文版官网网页进入
github中文官网入口 github中文版官网网页进入

github中文官网入口https://docs.github.com/zh/get-started,GitHub 是一种基于云的平台,可在其中存储、共享并与他人一起编写代码。 通过将代码存储在GitHub 上的“存储库”中,你可以: “展示或共享”你的工作。 持续“跟踪和管理”对代码的更改。

662

2026.01.21

页面置换算法
页面置换算法

页面置换算法是操作系统中用来决定在内存中哪些页面应该被换出以便为新的页面提供空间的算法。本专题为大家提供页面置换算法的相关文章,大家可以免费体验。

406

2023.08.14

Python 自然语言处理(NLP)基础与实战
Python 自然语言处理(NLP)基础与实战

本专题系统讲解 Python 在自然语言处理(NLP)领域的基础方法与实战应用,涵盖文本预处理(分词、去停用词)、词性标注、命名实体识别、关键词提取、情感分析,以及常用 NLP 库(NLTK、spaCy)的核心用法。通过真实文本案例,帮助学习者掌握 使用 Python 进行文本分析与语言数据处理的完整流程,适用于内容分析、舆情监测与智能文本应用场景。

2

2026.01.27

拼多多赚钱的5种方法 拼多多赚钱的5种方法
拼多多赚钱的5种方法 拼多多赚钱的5种方法

在拼多多上赚钱主要可以通过无货源模式一件代发、精细化运营特色店铺、参与官方高流量活动、利用拼团机制社交裂变,以及成为多多进宝推广员这5种方法实现。核心策略在于通过低成本、高效率的供应链管理与营销,利用平台社交电商红利实现盈利。

104

2026.01.26

edge浏览器怎样设置主页 edge浏览器自定义设置教程
edge浏览器怎样设置主页 edge浏览器自定义设置教程

在Edge浏览器中设置主页,请依次点击右上角“...”图标 > 设置 > 开始、主页和新建标签页。在“Microsoft Edge 启动时”选择“打开以下页面”,点击“添加新页面”并输入网址。若要使用主页按钮,需在“外观”设置中开启“显示主页按钮”并设定网址。

12

2026.01.26

苹果官方查询网站 苹果手机正品激活查询入口
苹果官方查询网站 苹果手机正品激活查询入口

苹果官方查询网站主要通过 checkcoverage.apple.com/cn/zh/ 进行,可用于查询序列号(SN)对应的保修状态、激活日期及技术支持服务。此外,查找丢失设备请使用 iCloud.com/find,购买信息与物流可访问 Apple (中国大陆) 订单状态页面。

93

2026.01.26

npd人格什么意思 npd人格有什么特征
npd人格什么意思 npd人格有什么特征

NPD(Narcissistic Personality Disorder)即自恋型人格障碍,是一种心理健康问题,特点是极度夸大自我重要性、需要过度赞美与关注,同时极度缺乏共情能力,背后常掩藏着低自尊和不安全感,影响人际关系、工作和生活,通常在青少年时期开始显现,需由专业人士诊断。

5

2026.01.26

windows安全中心怎么关闭 windows安全中心怎么执行操作
windows安全中心怎么关闭 windows安全中心怎么执行操作

关闭Windows安全中心(Windows Defender)可通过系统设置暂时关闭,或使用组策略/注册表永久关闭。最简单的方法是:进入设置 > 隐私和安全性 > Windows安全中心 > 病毒和威胁防护 > 管理设置,将实时保护等选项关闭。

6

2026.01.26

2026年春运抢票攻略大全 春运抢票攻略教你三招手【技巧】
2026年春运抢票攻略大全 春运抢票攻略教你三招手【技巧】

铁路12306提供起售时间查询、起售提醒、购票预填、候补购票及误购限时免费退票五项服务,并强调官方渠道唯一性与信息安全。

95

2026.01.26

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
第二十二期_综合实战
第二十二期_综合实战

共96课时 | 7.2万人学习

第二十一期_综合实战
第二十一期_综合实战

共112课时 | 10.2万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号