0

0

公众号上线声音克隆,自媒体博主未来的数字永生

花韻仙語

花韻仙語

发布时间:2024-11-26 17:36:13

|

625人浏览过

|

来源于鸟哥笔记

转载

做公众号自媒体的同学应该知道,微信公众号官方一直有为公众号博主提供了一个移动端的公众号管理工具 :「公众号订阅助手」。

可以方便公众号运营在移动端管理自己的公众号素材、发布、甚至是其他相关的账户设置。

就在最近,一个博主分享了公众号订阅助手上线的一个新功能:朗读音色设置。

作为公众号的超级管理员,你将有权限调整自己的公众号文章的朗读音色。

熟悉公众号的同学都知道,在早些时候公众号已经上线了朗读模式,你可以点击阅读全文,公众号通过音频自动播放。

公众号上线声音克隆,自媒体博主未来的数字永生

而这个音频的朗读人以前的版本是固定的,现在就朗读允许博主选择与创建了音色了。

而现在更新到2.29.1版本后,你有机会被灰度到。目前我的账户是没有被灰度到的,只有部分的公众号账户被灰度了。

比如我看到某些博主已经提前上线尝鲜,如下是公众号订阅助手的设置功能入口。

公众号上线声音克隆,自媒体博主未来的数字永生

没有被灰度到的公众号订阅助手哦

公众号上线声音克隆,自媒体博主未来的数字永生

公众号灰度支持朗读音色功能

公众号上线声音克隆,自媒体博主未来的数字永生

创建音色 图片来源:数字生命卡兹克

公众号上线声音克隆,自媒体博主未来的数字永生

试听朗读,图片来源:数字生命卡兹克

公众号上线声音克隆,自媒体博主未来的数字永生

选择创建的音频 图片来源 :数字生命卡兹克

克隆声音:Deep Fake技术

这项技术其实是AI的一个分支应用叫做deep fake,现在可以用于图像与声音上的克隆。

公众号上线声音克隆,自媒体博主未来的数字永生

图片来自网络

这项深度伪造技术的基础是GANS即Generative Adversarial Networks“生成式对抗网络”。在GitHub上有非常多的开源算法,产品经理随时可以调用与使用。

公众号上线声音克隆,自媒体博主未来的数字永生

要实现deep fake技术,首先要建立一个自己的模型,而模型训练要经历6个步骤,声音和音频是各自的模型。

  1. 数据收集:首先需要收集大量的音频数据,微信自然有天然的数据优势(每天有如此多人适用微信语音消息)

  2. 特征提取:利用深度学习算法对收集到的音频数据进行特征提取,即找出语音的各种特征,如音调、节奏、音色等

  3. 生成模型训练:通过训练生成模型,将一个人的声音转换成另一个人的声音。这一过程通常需要使用到对抗生成网络(GAN)等技术

  4. 合成音频:将生成的声音与原始的视频或音频进行合成,以生成最终的Deepfake音频

  5. 音频同步:Deepfake技术还可以将音频与伪造的音频同步,使人物在伪造音频中看似说出特定的语句。(这就是

  6. 模型调优与验证:通过超参数调优和验证数据集测试不断提升模型的生成效果。例如调整生成器和判别器的学习率,或者增大训练数据集,以提高模型的泛化能力

  7. 模型保存与部署:训练完成后,保存模型参数,便于进一步使用和优化,或将模型部署到实际应用中

    AI工具箱
    AI工具箱

    AI工具箱是一个全方位AI资源聚合平台

    下载

有了这样的模型后,用户只需要录入自己的声音,就可以快速生成,模型越精准,那么声音越像、时间越短、生成新素材所录入的素材越少。

博主提到的合规与风控

有博主解释到公众号的声音录入需要试读是因为合规与风控。

其实不是的。

Deep fake技术生成音频,需要有对应的音频输入,由此在朗读到一定素材后才能够用模型生成

作为产品经理,我们从上面的技术角度就可以知道,AI产品经理需要提供声音录入功能、以及声音校验的功能。

所以才会有对应:试读、以及试听例句。

公众号上线声音克隆,自媒体博主未来的数字永生

户对声音的反馈,反而再来进行模型的优化。

而作为AI产品经理,要想让用户使用这个功能,就必须为模型录入素材提供音频录入功能,考虑到内容版权的问题,最好的方式是选择博主自己“原创”的公众号文章。

这些文章既可以不需要担心「素材版权问题」还能够提供足够的各种音调、声音起伏、顿挫等阅读素材。

在音频解锁、声纹解锁上,也几乎都是同理,通过录入的声音进行声纹处理,将人类特有的声音声纹进行标注

公众号上线声音克隆,自媒体博主未来的数字永生

声纹特点 图片来自网络

deep fake的AI模型,就是快速标注其声纹的各个人类声纹特点,训练deep fake模型需要大量质量好的素材,如果是音频就是音频素材,视频就是视频素材。

这就是为什么Deepfake的虚假内容最多发生在政客和演员身上,因为网上存有大量他们的图片数据。数据越多,效果越好,比如下面的刘德华、吴京、甚至是在速度与激情上使用的都是类似道理。

公众号上线声音克隆,自媒体博主未来的数字永生

速度与激情保罗沃克

不仅是声音、还有画面,当然从deep fake技术的应用实战来说,画面的处理难度要比声音更难。

公众号上线声音克隆,自媒体博主未来的数字永生

电影中deep fake技术体验

所以让用户录入自己的声音,是并不是因为合规与风控的要求。而是要使用这项技术,就需要用户录入声音。

而用户数据与训练模型都是在腾讯微信服务端上,完全不用担心别人会使用,除非有人攻击了微信腾讯服务器盗取数据。

当然还有一个方式

你可以利用第三方deep fake技术的APP,通过录入模拟的数字音频再次模拟,这在技术上可以的。

只是由于不是录入的真人声音,是再次基于deep fake技术生成的,自然会有缺失,同时你也不知道博主的家属亲戚联系方式,从理论上来说可以,实际操作上还是很难的。

今天的分享就在这里。

热门AI工具

更多
DeepSeek
DeepSeek

幻方量化公司旗下的开源大模型平台

豆包大模型
豆包大模型

字节跳动自主研发的一系列大型语言模型

WorkBuddy
WorkBuddy

腾讯云推出的AI原生桌面智能体工作台

腾讯元宝
腾讯元宝

腾讯混元平台推出的AI助手

文心一言
文心一言

文心一言是百度开发的AI聊天机器人,通过对话可以生成各种形式的内容。

讯飞写作
讯飞写作

基于讯飞星火大模型的AI写作工具,可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

即梦AI
即梦AI

一站式AI创作平台,免费AI图片和视频生成。

ChatGPT
ChatGPT

最最强大的AI聊天机器人程序,ChatGPT不单是聊天机器人,还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

相关专题

更多
github中文官网入口 github中文版官网网页进入
github中文官网入口 github中文版官网网页进入

github中文官网入口https://docs.github.com/zh/get-started,GitHub 是一种基于云的平台,可在其中存储、共享并与他人一起编写代码。 通过将代码存储在GitHub 上的“存储库”中,你可以: “展示或共享”你的工作。 持续“跟踪和管理”对代码的更改。

4516

2026.01.21

页面置换算法
页面置换算法

页面置换算法是操作系统中用来决定在内存中哪些页面应该被换出以便为新的页面提供空间的算法。本专题为大家提供页面置换算法的相关文章,大家可以免费体验。

504

2023.08.14

chatgpt使用指南
chatgpt使用指南

本专题整合了chatgpt使用教程、新手使用说明等等相关内容,阅读专题下面的文章了解更多详细内容。

0

2026.03.16

chatgpt官网入口地址合集
chatgpt官网入口地址合集

本专题整合了chatgpt官网入口地址、使用教程等内容,阅读专题下面的文章了解更多详细内容。

0

2026.03.16

minimax入口地址汇总
minimax入口地址汇总

本专题整合了minimax相关入口合集,阅读专题下面的文章了解更多详细地址。

4

2026.03.16

C++多线程并发控制与线程安全设计实践
C++多线程并发控制与线程安全设计实践

本专题围绕 C++ 在高性能系统开发中的并发控制技术展开,系统讲解多线程编程模型与线程安全设计方法。内容包括互斥锁、读写锁、条件变量、原子操作以及线程池实现机制,同时结合实际案例分析并发竞争、死锁避免与性能优化策略。通过实践讲解,帮助开发者掌握构建稳定高效并发系统的关键技术。

7

2026.03.16

TypeScript类型系统进阶与大型前端项目实践
TypeScript类型系统进阶与大型前端项目实践

本专题围绕 TypeScript 在大型前端项目中的应用展开,深入讲解类型系统设计与工程化开发方法。内容包括泛型与高级类型、类型推断机制、声明文件编写、模块化结构设计以及代码规范管理。通过真实项目案例分析,帮助开发者构建类型安全、结构清晰、易维护的前端工程体系,提高团队协作效率与代码质量。

114

2026.03.13

Python异步编程与Asyncio高并发应用实践
Python异步编程与Asyncio高并发应用实践

本专题围绕 Python 异步编程模型展开,深入讲解 Asyncio 框架的核心原理与应用实践。内容包括事件循环机制、协程任务调度、异步 IO 处理以及并发任务管理策略。通过构建高并发网络请求与异步数据处理案例,帮助开发者掌握 Python 在高并发场景中的高效开发方法,并提升系统资源利用率与整体运行性能。

141

2026.03.12

C# ASP.NET Core微服务架构与API网关实践
C# ASP.NET Core微服务架构与API网关实践

本专题围绕 C# 在现代后端架构中的微服务实践展开,系统讲解基于 ASP.NET Core 构建可扩展服务体系的核心方法。内容涵盖服务拆分策略、RESTful API 设计、服务间通信、API 网关统一入口管理以及服务治理机制。通过真实项目案例,帮助开发者掌握构建高可用微服务系统的关键技术,提高系统的可扩展性与维护效率。

396

2026.03.11

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
PHP开发微信公众号平台从简到精
PHP开发微信公众号平台从简到精

共25课时 | 6.1万人学习

PHP开发微信公众号视频教程
PHP开发微信公众号视频教程

共5课时 | 1.6万人学习

微信开发公众号平台视频教程
微信开发公众号平台视频教程

共21课时 | 5.5万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号