关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
AIGC 领域的最新工具、开源项目以及行业大事件
太多人坚信字节这种「极致推荐用户喜欢」就是制造正反馈的不可逾越的天花板,但有没有想过:
俄罗斯方块为啥不给用户一直推他们最喜欢的直长条?
因为人的贪嗔痴喜欢,是靠阉割来产生的。
我最喜欢钱,但银行不让我抢,支付宝不让我破解。我第二喜欢色,但公开网络都不让看黄图。我最喜欢的东西,全都写在刑法里。我只能找点代偿品。
因为得不到,所以才喜欢。
所以游戏是靠故意设计boss障碍挑战,才让虚拟宝物有了价值。
如果你能设计生成障碍,你就能制造更高的正反馈,因为正反馈本就取决于行为前后GAP高度反差
俄罗斯方块为啥不给用户一直推他们最喜欢的直长条?
因为人的贪嗔痴喜欢,是靠阉割来产生的。
我最喜欢钱,但银行不让我抢,支付宝不让我破解。我第二喜欢色,但公开网络都不让看黄图。我最喜欢的东西,全都写在刑法里。我只能找点代偿品。
因为得不到,所以才喜欢。
所以游戏是靠故意设计boss障碍挑战,才让虚拟宝物有了价值。
如果你能设计生成障碍,你就能制造更高的正反馈,因为正反馈本就取决于行为前后GAP高度反差
上海交通大学开源了一个非常牛批的语音生成模型 F5-TTS。
刚好这几天AI音频和播客火爆,这下瞌睡送枕头了。
模型特点有:
零样本 (Zero-shot) 声音克隆
速度控制(基于总时长)
可以控制合成语音的情感表现
长文本合成
支持中文和英文多语言合成
在 10 万小时数据上训练
最重要的是支持商用
论文:https://arxiv.org/abs/2410.06885
模型下载:https://huggingface.co/SWivid/F5-TTS
演示Demo:https://huggingface.co/spaces/mrfakename/E2-F5-TTS
项目地址:https://github.com/SWivid/F5-TTS
刚好这几天AI音频和播客火爆,这下瞌睡送枕头了。
模型特点有:
零样本 (Zero-shot) 声音克隆
速度控制(基于总时长)
可以控制合成语音的情感表现
长文本合成
支持中文和英文多语言合成
在 10 万小时数据上训练
最重要的是支持商用
论文:https://arxiv.org/abs/2410.06885
模型下载:https://huggingface.co/SWivid/F5-TTS
演示Demo:https://huggingface.co/spaces/mrfakename/E2-F5-TTS
项目地址:https://github.com/SWivid/F5-TTS