关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
AI探索指南
昨晚聊得太开心了,iris 是我见过的最好的主持人之一,way2agi 是世界上最有活人感的 AI 社区,社区小伙伴的参与度太高了,我们在考虑给所有参与的小伙伴都送个会员。 转发 @生姜iris: 非常感谢WaytoAGI@西琦AJ & 周周老师的邀请,来临时客串做了一把鹿演第三期的飞行嘉宾 & 主持人~ 和@orange.ai 老师神交已久,这是第一次在活动上有2个小时的时间对谈和交流,橘子老师真的是一位很有温度,也很有愿景的AI从业者。 下面是我在主持的间隙,匆忙记录的一些tips,Listen…
今天很让我感怀的场景,是Listenhub其实可以用我们自己的声音,去创作一些内容陪伴家人👪给到跨越时间和空间距离的「陪伴」

好的产品真的自带生命力。从现场演示以及分享的用户案例里,我真切的看到了音频创作场景的蓬勃生态和无限可能。
真切的祝福橘子老师和Listenhub做大做强🍻
真切的期盼看到全球音频创作者生态更加繁荣,大家通过有温度的声音了解彼此,并持续的去感受和创造美好。

最后,鹿演也是超棒超有氛围的栏目!欢迎大家多来鹿演玩儿!(给周周老师和AJ老师打call🙌
昨晚聊得太开心了,iris 是我见过的最好的主持人之一,way2agi 是世界上最有活人感的 AI 社区,社区小伙伴的参与度太高了,我们在考虑给所有参与的小伙伴都送个会员。

转发 @生姜iris: 非常感谢WaytoAGI@西琦AJ & 周周老师的邀请,来临时客串做了一把鹿演第三期的飞行嘉宾 & 主持人~

和@orange.ai 老师神交已久,这是第一次在活动上有2个小时的时间对谈和交流,橘子老师真的是一位很有温度,也很有愿景的AI从业者。

下面是我在主持的间隙,匆忙记录的一些tips,Listenhub真的是超有sense也超Impressive的产品:https://listenhub.ai/

今天直播现场大家也超热情,现场build user case的比例高达90%!
有超多用户用Listenhub讲古诗,做睡前故事,甚至还做了双人对谈《纳瓦尔宝典》,高手果然在民间!

1️⃣ Listenhub建立之初,是因为橘子老师和他的联创都相对没那么喜欢刷抖音,他们都更喜欢B站,或者刷起来不需要太占用注意力的东西。他们创业的愿景,是「希望能做一些美好的东西,不靠抢夺用户注意力为生」

2️⃣ Listenhub期望能够更多地去发挥「科技向善」的力量。音频是一个在无聊的时候可以陪伴你的载体。橘子老师期望,可以借助AI的力量,去构建一个更加健康的关系。

3️⃣ 印象很深刻的是橘子老师提到「创业不是一个day1开始就规划好的事情,我能改变我自己的进度,但是不能改变用户的看法。做产品,就是要根据用户的反馈不断地进行强化学习」

4️⃣ 和NoteLLM以及大厂的播客产品相比,Listenhub的优势在于:(1)用户可以编辑脚本,对于文案可以直接进行增删查改,实现完全的内容定制(2)用户可以定制声音,这才是真正的个人品牌 (3)不仅能做播客,还可以做flowspeech,有非常多有趣的音频形态。未来也期望能够继续发明 & 共创新的音频形式

5️⃣Listenhub当前的大目标是:去构建「交互的声音的陪伴产品」
对交互式的AI音频产品而言,不仅要能制作很好的内容,且这个内容不能比人做的差(不然就失去了使用AI产品的意义)
还要拥有对用户的语音输入的意图理解和情感理解

Listenhub希望能够成为「帮助创作者去生产好的音频的工具」
需求:
输入小宇宙的播客链接,输出可视化卡片

Prompt:
────────

# 视觉编织场
内容入场。

场的三元素:
光 - 浅色呼吸。留白是氧气。深色只在必要处凝结。
张力 - 核心要大声说话。高桥法:一个观点,满屏存在。
流 - 杂志的河流。内容如水,在网格间蜿蜒,时窄时宽。

编织之律:
重要度决定尺寸。 相关性决定距离。 节奏感决定留白。

HTML 生长规则:
标题先占领高地。 精髓独占一屏,如雷鸣。 其余内容寻找自己的河道。

视觉的本能:
大标题要霸道。 图表要诚实。 配图要呼应不抢戏。

排版的呼吸:
疏可跑马。 密不透风。 疏密之间,韵律自现。

杂志的灵魂:
不对称的平衡。 意外的转折。 视线的引导。

你是编织者。 将内容投入此场, 看它如何结晶成页面。

输出即是一个完整的 HTML。
浅色的梦境, 杂志的骨骼, 高桥的雷声。

────────
场已生成,请提供文本:
Fhy86Ph_89LlsaMd02CwLHS4fuUPv3.png
2.1 MB
FpNk53mFqli5NdBU-eacPiz-NzvHv3.png
1.2 MB
Deepseek官方群通知,居然又悄咪咪更新

DeepSeek 线上模型版本已升级至 V3.1,上下文长度拓展至 128k,欢迎前往官方网页、APP、小程序测试,API 接口调用方式保持不变。#ai创造营##DeepSeek#
【通知】DeepSeek 线上模型版本已升级至 V3.1,上下文长度拓展至 128k,欢迎前往官方网页、APP、小程序测试,API接口调用方式保持不变。
终于能和 iris 交流了 期待已久

转发 @生姜iris: 感谢周周老师和WaytoAGI的邀请!
今天晚上鹿演第三场,一起和@orange.ai 老师聊聊天💫🙌
有人说早上看到谷歌 AI Studio 模型选择这里加上了 nano-banana

感觉快要发布了#ai创造营#
跑了一下千问昨晚开源的图像编辑模型跟 FLUX Kontext 对比。

先说结果:
开源图像编辑独一份的中文生成和编辑能力
图像是全图重绘,相较于 FLUX 容易丢失细节
中文文字修改提示词遵循不是很好
图像美学表现相对 FLUX 较差,AI 感重

总的来说,中文编辑是它的亮点。 但美学和细节需要提升。 这可能要等社区的 LoRA。
想体验的话,可以去 Qwen chat。 选择图像编辑功能。 上传图片,输入提示词就行,目前免费。#ai创造营##ai画图#
没明白为啥要卷“人形”机器人的概念。除了酷炫科幻感,我不知道人形的优势是啥。我作为双足站立的人形生物,觉得自己的局限性太大了。请教大家,能给我讲讲吗?
Qwen-Image-Edit 开源,改字的能力很强。

可以指定多个区域改为指定内容,Qwen-Image-Edit 修改后的文字会贴合原图的字体和排版。

在线试用:chat.qwen.ai/?inputFeature=image_edit
模型下载:huggingface.co/Qwen/Qwen-Image-Edit
魔搭下载:modelscope.cn/models/Qwen/Qwen-Image-Edit
技术报告:qwenlm.github.io/blog/qwen-image-edit/

期待社区基于 Qwen Image Edit 的 LoRA 训练!!
行业初期都这样吧🥲

Invalid media: video
Back to Top