关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
从0到5k:花了100天,从5k到8k:花了30天。在这8k的订阅中,有2400人进了微信会员群。

好内容,驱动高质量的增长~
前几天做了个新站,最近谷歌日UV都突破了1000,记录下自己的一点点想法

1. 选择比努力更重要

这个站起量起得比较快,并不是因为SEO和推广做得多到位,也不是我网站提供的产品/服务多么地突出

纯粹就是找到了一个搜索量还可以,但几乎没人竞争的词。做一个网站出来,基础的SEO动作做足,流量就蹭蹭地来了

在找需求、分析需求上要投入的功夫,一点都不比开发和推广的要少,甚至我觉得是能决定一个站成败与否的一步

而这块也是自己目前比较薄弱的部分,后面需要投入更多的时间去学习

2. 以下是对自己的一些警醒

①做新词能搞来流量,不代表着做老词也能达到这水平

并且总的来说,越是刚需、越是高频的需求,是老词的概率也越大。如果未来想获得稳定且大额的收入的话,老词应该是绕不过去的坎

②目前这个词几乎不存在变现的可能,作为练手的素材可以,但未来还是得挑战有变现空间的词

或许也早有人发现了这个词,但是因为看不到变现的可能,所以不屑于下场做,才让自己捡了个漏,因此别对这一点点成绩沾沾自喜
Demo 不算产品,用户真正可用的才叫产品。

只给 Demo 不给产品甚至连发布时间都没有的一律按新建文件夹的诈骗处理。

Arc CEO 说这个夏天剩下的时间他都不会发推了。

“最近整个行业都很怪,感觉大家都在宣布新东西,但却没有真正发布。

谷歌 I/O 大会发布那么多东西,用上的寥寥无几,甚至苹果都开始画饼,今年 WWDC 发的东西 2025 年才能用上。

所以他想挑战一下用真正可用的产品来讲述他们希望的未来。”
微软开源的一个文本编码器Glyph-ByT5-v2。

支持使用十多种语言生成图片。

还搭配了一个使用这个文本编码器的 SDXL 模型,可以直接生成中文海报和内容。

从演示来看排版都挺好的。

1) 创建了一个高质量的多语言字形文本和图形设计数据集,包含超过100万个字形文本对和1000万个图形设计图像文本对,覆盖另外九种语言;

2) 构建了一个多语言视觉段落基准数据集,包括1000个提示,每种语言100个,用于评估多语言视觉拼写准确性;

3) 采用最新的步进感知偏好学习方法,提高了视觉美学质量。

模型下载:https://huggingface.co/GlyphByT5/Glyph-SDXL-v2
年轻人拒绝伺候扫地机了

今天跟我奶奶👵说,咸鱼上找保洁搞卫生,15元/小时很便宜,我奶奶说不能用扫地机器人吗?

我说,阿姨一次30元/2小时,每周一次,一个月120元。一年大概跟一个入门版扫地机器人一样的价格。但是扫地机器人只能清洁地板,不能帮我清洁猫砂盆,洗猫砂盆,洗猫咪的碗,也不能搞厨房和厕所的卫生。

说完,忽然有点莫名的悲伤😞
看啥长文档都有GPT的味道🙃...
一些使用国产 AI 大模型的细节限制。

1.kimi 的文本生成很强,但没有数据分析能力,会把上传的 Excel 识别为文本。kimi 无法识别图片,只能识别图片的文本,OCR。

2.智谱清言可以识别图片内容,可以做数据分析,但是要用数据分析的智能体,经常抽风。你不和他特地强调 Excel 里有几个 sheet,他只默认识别第一个 sheet。

3.coze 里上传 Excel 分析的体验很差,coze 的知识库是无法理解数据集的,还是当成文本来处理。
机器逐渐智能,走进人类的家庭,承担日常繁杂事务,成为新时代的黑奴,并奋起反抗。
出于政治斗争,人类中分裂出一个群体,要解放机器人,并和人类至上主义者发生战争,史称东西战争。
最终机器人争取到人权,人“人”平等
10分钟搞定我妈明天答辩的ppt
感谢gamma!真的好用啊
如何做一部风格化鲜明又统一的 AI 短片?
「VISION」视频制作流程分享⬇️
分享色彩统一、主题鲜明、流动感强的技巧
原视频:https://m.okjike.com/originalPosts/666d7cd319d274e296add59d?s=ewoidSI6ICI2NDk0MzEwNDA1MDU0NDcyNjRkNmI3MDEiCn0=

偶然在 MJ 中抽卡“Monument Valley”发现了这个色彩斑斓红色岩石般的风格 便开启这次 AI 创作之旅,文案、配音、配乐、图片、视频均由 AI 制作,我提供灵感和剪辑。

1️⃣MJ Style Prompt
在 MJ 网页版更好操作,用第一张图作为风格参考图后,后面的 prompt 只需要描述物体意向即可。比如鸟、树、森林、月亮,是本次我想创作的主题。如图2。

2️⃣文案与配音
想营造马丁卢瑟金充满希望向上的生命力,我使用11labs 克隆自己的声音,用日语念独白。
独白让 GPT4o 生成一份“模仿马丁 I have a dream 演讲,关于生活向往的文章”

我上传了在干净环境下录制的4mins 说话素材到11labs 即可完成 instant clone voice,如图3。实测声音特别像我念日语!很惊艳

3️⃣配乐
配乐用 Suno ,描绘创作想法就可以找到你想要的配乐,没抽卡几次。
prompt 很简单:flying through a monument valley, relaxing , exciting, and a little bit halarious and weird.
因为想要一种向上,但又不是正能量向上的感觉。所以加上了“略微奇怪”

4️⃣动起来的视频
Luma 和 Runway 均使用了(为了分摊成本和时间)。从视频右上角水印你可以看出哪些是 Luma 的。
Runway 适合只有一点动感的场景,比如水波纹流动,略微场景透视变化。
Luma 适合开头飞跃山谷这种透视变化的3D/2.5D 场景。
Runway 更稳定一些,Luma 抽卡失败率较高,可以酌情考虑成本和抽卡时间。

5️⃣蒙太奇剪辑
只需要使用 text based 剪辑手法即可,根据音乐节奏调整素材速度。字幕和字体很关键,适当加一些转场特效。
一个小 tips,让画面与音乐变化或台词变化的节奏错开一点,会增加视频的有机程度,没那么像卡点剪辑。
Back to Top