关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
对于创作女孩子我还是有一点审美自信的
吴恩达课程出的和母猪下仔一样,新课《深入了解量化》发布。

将从零开始学习实现线性量化的不同形式,包括非对称和对称模式。

课程还将指导如何在不同的维度(如单个张量、单个通道、单个组)上进行量化,以确保性能不受影响。

学习构建量化器,将任何开源深度学习模型的密集层压缩至8位精度。

通过将四个2位的权重打包进一个8位的整数中,实践如何将权重量化至2位。

课程地址:https://www.deeplearning.ai/short-courses/quantization-in-depth/
最近见到过最好的 Animatediff 作品,动作幅度很大,运动很流畅,而且画面表现也很强。

作者用 Blander 制作很简陋的动画,再用 Animatediff 转绘的。

制作过程视频在这里:https://www.instagram.com/p/C555jsDLlP_/
一个很简单的教程,教你用 GPT-4 实现一个自动的 RAG 项目,系统可以自动决定从本地数据中查找还是联网获取内容。

项目地址:https://github.com/phidatahq/phidata/tree/main/cookbook/examples/auto_rag
一晚上把 coze 的大部分插件都玩了一遍,下图记录了一些比较好玩的插件

把这些插件利用工作流串起来放到 bot 中,很多小想法都可以实现了

例如小宇宙链接分享至微信获取播客摘要:小宇宙链接提取工具 ➡️ 音频处理成文本工具 ➡️ 文本总结摘要工具 ➡️ 发布至微信客服

就可以达到分享至微信就获取摘要的目的

对于一些不复杂的产品,coze 把做产品变得像写 prd 一样简单
终于有人干这个了,之前很多在 Comfyui 中的 LLM 都得单独配置,一个插件一个玩法。

Comfyui-ollama 这个插件可以直接使用 Ollama 中的 LLM。

你可以使用带视觉能力的模型生成图片描述,也可以自定义提示词对你的图像提示进行润色生成。

插件地址:https://github.com/stavsap/comfyui-ollama
FgxE27z6KcW07ckN0Qs1_yQDYdyhv3.png
928.6 KB
今天候机的时候看到一款很特别的“AI 硬件”产品,给我留下了深刻印象。

先介绍一下这款产品,它叫诗歌相机(Poetry Camera),看着和一个拍立得相机并无二致,一切不同发生在用户按下快门之后。
完成拍摄后,相机吐出的不是相纸,而是一张印有一首诗歌的小纸条,就好像拍立得当场洗出了一张照片。诗歌纸条的内容,是 GPT-4V 基于用户拍摄的画面本身的元素/颜色/情绪等等信息,生成的一首小诗。

这款产品给我的冲击之处在于,最先进的前沿技术代表与老式的仪式感代表在这款产品上得到了融合,特别是还是借助的诗歌这个载体。

它不仅使用了拍立得这个具有特殊意义的相机形态作为载体(拍摄立刻出片,不可修图,不可保存电子档),并且在输出件上再做了一层减法——连图片都不保留,诗歌就是这一瞬间保存的唯一载体,连文字都以实体的纸条形态承载,不可被修改,不可被直接转发。
而这样一个略带复古和仪式感的流程,中间最核心的部分则是由最前沿的多模态大模型完成图像输入到诗歌生成输出的。

这个新旧的交融很打动我。
而且和给出的画面已有基本预期的拍立得比起来,生成诗歌结果的不确定性也许更让人期待。

这还是一个开源项目,开发者已经在 Github 上公开了详细的 DIY 教程(https://github.com/carolynz/poetry-camera-rpi),包含所需硬件清单和软件代码。使用树莓派作为主体,搞上热敏打印机,外加上一个纸壳子,接上大模型 API,你也可以打造一个属于自己的拍立得(写诗版)。

这里是官网链接:https://poetry.camera
喜欢AI生成的小姐姐吗?
整理一下国内最近 AI 影像比赛:

1. 猫眼电影“造梦师”AI 短视频大赛
🔸主题:造梦师进入TA人的梦里
🔸截止:5.4
🔸奖品:猫眼电影动画项目合作等

2. 新世相 AI 影像创作计划
🔸主题:爱恨情仇
🔸截止:5.6
🔸奖品:阿那亚线下展览

3. V中文版 & 故事接龙社群
🔸主题:法国主题 AI 短片影像
🔸截止:5.10
🔸奖品:5.24-5.26 在成都当代影像馆展出

4. 上影全球 AI 电影马拉松大赛
🔸主题:神话/科幻 + IP
🔸截止:5.19
🔸奖品:影院展映

5. 歌德学院 AI 生成短片竞赛
🔸主题:自由意志
🔸截止:5.31
🔸奖品:中德往返机票、线上展示

6. Bilibili x 央视 AI 影像征集大赛
🔸主题:奇幻 / 科幻 / 创想
🔸截止:6.28
🔸奖品:每一赛道有 10W 奖金池,最高5W

最近比赛真的好多哇,还有三个我知道有的但还没宣的,等正式发布了添加进来。

春末夏初是创作的季节!
Shape of AI —— AI 功能模式收集

链接:https://www.shapeof.ai/

网站收集了 5 类共 16 种 AI 能在产品中落地的功能模式。你可以从网站上学到如何在自己的产品中融入合适的 AI 功能,也能看到其他产品中使用 AI 功能的截图。
生成式 AI 这一波,作为非技术人员,我的突破口究竟在哪里?

这个问题,从去年上半年开始,我一直在探索。但迄今为止,也不敢说有多么确切的答案。

最近读到几篇有意思的文章,感觉还挺给我信心的,试着整理出来:

1、智能效能=大模型的智商水平 × 现实理解的深度

内容来自《假如想做一个只有AI智能体的公司,那要分几步?》[1]。

前半部分的“大模型智商水平”,要依赖 AI 科学家和工程师们;后半部分的“现实理解的深度”,却主要靠各个领域的高手。

文章中说,这事行不行,能搞到什么程度,不是程序员能验证的,而是「理解领域的人」要自己操练大模型做判断。

而这,就是非技术人员的突破口之一。

2、做“汤姆猫”实现能力升级后,再去超越“汤姆猫”

结论来自《AI应用之路:质疑汤姆猫,成为汤姆猫,超越汤姆猫》[2]

文章中说,汤姆猫是2010年移动互联网早期的一款应用,迅速走红,又淡出视野。

这也对应了自己一些时候的焦虑吧,现在手头的事情,会不会昙花一现,难以长虹。

然后,文章里的这两段话安慰到我了:

“AI现在所处的极早期阶段,在寻找PMF的时候,先不要嫌弃他是汤姆猫,找个具体且收敛的切入点,跑通他,让自己有个实验室,先完成能力跳变。”

“(PMF)跑通后,整个人的思考水平、决策的犀利程度、心态的平稳度都有一个质变,再之后,就和业务量爬到几层楼相关了。”

3、赢家常常不是第一个,但大概率是第一批

规律来自《议古论今:聊聊现在AI应用层创业者面对的三个问题》[3]

通过梳理过去50年IT产业的发展和创业历史,这篇文章中发现:

第一个吃螃蟹的人,产品往往不完善;但笑到最后的玩家,都来自「产品定义/商业模式成为共识前」冲进来的那一批。

如果历史会押韵,那么与我而言,倒不是奢望成为所谓的“赢家”,但至少能说明早点来牌桌上呆着,是有一定价值的。

———

[1]https://mp.weixin.qq.com/s/s4g_qxg95wyGs2GGcvztpw

[2]https://mp.weixin.qq.com/s/l6cNKA5gCsselraTMV5UXA

[3]https://mp.weixin.qq.com/s/JPyfpVUgqI8hxZE-z-zBbg
Remini生成不出来可以不生成。把我变成消防栓也是够了🙂
Back to Top