关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
【BibiGPT】AI 自动总结 YouTub 视频 · 一大波更新!Notion 账号登录,书签快捷跳转,智能时间戳,油管英文内容也可以一键总结!_哔哩哔哩_bilibili

【BibiGPT】AI 自动总结 YouTub 视频

👨‍💻 昨晚刚上线了YouTube视频的一键总结,欢迎试用给我反馈哦 🥳☀️

https://b.jimmylv.cn

🐳 一大波更新!Notion 账号登录,书签快捷跳转,智能时间戳,油管英文内容也可以一键总结!
读近期历史的好处是不管出现多少个人的名字,多多少少都认识,不会犯晕。
今天的大新闻让我们瞥见未来,Google 公布了 PaLM-E 具身语言模型,562B 参数,将现实世界的信息通过传感器纳入语言模型,让机器人可以连续对物体进行适应性操作。 https://palm-e.github.io/
RT Baye aka 威力狈
OpenCat is now available on the App Store. This native iOS/macOS client for ChatGPT utilizes your own API key, providing a faster and enhanced chat experience. https://apps.apple.com/us/app/opencat/id6445999201
看到一个特别有趣的AI模型,可以让文字变成图象,象形文字要复兴了(不是)。

里面有几个单词原本不知道什么意思,看到图象突然就懂了。

链接:https://wordasimage.github.io/Word-As-Image-Page/

另外,还看到一个用ControlNet将文字嵌入到图片中的尝试(图5)。

感觉这两者结合可以有很多商业用途,logo设计,海报设计,banner设计等等,这些设计工作都会涉及到如何让文字和图像相融合。
RT 狗粮轰炸机恶师傅
ChatGPT:
* 假装理中客语气
* 显得上知天文下知地理
* 不懂就开始天花乱坠瞎编,直到说到了用户熟悉的领域
* 当被指出错误的时候勇于承认并表示“我就是个语言模型啊”,暗示大家要宽容

结论:是个中年国师大V

(逃
RT no13bus🇸🇪
OMG. It is shock for me. The knowledge I learned from childhood to adulthood turned out to be false. FUCK.
RT Danny Driess
What happens when we train the largest vision-language model and add in robot experiences?
The result is PaLM-E 🌴🤖, a 562-billion parameter, general-purpose, embodied visual-language generalist - across robotics, vision, and language.

Website: https://palm-e.github.io
AI探索指南
Google 重磅: PaLM-E 来了,562B、多模态,打破生物和非生物界限的一大步! 受到New Bing 和ChatGPT强劲冲击的谷歌, 今天放出了重磅消息。 老规矩, 这则爆炸新闻依然照顾非专业人士的阅读体验。 如果你还没有了解过多模态,这个核心概念。 (强烈推荐优先阅读,这里一篇极简的科普 《像大脑一样学习的多模态》https://m.okjike.com/originalPosts/6400909b4fa545a27bca4547?s=ewoidSI6ICI1OWU1NmRlYzM1M…
步骤就不描述了, 你很容易想象成为一个万能分类能手, 有点像儿童早期认知世界那样的话,通过不断探索各式各样的物件的属性,慢慢成为人类社会的一份子。

我们想象家庭和工业场景的有认知学习的对话机器人,清洁助手也好、厨房助手、衣柜整理小助手也好,无处不在。

官方🔗 有更多视频和论文说明,推荐观赏。https://palm-e.github.io/

相信你已经大致感受到了 PaLM-E 的神奇、无限想象空间。可以说, PaLM-E 诞生,机器不仅有了 ChatGPT 的辅助创作和认知学习能力,还有了多维度感官学习的能力,它必将为进一步打破生物和非生物的边界, 迈出了一大步。 更多消息,持续跟进中。

🌄「重点不在于我们在山坡上攀登到了什么高度,而在于山峰自身正在被那些巨大但不可见的陆块碰撞的力量推得更高。」
Google 重磅: PaLM-E 来了,562B、多模态,打破生物和非生物界限的一大步!

受到New Bing 和ChatGPT强劲冲击的谷歌, 今天放出了重磅消息。

老规矩, 这则爆炸新闻依然照顾非专业人士的阅读体验。 如果你还没有了解过多模态,这个核心概念。
(强烈推荐优先阅读,这里一篇极简的科普 《像大脑一样学习的多模态》https://m.okjike.com/originalPosts/6400909b4fa545a27bca4547?s=ewoidSI6ICI1OWU1NmRlYzM1MzM1ZjAwMTU4YTdhNTciCn0=)

🆚 先快速对比讨论, PaLM-E 和 ChatGPT 有什么异同:

- PaLM-E 是5620亿参数的嵌入式语言模型,而ChatGPT是1750亿参数的通用语言模型。
- PaLM-E 可以处理多模态数据,例如声音、图像、文本等,而ChatGPT主要处理文本数据。
- PaLM-E 能够在边缘设备(手机、摄像头等不依赖云)上高效运行,而ChatGPT需要云端计算资源。

🫣 多模态为什么很神奇?

我对多模态的思想给出一个参考的比喻,即它是机器学习进一步地模拟大脑,希望机器像生物一样拥有多感官来整合对世界的认知。

具体来说,PaLM-E 是输入端的数据训练有了维度上的突破, 它可以把连续性的、多维度的观察数据(状态、视觉还有各种探测器)注入模型。全称是 Pathways Lauguage Model, 其中E 代表Embody(具身认知)。

因此, Palm- E 是一个多模态的、 5620 亿参数、通用、具身认知的通才——横跨机器人、视觉和语言的LLM。

🤖 第一案例:家用机器人的厨房场景

(在随附视频 25秒,左上位置,你看到了厨房的机器人)

你直接想象,你把它买回家!让它自己也通过视觉和语音等方式捕捉来完善整个环境和物件信息,完全个性化、定制化的学习。

任务是这样: 帮我把抽屉里的薯片拿过来!

- 首先,它自己先走抽屉附近
- 然后,打开了最上面第一个抽屉
- 接着把绿色包装的薯片取了出来。
- 它戴着薯片走向你面前。( Fin)

🟩 第二个案例:认知学习,排列组合不同形状和颜色物件

(在随附视频 25秒,右上位置,桌面工作站)

任务是这样:根据颜色分类,并将其放置桌角。
RT Dayu
这个 OpenAI API + Telegram Bot + Cloudflare Workers 的方案太舒服了,反应速度比直接用 ChatGPT Plus 还流畅些!

Dayu: #Alfred 现在也有支持 OpenAI Api 的插件了!
https://anotherdayu.com/2023/4866/
什么叫好服务呢
就是看到数字游民都在往土耳其迁徙
然后看到 clash 订阅里出现了一个土耳其
这不去白不去啊😂
RT 🍋Ice-Hazymoon
看到大家最近都在用 Cloudflare Worker 搭建OpenAI 的代理,但其实还有更简单的方法,腾讯云函数,所以我花了半个小时写了份猴子都能学会的教程供大家使用。

我希望每个人都能无痛的使用 OpenAI,而不是去给第三方套壳 APP 交钱。

教程在此:👇🏻https://github.com/Ice-Hazymoon/openai-scf-proxy
Back to Top