关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
大家放心,目前机器人完全没有取代人类工作的可能。
十万美元的机器人,连续工作二十个小时,坏地上了,老板还得花钱找人去修。
而三千块钱的你,连续通宵,身体不舒服了,会自己花钱去医院,请假还能再扣你一笔钱。
GPT可以理解你说的话,可以听明白你说的话,可以看世间万物,可以说,可以写,可以通过与你的互动不断学习,可以不断满足你的需求。chatGPT在手机APP上已经实现了这些。
换言之,未来的机器人时代的基础都已经搭建好了,不是么?
机器人干活的样子真有趣🙂
做了一个 爬虫(Selenium) GPTs 助手(1.0 版本)

🤔 有时候科研人需要爬取一些网站的数据,但可能没有花太多时间系统深入学习过爬虫技术(处于一种似懂非懂的状态),这个时候如果你直接问 GPT-4,他其实很难很快给到你一个满意的回复。

🤷 首先 GPT-4 不一定会主动用 selenium 框架,面对一些反爬又很烦;其次,就算你让他使用,中间也需要大量的沟通防止 GPT-4 不要跑题(例如改着改着就不用 selenium 框架了);再者,也有人可能并不知道如何解决 ChromeDriver 的版本匹配问题,而 GPT-4 似乎很难清晰地提出这个问题的解决方案。所以我干脆就写好了 Documents 和 Prompts 方便你直接跳过很多和 GPT-4 不必要的沟通……从而迅速根据你的需求定制爬虫代码。再加上现在 GPT-4 这上下文长度起来后,不会超出限制就很好。

🐍 我把她命名为 Cyber Scraper: Seraphina。在这里可以联系她:https://chat.openai.com/g/g-6TW6hL3cK-cyber-scraper-seraphina-web-crawler

使用的方法大致就是只要你会审查元素,然后把它们 copy 给 Seraphina,让她清楚地知道你的目标元素是啥就行。如果她没明白的话你还可以保存一下当前页面 html 文件(mac 是 cmd shift s)然后上传上去,配合着你 copy 的 element 代码,这样大致上没问题了。相比之下,直接问 GPT-4 需要花费更多的时间达成共识。

🧑‍🤝‍🧑 她也是我制作的另一个 GPTs:「Carpe Diem 教授」的朋友:https://chat.openai.com/g/g-zut9cfvbZ-paper-reading-advisor-carpe-diem

🤨 那么 Seraphina 和 Carpe Diem 教授是如何认识的呢?让我们一起看看 Carpe Diem 教授是怎么说的吧 😆👇
给研究 AI 的朋友推荐一款 AI 产品榜,aicpb.com,它收录了一万多款 AI 产品,覆盖了从访问量、时长、增长速度和营收等相关数据,并且对所有产品进行了维度细分,包含 100 多个子领域,较为全面。

当前榜单按月更新,数据来源主要是 SimilarWeb 和 SensorTower,前者是一个著名的网站分析工具,后者是一家移动应用数据分析公司。
去年开始会不断有投资人找我吃饭,大致都是希望能探讨AI对影视/动画/游戏产业的影响,虽然我并没有成为一个创业公司 founder 的打算,但是回顾这一年,不同 VC 对我的帮助非常大:

🔸A 介绍了 OpenAI 的朋友和大厂 GPT 线负责人给我,这两位都成为了我重要的朋友;
🔸B 介绍了猫眼电影给我,我成为了猫眼的签约制作人;
🔸C 介绍了 Stability AI 的 Tech Lead 给我,以及通过 C 认识了非常棒的 AI Video 公司;
🔸D 介绍我制作了他们公司大会的 AI 视频;
🔸E 介绍我认识了头部大厂 AI 产品的负责人。
……

基本每件事都对我产生了或大或小的影响,这些都不是我曾经能计划的。每次这种时候我都会想起乔布斯在斯坦福的演讲:of course it was impossible to connect the dots when I was in college, but it was very very clear looking backwards 10 years later.

生命的缘分都是难以被计划的啊,谢谢朋友们一直以来的厚爱和关照 💓
最近OPENAI DEVDAY又火了一把,不想关注都不行。前两天跟一个技术大拿讨论AI发展的终局、层次和阶段会是什么,杀手锏级应用是什么?抛出一个不成熟的观点:
三种可能性:AI作为人类的高级工具(工具),AI作为人类的外挂(器官),AI作为独立个体(伙伴)

作为生产力工具,它取代的是低效能工具和服务,为人类带来更多剩余时间。作为人类外挂,它是增强人类的创造力,增加人类生命质量。作为独立个体,延长人类生命时间。

正在发生和被讨论最多的是生产力工具,最近见识了几千个工具,基本上绝大多数还停留在套壳阶段,基于智能机和电脑键盘,自娱自乐性质更大一些,相信很快有实际的真正亮眼的AI工具出来。

多模态环境感知和处理能力的增强,我深信可见时间的未来,AI杀手锏会诞生在软硬件结合领域,它应该具备这些特点中的两个:1、多模态环境感知能力(增强人类的五官,看、听、闻、触、温等);2、空间感知能力(能接收和处理空间变化);3、可自主移动能力(空间意义上的数字分身)。

盘点下来,值得关注和期待的领域:可穿戴设备(实时在线,可被动移动)、智能家居(环境感知增强)、智能家用机器人(小区域可自主移动)、​智能车(大区域可自主移动)、可飞行智能车(大空间可自主移动)…
发现了一个神奇的硬件,叫The Halo:一种非侵入性神经设备,用于稳定和诱导清明梦。
关于清明梦:是一种梦,做梦者意识到自己正在做梦。你可以在梦中做任何自己想做的事情,类似于赛博朋克2077的超梦。有的说古人的阴神出游也是清明梦的一种。

The Halo基于超声波和机器学习模型的结合,使The Halo能够检测做梦者何时处于快速眼动睡眠状态,以诱导和稳定清醒梦。
这个硬件还搭配一个The Prophetic App应用,运行专有的机器学习检测模型,支持追踪睡眠,上传清醒梦数据以改进模型。

官网:https://propheticai.co/pages/science
昨晚在@哥飞 的群里,申请了@Airyland 共享的 gptshunter.com 网站的数据,今天上午写了个 GPTs 应用导航站,下午写了个浏览器插件,在 ChatGPT explore 侧边栏展示第三方 GPTs 应用.

最近几天卷这类产品的人有点多,在 ChatGPT 上线官方应用商店之前,多少还是有点机会,就跟 17 年小程序刚出来时各种第三方小程序商店一样.

可以访问 https://gpts.works 查看我这款 GPTs 导航站,chrome 插件已经提交审核,预计要等几天才能发布,有需要提前体验插件的可以微信私聊我:imgptalk 拿离线安装包.😉
不亏是旧金山,机场就有机器人咖啡店,虽然有很多多余的动作,就当看表演了。

Invalid media: video
ChatGPT新推出的GPTs这个功能真的太好用了!
做了3个GPT:
- 创业导师:模仿知名企业家,协助用户一起分析和思考,欢迎体验:https://chat.openai.com/g/g-FirDmP6nD-startup-mentor
- KOL助手:把帖子转化成适合不同平台的风格并配图,一稿多投 https://chat.openai.com/g/g-2Vi1rfYki-kolduo-ping-tai-fa-bu-xiao-zhu-shou
- Sophia的个人分身:基于Sophia的简历、各种回答训练而成,非常适合用于填写申请表、以及个性化写作
(ps. 原来GPT眼中的我长这样吗?)
学计算机的造词能力太强了,机器人这个次都要淘汰了。试了一下GPTs,初步体验还可以,但有时仍然会忘记设置的指令。做了一个计算机和机器人相关的双语专家系统,欢迎使用(需要plus)https://chat.openai.com/g/g-Uq9N2UsGO-hohar
你们会花七万块 买一个小小小型机器人的拥抱吗 带37度温度的…它还只负责卖萌 每天睡8小时…
今天还有个事情我觉的不亚于GPTs也值得关注一下。
前段时间我一直在关注LCM(Latent Consistency Models)这个技术,它可以让SD的图片生成速度提高5倍左右,但是存在的一个问题就是模型需要单独训练,无法兼容现有模型,这就导致无法融入现有的生态。
今天这个状态改变了,他们把LCM变成了一个Lora模型,这个模型可以兼容现有的所有SD模型,不管是1.5的还是SDXL还是SSB-1B。

带来的后果就是大幅降低SD图片生成的硬件门槛,你现在甚至用CPU跑图的时间都可以接受了。
可以在更短的时间生成更多的图像,这在抽卡的时候很重要,大力出奇迹是能解决很多问题的。
SD图像生成服务的成本会大幅降低。

LCM Lora现在已经可以在Comfy UI上使用了,我自己测试了一下,1.5的模型使用LCM Lora大概比不使用快了4.7倍左右。下面几张图是对应的生成效果和时间。从生成质量上来看没有特别大的区别。
Back to Top