关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
AI 可能是一种新的印刷术。

印刷术让内容复制大为便利。在15-16世纪,印刷术的崛起,打破了各大教堂对文本的控制。在印刷术崛起前的1424年,剑桥大学图书馆总共只有122本书。在印刷术崛起后的1454年至1500年的46年中,欧洲印刷了超过1200万册图书。

AI可能是一种新的印刷术。这种印刷术,在内容压缩的基础上,让内容的remix变得极为便利。任何用户都有能力通过AI产生内容。印刷,让人人可复制内容。AI,让人人能创作内容。

然而有意思的是,印刷术本身,并没有产生科学。但没有印刷术,科学在人类中的发展速度大概率会慢很多。AI可能也类似。AI本身产生不了创新,但AI工具可以极大帮助创新发生。本需要50-100年发生的创新,有了AI后,很可能能在接下来5-10年内发生。这非常让人激动。
给 Jellycat 做了再见爱人联名款。
AI硬件方向主理人Mark又更新啦
新增手势传感,反应很灵敏哈,我有那么一点有付费意愿啦。

客观的讲,如果不是研究学习以及二次开发,付费意愿还是不够。

最近与他一起参加阿里AI硬件的黑客松,顺手打算做一套智能体长期记忆与认知。立个小flag,半年后达到自己满意的效果。
这几个LLM常识你懂几个?

记得Andrej Kapathy
在微软2023Build大会大会上分享过
State of GPT

于是翻出来看了下
发现很多意外的惊喜

图1:Prompt是什么?
Prompt弥补了人类大脑和LLM大脑两种认知架构的差异

人类要用自然语言进行编程
也需要深入理解模型的行为和反应

图2:描述了人类的思考逻辑
o1的出现恰恰是模仿了人类这个思维链

图3、图4:为何CoT(思维链)有效?
因为Transformer架构对每个Token块分配相同的短时间
所以复杂任务你必须要让他思考更长时间
即用更多Token块来让模型有时间思考

图5:为何大模型不会调用工具?
因为大模型不知道他不知道的
之前的语料里就没有何时应该用工具
如何用工具的内容
所以它不知道

太有意思了!
对话谷歌首席科学家Jeff Dean:AI将成为继PC之后的第二次计算革命,改变人类工作方式

大多数人有个误区:认为人人都能利用AI,其实不是的。只有本身就很强很有创造力的人才能驾驭AI——很强的人再利用了AI之后会变得超级强。你要能问出一个好问题,AI才能给你更好的结果,今天没有能力和没有创造力的人,其实是无法真正驾驭AI的,根本就“启发”不了AI,也就无法完成人机协作。AI时代人类的贫富分化会超过现在100倍,因为很多人公司就十来个人,但是却拥有几百万个24小时提供服务的AI数字员工。
机器人系列|③帕西尼CEO许晋诚:机器人只要能帮人干活就行,不一定要追求AGI

通篇大实话,实在人,很值得读的一篇报道。

✋🏻Key points
做人形机器人是为了展示触觉传感器的能力;
数据采集已有两种模式,我们在创造第三种;
半年造出人形机器人不是问题,传统机器人厂商随时可能加入;
纯AI太贵了,控制论在机器人领域仍然有市场;
机器人只要能帮人干活就行,不一定要追求AGI。
我去,这两天开源生态过年了?

Lightricks 开源实时视频生成模型 LTX-Video。

视频生成速度比观看速度啊还快!!!

- 只需 4 秒就能生成 5 秒的 24 FPS 视频
- 具有高度可扩展性,能够生成质量一致的长视频
- 2B 参数DiT 的视频生成模型

ComfyUI已经支持,可以冲了朋友们

模型下载:https://huggingface.co/Lightricks/LTX-Video/blob/main/ltx-video-2b-v0.9.safetensors
工作流:https://blog.comfy.org/ltxv-day-1-comfyui/
很好的点子,菜单可视化应用。

拍摄菜单之后应用会生成菜单上每道菜的精美图片。

国内很多小店应该也需要这种应用。
妙刷这个太可爱了!感觉可以把所有人生照片都变成一个玩具~!
顺利结束了东京的展览!感谢CCS邀请,能和这么多大佬同台展览&分享,这次真的解锁了超多新体验:

设计了一场海外展览和峰会的主视觉,特别特别感谢忠忠的远程全力支持,还有屹州全日文无障碍沟通!

在东京的画廊@SOMSOCGallery 展出了我和@海辛Hyacinth 的作品&工作流;

在原宿的超大屏上播放了我们的作品;

甚至在开放麦上做了人生第一次的全英演讲(中间卡壳还好有海佬救场)

期待下一站,CCS牛逼,开源牛逼!

#ccs 东京站
Back to Top