关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
杜雨对话奇波机器人创始人 | 父子齐上阵,做最快最酷的拳击机器人

·我国文化的实用主义倾向,能快速制造一批高水平工程师,但相应地束缚了想象力和创造力;而西方的教育充分保护天才的发展,却牺牲了普通人的技能学习。
AI探索指南
AI领域里面大家可能更多关注的是LLM相关的内容,但是AI画图的一些数据往往难以找到。 今天一个团队发布了一份关于AI画图领域的数据分析,里面的数据显示过去一年多时间AI生产的图片数量已经超过了150年间人类拍摄的所有照片数量,太离谱了。 详细的内容可以看这里:https://mp.weixin.qq.com/s/h-xNxw5flsleubiqQTmrTQ 下面是这个数据分析的主要内容: →自去年以来,使用文本转图像算法创建了超过 150 亿张图像。客观地说,从 1826 年拍摄第一张照片到 1975…
Stable Diffusion 是人工智能公司 Stability AI 背后的文本到图像模型,于 2022 年 8 月发布。Stability AI 首席执行官 Emad Mostaque 表示,Stable Diffusion 在所有渠道拥有超过 1000 万用户。如果我们推断一下《Midjourney》的数据和趋势,就会发现,通过官方的 Stable Diffusion 渠道,用户每天会生成 200 万张图片,而在发布一年多的时间里,这个数字已经达到了 6.9 亿张图像。
如果加上其他流行模型(例如 Runway,我们单独统计)和 Stability AI 的官方渠道,使用 Stable Diffusion 创建的图像数量将增加到 125.9 亿张,占所有使用文本转文字创建的 AI 图像的 80%。

Adobe Firefly Adobe

Adobe 推出了 Firefly,于 2023 年 3 月发布。上线 6 周内,用户创建了超过 1 亿资产。随着 Firefly 于 2023 年 5 月集成到 Adobe Photoshop,考虑到全球使用 Photoshop 的人数,图像数量呈指数级增长。 Adobe 在最新的新闻稿中分享了其 AI 图像统计数据:推出仅 3 个月,使用 Adobe Firefly 创建的图像数量就已达到 10 亿张。

使用 Stable Diffusion、Adobe Firefly、Midjourney 和 DALLE-2 总共生成了超过 150 亿张人工智能创建的图像。这比 Shutterstock 的整个照片、矢量图和插图库还要多,而且是 Instagram 上传的图片数量的三分之一。
AI领域里面大家可能更多关注的是LLM相关的内容,但是AI画图的一些数据往往难以找到。
今天一个团队发布了一份关于AI画图领域的数据分析,里面的数据显示过去一年多时间AI生产的图片数量已经超过了150年间人类拍摄的所有照片数量,太离谱了。

详细的内容可以看这里:https://mp.weixin.qq.com/s/h-xNxw5flsleubiqQTmrTQ

下面是这个数据分析的主要内容:

→自去年以来,使用文本转图像算法创建了超过 150 亿张图像。客观地说,从 1826 年拍摄第一张照片到 1975 年,摄影师花了 150 年的时间才达到 150 亿张大关。

→DALLE-2 推出以来,人们平均每天创建 3400 万张图像。

→增长最快的产品是 Adobe Firefly,自推出以来仅三个月内就创建了 10 亿张图像。

→Midjourney 拥有 1500 万用户,是公开统计的所有图像生成平台中最大的用户群。

→大约 80% 的图像(即 125.9 亿张)是使用基于开源 Stable Diffusion 的模型、服务、平台和应用程序创建的。

DALL-E 2

2022 年 4 月,OpenAI 发布了其图像生成模型 DALL-E 2。然后 OpenAI 报告称,用户每天使用 DALL-E 2 生成超过 200 万张图像。我们不确定 OpenAI 所说的这个数字意味着什么时间段,或者他们是否获取了生成的平均图像量。我们假设这是一个平均值,这意味着 15 个月内在单个平台上生成了大约 9.16 亿张图像。

Midjourney

Midjourney 于 2022 年 7 月上线。根据 Photutorial 的估计,Midjourney 的 Discord(该算法只能通过 Discord 获得)每秒接收约 20 至 40 个作业,拥有 1500 万注册用户和 150 万至 250 万活跃用户任何特定时间的成员。考虑到这一点,我们使用每秒 30 个作业作为平均创建图像数,每天创建多达 250 万个图像。因此,自 Midjourney 推出以来,已创建了 9.64 亿张图像。

Stable Diffusion
我感觉在new bing上用中文搜索,经常会出来知乎帖的总结,质量相对而言没有那么好。

包括用ChatGPT上的webpilot搜,如果单纯搜中文,答案都不是那么理想。

不过,想想简体中文互联网上都是些什么信息,想想用百度搜出来的前N条都是些什么广告,似乎也说得通了。

1、

所以,在不知道该领域最专业网站的情况下,我自己一般会让webpilot插件用英文帮我在google上搜。

担心自己看英语没那么快,我就让它用中文帮我总结;担心它胡说八道,我就请它把出处的链接也放上来,然后亲自点进去检查。

如果知道该领域最专业的网站是什么,我就直接让它去那个网站里去搜,比如某些产品肯定是先去官网上搜细节。

2、

以上这套流程,真的帮我解决了很多工作中的阻塞感。

当工作/探索进入到全新的领域、我不得不进行大量的搜索。

用中文在百度上搜,不如用中文在google上搜;用中文在google上搜,又不如用英文在google上搜。

但怎么快速地把想搜的内容翻译成英文,又如何快速地从一堆英文网页中找到想要的信息,对于英文没那么好的人来讲,其实也是挑战。

如今通过AI来翻译和总结,我只用一句中文提示词“请在google上用英文帮我搜xxx,然后用英文总结出来,最后把出处的链接也放上来”,就把刚刚的这一系列琐事给解决了。(如图)

3、

当然,之前也遇到过给的出处链接点进去查无此链接的情况,这个时候我在去google上搜对应链接的标题,一般也可以搜到。

此外,进入网页后也会有不完全能读懂的情况。

我一般第一步是用“沉浸式翻译”插件,把网页变成中英文对照,相对就能看懂很多了。因为有对照,翻译得不好的地方,我也可以比较快识别,典型的有把LLM翻译成法律硕士的。(更多翻译插件和软件的内容,强烈推荐@DemoChen 老师的这篇文章https://mp.weixin.qq.com/s/iL1KAZ4OQuuHUNMs5bvajQ)

定位到我问题相关的段落后,我会把该段落复制粘贴出来,然后带上网址一块儿,让webpilot插件给我翻译。这一版的翻译,就会信达雅很多了。

如果这一版翻译我还是看不懂,那就请ChatGPT-4用15岁学生能懂的方式给我解释。如果还是看不懂,继续让它以9岁学生能懂的方式解释。#AI工作流
这是我的github,在GPT发布之前,我完全没有任何编程的实战经验,但是现在我(和GPT)已经成为了一个全栈工程师。

在这之前我完全不敢想象我能够自己开发出一个生产级别的产品。过去,我有很多借口,比如英语不够好,技术怎么也比不上科班出身的,但是现在这些借口已经不管用了,GPT大大降低了编程的难度。

如果你有想要亲手创造产品的冲动,现在是一个非常好的时间。当然,你最好热爱编程,只有这样,当AI的编程能力进一步提升,以至于人们不再需要编程的时候,你才不会觉得你把时间浪费在了一个可能没有经济收益的事情上。

另外,有了GPT,并不表示可以免于学习,付出时间和精力学习仍然是必要的,只是学习的方法变了。当我说我是编程小白的时候,其实不是很准确,我至少受过100小时以上的编程教育,写过一些50行以下的代码,玩过一些和编程相关的游戏。所以,如果你想要从0到能开发出一个产品,几个月的学习时间是少不了的。
一个 AI 简历扫描仪,把你的简历上传之后,AI 会提供关于简历的一些建议,以及针对你的简历提出十个面试问题,我试了一下大部分问题比较通用,可能会有两三个问题跟专业相关。
最近在求职的朋友可以试一下,有些建议还行。
地址:https://pdf.ai/tools/resume-ai-scanner
值得听的7个AI播客节目:

01. 投 AI 最猛的人 | 对谈张津剑
https://www.xiaoyuzhoufm.com/episode/64c542a399e1e7669e56d4da

👤主持人:@曲凯
👤嘉宾:张津箭

📻节目简介:

本期嘉宾张津剑是目前年轻一代 VC 里最有代表性的合伙人,他的绿洲资本是过去几年里少数募资到数亿美元的新基金,也是这波 AI 投资中出手最积极的机构,超过十家的 AI 企业投资数量在市场中绝对是数一数二。此外,津剑也是我多年的好友,他在 42章经 发表的《投资中的信号与噪声》系列文章也是脍炙人口、广为流传。

在这期播客中,我和津剑聊了过去几年的投资市场、聊了最近的 AI 热潮以及对未来 AI 市场的看法、也讲了很多关于「生命力」的故事。

💬听友评论:

Vcer_leon :绿洲津剑应该算是同辈人85后投资圈代表人物,之前也读过他的佳作《投资中的信号与噪音》、《投资中的结构与节奏》,这期播客着实听了两遍,值得刷三遍!

还是有蛮多收获,先敬佩再是感触,尤其是对生命力的信仰,做投资十年以来我关注到有公开阐述关于生命力投资逻辑的,除了津剑,另外的就是公募基金明星基金经理杨锐文,很巧他也是从一级分析师开启投资生涯。

中医讲无形的生命力是人的“精、气、神”,放到创业者身上,可能就是眼里有光,而他口中创业者的生命力更具象化了——『好的时候克制收住了自己的心,难的时候能坚韧坚持,自我迭代突破进化,穿越时间和周期』。

以往做投后,财务和业务指标很重要,但也都是结果,有个很关注的一点就是创始人CEO的康健与成长,这个核心资产某种意义上在相当长时间他决定了公司的下限与上限。很幸运有机会去见证一些优秀的创业者,早中期或困难的时候可能我们能投点钱帮帮忙,越往后的时候也很感谢他们能带我们一起打开新世界。

投资本来逆着人性,且投且修行,生命力的提升也就是在一次次开开阖阖中进化突破,自此迈向更高能量状态。

《黄帝内经》里面有句话说得好,“与万物沉浮于成长之门”。

---

02. AI大爆发:OpenAI极早期历史,以及图像领域的GPT moment
https://www.xiaoyuzhoufm.com/episode/64486f68baaef727ec431ff3

👤主持人:@泓君Jane
👤嘉宾:Jim Fan,现英伟达AI科学家,EX-OpenAI and Google AI

📻节目简介:

对于创业公司而言,前十个人最为重要,它会塑造一家公司的基因与文化。我们也想知道,除了信念,到底有没有一些实验上的数据反馈与方法,让OpenAI早期愿意坚定去堆算力。这期节目很幸运,我们找到了OpenAI的第一个实习生,他见证了OpenAI极早期的时刻。

这期音频聊了聊OpenAI极早期的一小段历史,我们的同名视频节目《硅谷101》,也做了一个45分钟的视频,以讲故事的方法去梳理盘点OpenAI的整个成长历程,欢迎对后面的故事感兴趣的同学去关注。

💬听友评论:

Roi 炑星迹:看了 B 站的视频《openAI 成长史》,特别清晰,整个 openAI 的成转起和都讲解的很完整很清晰,感谢制作,特别推荐。🙏

另外,也推荐几个视频:

· TED I Greg Brockman I The Inside Story of ChatGPT’s Astonishing Potential
https://www.ted.com/talks/greg_brockman_the_inside_story_of_chatgpt_s_astonishing_potential

· Lex Fridman Podcast I OpenAI CEO on GPT-4, ChatGPT, and the Future of AI
https://www.youtube.com/watch?v=L_Guz73e6fw

· NVIDIA GTC I 黄仁勋与 Ilya Sutskever 的炉边谈话:看 AI 的现状和未来
https://www.youtube.com/watch?v=ZszBzXyrchA

· CBS Mornings I Full interview: "Godfather of artificial intelligence" talks impact and potential of AI
https://www.youtube.com/watch?v=qpoRO378qRY

·还有 openAI 官网的发布会 以及微软的 Microsoft 365 Copilot 发布会

以上也可以作为一个视角的补充

---

03. 对话王小川:通用人工智能是一次文艺复兴
https://www.xiaoyuzhoufm.com/episode/6442527cfbc05629d3a0ac77

👤主持人:@杨轩
👤嘉宾:王小川

📻节目简介:

本期节目,「商业WHY酱」主播杨轩在王小川宣布创业后与他进行了一次对话。在这次对话中,王小川不吝分享了他对大模型的看法,对人工智能行业的观察,对创业方法论的研究,甚至对人类和人工智能关系的终极命题的思考。

💬听友评论:

马格里布求甚解:允许我悲观一点。现代教育的普及,并没有如愿带来心智启蒙与独立思考,反而产生大量技术喵呜与狭隘的民族主义者。先贤著作既没转化为社会创新发展,或者提升文化品味,反而成为茶余饭后的庸俗趣谈。人们关注点是在科层化组织里如何的钻营,寻租特权。我记得现代性与大屠杀里讨论过知识普及与一些社会问题的关系。而gpt也并非技术基督降神,能真正解放你枯燥乏味的生活的只有你自身潜力的启发。

---

04. AI狂飙的时代,人还有价值吗?
https://www.xiaoyuzhoufm.com/episode/641d59168aca9099d7312077

👤主持人:王磬
👤嘉宾:木遥

📻节目简介:

比尔·盖茨称赞,当前这场由ChatGPT衍生开来的人工智能革命是他所见到的自1980年以来最具革命性的技术进步。具体来说,GPT的革命性到底体现在什么地方?当前关于人工智能的讨论有些怎样的误区?它可能会带来什么影响?有什么是它能做的、又有什么是它永远也做不到的?它会是我们的“奇点时刻”吗?人类需要为此忧心忡忡吗?

今天的节目里,我们请来了一位懂技术也懂哲学的老朋友,围绕着关于ChatGPT与人工智能的许多迷思,展开了讨论。

💬听友评论:

蒲艺馨:这期挺不错,之前关于ChatGBT都是纯科技内容,这期终于有不一样的视角了。主播不用担心问了“蠢问题”,你是代表广大不懂技术的人民群众问的,你的问题很棒。

---

05. 如何应对ChatGPT?二级市场闭门研讨会精选
https://www.xiaoyuzhoufm.com/episode/63f5f66e1324e63d1259b079

👤主持人:@硅谷徐老师
👤嘉宾:

闵可锐,秘塔科技CEO,连续创业者,前猎豹移动AI Lab负责人

孙煜征,Youtube/B站账号课代表立正,腾讯游戏数据科学副总监,曾就职BCG、Amazon、 Meta

孔蓉,天风全球前瞻产业研究院联席院长

李泽宇,天风海外分析师

📻节目简介:

本期节目内容来自硅谷徐老师所参加的一场投资闭门会议,会议讨论了以 ChatGPT 为代表的 AIGC 在不同细分领域内的潜在应用方向,AI 技术进化的本质逻辑,以及面对已经到来的人工智能时代,公司和个人可以如何做好准备。

💬听友评论:

天宇同学:非常认同徐老师观点,AI在没有形成自主意识之前(Strong AI,先不讨论是否可能),取代自己工作的并不是AI,而是拥抱AI、掌握AI这个工具的其他人——拥抱变化,不断更新技能是必要的,只不过,科技发展的指数级变化,和过去对比,确实对普通人的学习能力要求越来越高(对比几十年前的话)

---

06. AI技术爆发的背后:安全、伦理与责任
https://www.xiaoyuzhoufm.com/episode/645b3fae94d78eb3f79a09af

👤主持人:戴雨森 真格基金管理合伙人
👤嘉宾:符尧 青年AI研究员

📻节目简介:

这期播客录制于2023年4月,邀请了很活跃的青年AI学者符尧交流。

在本期播客里,你将听到我们讨论什么是 AI alignment?目前主流的研究和进展是什么?大语言模型的能力不断增强,AI 的能力边界在哪里?面对动态变化的价值观,怎么 align AI?针对AI safety的研究有什么大框架?AI 是否具有意识?大模型方面中美的差距在哪里?

💬听友评论:

我是凯撒:这期真的讲得非常好,把国内外AI技术发展的阶段,面临的问题,以及未来的可能性捋得非常清楚,启发性很大

---

07. 一个 AI 创业者的反思、观察和预测
https://www.xiaoyuzhoufm.com/episode/648ffa1886eb9d7e47b43fd0

👤嘉宾:季逸超 Peak Magi创始人、真格基金EIR

📻节目简介:

作为国内最早拥抱 AI 技术的投资机构之一,我们认为在一个技术刚诞生的前几年去预测未来的终局形态和大赢家是很困难的。因此在这一波AI技术革命的早期,我们坚持以创业者为中心,相信优秀的创业者终会找到方向。在 AI 信息大爆炸的当下,我们也希望让大家听到来自一线 AI 创业者的声音。

本期节目我们邀请到了 Magi 创始人、真格基金 EIR 季逸超 Peak 和大家分享他作为一名从 2012 年起就加入 AI 行业的创业者,对新一波AI浪潮的反思、观察和预测。

💬听友评论:
Midjourney 的局部重绘功能即将在这周或者下周发布,Niji 新发布了一个预告来演示这些功能,从演示来看效果非常强大。
局部重绘是一个 AI 画图非常重要的功能你可以只修改图片的部分内容,再配合已经发布的平移和放大能力 MJ 的可用性将更上一个台阶。

下面详细介绍一下MJ 的局部重绘功能和可以做的事情:

什么是局部重绘
局部重绘是选择一个区域并重新绘制这部分的一个功能,比如下面这张图他非常好,但是有三只手,我们可以选择多出来的那只手重新绘制,同时根据选择的区域不同生成的结果也会不同。

不仅可以修复错误
局部重绘不止可以用来修复问题,也可以添加额外的元素,比如给他更换动物伙伴以及添加背景。

修复多角色场景
下面这个案例里面使用制作的空教室作为背景,为教室添加了多个不同的角色。
或者你也可以把一个有很多人的教室变成一个空教室。

修复你的完美图片
你也可以用来不断调整你的图片直到他符合你想象中的样子。不需要再把有瑕疵的地方遮起来,也不会影响你的关键内容。

视觉控制的新泛式
生成式人工智能行业仍处于起步阶段。文本到图像功能是一个:它允许许多从未接触过图像编辑器的人将他们的想法变成美丽的图像。
随着该领域的成熟和用户在操作图像方面变得更加熟练,他们将希望更好地控制自己的画布。虽然文本是最容易使用的界面,无法实现更加精细的操作。
随着平移、缩放和局部重绘的引入,他们正在探索在更具有视觉感知的空间中操纵图像的方法。
他们还强调了功能最终实现的时候 UI 可能不是上面图片的样子。
#三项式 #绘本 分享Day 806
今天又翻出了吉竹伸介的绘本《做个机器人,假装是我》

最近AIGC很火,可以生成人像,可以模仿语言说话风格,那么“我”到底是谁呢?

大家都在聊的AI个人助理,这本几年前出版的绘本里就形象幽默地畅想过了:小朋友想“写作业、打扫卫生、整理房间......每天都要做这些不喜欢的事情,好烦啊!如果做一个机器人,让它假装是我,然后去做那些我不喜欢做的事情呢?但是替身可不能穿帮,它必须和我一模一样,那我是什么样呢?”

最近看了一些心理学和哲学的内容,再看这个绘本,别有一番乐趣和感悟。我 即 我。
Back to Top