关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
图1是我在 2022.12.22 用 Midjourney 画的第一张图。一年过去了,图2是今天用完全相同的 prompt 的效果。图3-图6 是在 prompt 基础上增加了一些风格化的效果。

人间一年, AI 几年?
易用性有时候是值得损失部分准确性的

阅读 Ben Thompson 的文章 https://stratechery.com/2023/the-openai-keynote/,分析非常有意思,其中有一章节,论述为什么 OpenAI Dev Day 之后 ChatGPT 似乎淡化了 Plugin 的概念,而推出了新的产品交互形态,对比下前后两者的差别:
之前:用户如果需要使用某一插件(如PDF总结),必须搜索安装插件,并在对话前切换打开插件,然后对话;
之后:用户不再需要特意安装插件,直接点到侧边栏的 GPTs(为某一场景专门定制的GPT),对话即可;

这其中,虽然用户还是做了一次选择,但一开始插件就已经被集成到了 GPTs 中,这个整体操作和交互体验改变很大,它降低了用户的思考成本,只需要在合适的时候做一个简单的点击即可。

作者由此引出自己的观点:
1. 消费者关心事物的方式和你赋予他们的期望可能不同,他们优先考虑易用性,对于模块化解决方案的“接缝感”会表现出明显的不满(比如 ChatGPT 之前的 Plugin 使用方式就是一种模块化方案)。
2. 综合的解决方案最终能够获胜,因为没有什么是“足够好的”,综合的解决方案也许会有缺陷(比如 ChatGPT 有时欠缺准确性),但是,这种缺陷是可以接受的,易用性是值得损失部分准确性的。
3. 客户会说自己需要准确性和第三方工具,但是他们的行动会证明,方便和易用才是最重要的。

以上的观点启发很大,可见 OpenAI 正在从一家主要关注技术能力的公司,转变为同时关注产品能力和用户体验的公司。
一年前的今天,ChatGPT 上线发布。
Screenshot to Code 只需要一张截图,AI就能免费帮你快速把网页截图变成代码,非常神奇🐮

Github 霸榜第一,单日2500+ Star🌟

只需上传截图,就能轻松获得前端代码,包括HTML、Tailwind CSS 和 JavaScript,这极大地提高了开发效率和体验

该项目可借助 GPT-4 Vision 的能力,并利用 DALL-E 3 的图像生成能力,生成外观相似的图像

项目地址:https://github.com/abi/screenshot-to-code
哇哇哇,又刷到了两篇很有意思的论文,感觉用来做风格化会很酷!

【1】Sketch Video Synthesis:直接把视频主体转为简笔画!(见图1~3)
项目地址:sketchvideo.github.io

【2】livesketch:直接让简笔画动起来!(见图4~7)
项目地址:livesketch.github.io/?ref=aiartweekly

甚至觉得两者可以结合来用,希望能早日玩上!
投了Pika。

Nat Friedman和Daniel Gross给的不只是钱,还给了很多指导和巨大的算力支持,他俩的私人GPU集群有两千多块H100用来支持创业者。

Demi智商情商双高,擅长社交,有大量的friend check,说笼了半个硅谷确实不为过。

Pika团队的行动力给所有人留下了深刻的印象。

赛道很卷,目前无论哪家产品PMF都还不够,格局其实还没有确定,需要极速进化才能占住位置,新团队依然有充足的机会。

Pika 2.0不会很久。
狂喜,ChatGPT 可以一次性读完近300页英文书了,而且可以同时分析多本书,对比着读。

一、

今天试着用ChatGPT读了下挺火的《10x Is Easier Than 2x》,发现270 页全部读下来,也没太大问题。

好几个章节,我有简单对比过原文,没发现明显的出入。顺便吐槽一句,这本书的原文可读性真心不高~

对啦,因为直接用的 ChatGPT 网页版,我终于不太担心 token 的消耗。这是我第一次感觉到,20 美刀/月的订阅费,实在太赚了。

二、

刚好,我最近也看了美国互联网界的教父级人物Paul Graham 最新博客《Superlinear Returns》,感觉两者的核心观点有一定的异同和互补之处。

于是,我找到英文博客原文,把整个网页打印成 PDF,然后跟《10x Is Easier Than 2x》一同上传到 ChatGPT 上。没想到,效果真不错,比我自己挨个读完比较,还有洞察,比如:

1、异同:

《10x Is Easier Than 2x》侧重于目标设定和效率提升的策略,而《Superlinear Returns》则更多地探讨了性能回报的非线性增长和市场机制。

前者关注的是个体如何通过改变思维方式来提高成就,后者则关注的是宏观环境中的机遇和挑战。

2、互补:

这两本书在某种程度上是互补的。

《10x Is Easier Than 2x》提供了关于如何设定和实现高目标的实用策略,而《Superlinear Returns》则提供了一个更广泛的视角来理解这些目标在更大的市场和社会环境中如何运作。

两者结合起来,为读者提供了一个全面的框架,既包括个人发展策略,也包括对外部市场力量的理解。

三、

在直接读 PDF 方面,GPT-4 turbo (128k)准确度还是不错的,比Claude 2.1(200k)都强不少。PDF 里面没有的内容,他也不会瞎展开(如图二),这个就很不错。

以前总想着,能不能搞个 learning agent 去解决知识间联系的事儿。现在发现,似乎也可以不用那么麻烦,甚至都可以不咋花钱,直接把对应的知识都整理到 PDF 里,一次性喂进去就得了。

我还尝试过一些别的办法,比如复制《产品沉思录》里一段话进去对比(图三),或者干脆让 ChatGPT 去搜时下的新闻去做结合(图四),也都能给出一些还行的反馈来。
Back to Top