关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
Screenshot to Code 只需要一张截图,AI就能免费帮你快速把网页截图变成代码,非常神奇🐮

Github 霸榜第一,单日2500+ Star🌟

只需上传截图,就能轻松获得前端代码,包括HTML、Tailwind CSS 和 JavaScript,这极大地提高了开发效率和体验

该项目可借助 GPT-4 Vision 的能力,并利用 DALL-E 3 的图像生成能力,生成外观相似的图像

项目地址:https://github.com/abi/screenshot-to-code
哇哇哇,又刷到了两篇很有意思的论文,感觉用来做风格化会很酷!

【1】Sketch Video Synthesis:直接把视频主体转为简笔画!(见图1~3)
项目地址:sketchvideo.github.io

【2】livesketch:直接让简笔画动起来!(见图4~7)
项目地址:livesketch.github.io/?ref=aiartweekly

甚至觉得两者可以结合来用,希望能早日玩上!
投了Pika。

Nat Friedman和Daniel Gross给的不只是钱,还给了很多指导和巨大的算力支持,他俩的私人GPU集群有两千多块H100用来支持创业者。

Demi智商情商双高,擅长社交,有大量的friend check,说笼了半个硅谷确实不为过。

Pika团队的行动力给所有人留下了深刻的印象。

赛道很卷,目前无论哪家产品PMF都还不够,格局其实还没有确定,需要极速进化才能占住位置,新团队依然有充足的机会。

Pika 2.0不会很久。
狂喜,ChatGPT 可以一次性读完近300页英文书了,而且可以同时分析多本书,对比着读。

一、

今天试着用ChatGPT读了下挺火的《10x Is Easier Than 2x》,发现270 页全部读下来,也没太大问题。

好几个章节,我有简单对比过原文,没发现明显的出入。顺便吐槽一句,这本书的原文可读性真心不高~

对啦,因为直接用的 ChatGPT 网页版,我终于不太担心 token 的消耗。这是我第一次感觉到,20 美刀/月的订阅费,实在太赚了。

二、

刚好,我最近也看了美国互联网界的教父级人物Paul Graham 最新博客《Superlinear Returns》,感觉两者的核心观点有一定的异同和互补之处。

于是,我找到英文博客原文,把整个网页打印成 PDF,然后跟《10x Is Easier Than 2x》一同上传到 ChatGPT 上。没想到,效果真不错,比我自己挨个读完比较,还有洞察,比如:

1、异同:

《10x Is Easier Than 2x》侧重于目标设定和效率提升的策略,而《Superlinear Returns》则更多地探讨了性能回报的非线性增长和市场机制。

前者关注的是个体如何通过改变思维方式来提高成就,后者则关注的是宏观环境中的机遇和挑战。

2、互补:

这两本书在某种程度上是互补的。

《10x Is Easier Than 2x》提供了关于如何设定和实现高目标的实用策略,而《Superlinear Returns》则提供了一个更广泛的视角来理解这些目标在更大的市场和社会环境中如何运作。

两者结合起来,为读者提供了一个全面的框架,既包括个人发展策略,也包括对外部市场力量的理解。

三、

在直接读 PDF 方面,GPT-4 turbo (128k)准确度还是不错的,比Claude 2.1(200k)都强不少。PDF 里面没有的内容,他也不会瞎展开(如图二),这个就很不错。

以前总想着,能不能搞个 learning agent 去解决知识间联系的事儿。现在发现,似乎也可以不用那么麻烦,甚至都可以不咋花钱,直接把对应的知识都整理到 PDF 里,一次性喂进去就得了。

我还尝试过一些别的办法,比如复制《产品沉思录》里一段话进去对比(图三),或者干脆让 ChatGPT 去搜时下的新闻去做结合(图四),也都能给出一些还行的反馈来。
🚨 Magnific AI 的 Upscaler 太强了,可能是目前最强的图像放大器。除了单纯的像素放大之外,细节的修复增强也是他们做的最好。

🧪 经过我的实验发现:在二次元 / 摄影图像处理上的效果尤其明显。之前总觉得 Nijijourney 生成的例如新海诚风格的图像在局部细节上表现为「一团带着噪点和竖条纹理的浆糊」。现在结合 Magnific AI 之后,这感觉一下就上来了,而且放大的同时直接修复人物面部崩坏的效果也非常顶。

🔗 链接:https://magnific.ai/

📝 我说一下二次元图像的操作细节:

Optimized for 选择 Art & Illustrations。(摄影的话选择 Films & Photography 效果最好)

Prompt 不需要像 Midjourney 那样说得特别完整,保证主体的描述清晰即可。但是我一般都直接把 Midjourney Prompt 粘贴过来,比较省事。

Resemblance 这个参数不要向负数方向拉动,因为会严重偏离原图。所以一般保持不动或者向正数(右边)方向拉动,如果你发现二次元人物修复后的效果不太好,那就尝试把这个数值拉高一点。

HDR 的理想数值,无论是动漫、插画还是摄影,在 2~4 基本能保证一个不错的效果。

Creativity 同 HDR。

在相同的 Prompt 之下,Engine 选择 Auto 就好了,没有必要手动选择。有时候如果动漫图像过锐,我会选择 Illusio,实验发现得到的效果比较好。

Invalid media: video
用 pinokio https://pinokio.computer/ 来本地部署一些 AI 项目真的很方便,我愿称之为开源项目普及之光👍🏻 比如 ComfyUI、SD-WEBUI、SVD、Whisper、RVC、TokenFlow啊都可以很快在自己电脑上一键部署起来,很适合不太熟悉部署项目,但是又想体验最新技术的朋友。这周有设计同事想体验实时 LCM 涂鸦生成就是让她自己去用 pinokio 部署的。不过由于是部署在本地的,建议还是有 NVIDIA 显卡或者有 m 系列 mac 的用户使用。
我就打开一个招聘网站,机器人疯狂弹送消息给我🌚,这是真人回复信息,才怪呢🤦‍♂️
FhFOBCiJvzFkn2nVp-SeLYu_ZV_Sv3.jpg
327 KB
推荐2个免费文本转语音网站

https://www.ttson.cn/

https://acgn.ttson.cn/

提供超过160种声音选项 1000+二次元声音,无论是自媒体内容制作、有声书创作,还是日常教学和娱乐,都能满足您的多样化需求。为各种场景提供丰富的声音选择,包括适合自媒体、有声书、教育教学等多元化需求。热门标签里包含了当前自媒体常用的小美,小帅,财经使用的晓辰音色支持十几种国家语音3.媲美真人的配音效果:高质量的语音输出,带来接近真人的配音体验。
Back to Top