关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
用飞书的企业多,字节流出去的人才也不少,用飞书文档写东西分享倒是开始流行起来了,有了大量对外开放的学霸笔记,去年大火的ChatGPT、今年表现炸裂的Sora都有超强分析。

今天看到的这个AI的科普文档叫《通往 AGI 之路》,创建之后的10个月时间里有接近500万的阅读量,链接:https://waytoagi.feishu.cn/wiki/QPe5w5g7UisbEkkow8XcDmOpn8e

这只是一个学习文档啊…

你说一个免费的文档知识库能做成这样,更新是即时的,最关键的是一个文档还可以由几个大牛一起书写,譬如向阳乔木,宝玉xp,互联网的那点事,barret李靖等等知名互联网行业观察者,在共同缔造一个AGI知识库。这么一对比,那些搞付费割韭菜的开课的,就显得emmm

而且写得好的文档,有点像SCI论文(科学引文索引收录的论文,代表一种影响因子分数),是很容易获得行业前辈与同仁认可的,造成了写作者前仆后继的分享...

谁能想到,一个办公软件能成科普社区。
被英伟达、OpenAI、微软、木头姐和贝佐斯等人投资后,炙手可热的人形机器人公司Figure发布视频,公布产品最新进展!
视频中的Figure01已经能够在工厂内完成搬运、放置箱子等操作。
Media is too big
VIEW IN TELEGRAM
分享一个使用kimi的万能公式,无需记住任何提示词,只需要问kimi一个问题:
【一个(xxx职业)需要具备哪些知识?】
Kimi就可以给出知识框架,然后你根据知识框架每一个小点去问,就能让kimi帮你思考啦~
得出的信息比单个提示词要多很多

如下这个例子,kimi给出来12个能力,每个能力分10步的话,我能得到的信息是120条!
#AI工作流 #AI的神奇用法

示例:(括号可改成你的问题)
一个CEO应该具备哪些知识?
如果你是一个CEO,你使用(战略规划与管理来决策,)需要分为哪几步?
你是一个CEO,请以上面(10)步来帮我做决策:我需要(建立一个帮助金融投资者交流并且通过社群和知识付费赚钱的社群,)每一步都以表格的形式展现你的思考过程
好,接下来每一个步骤详细分析,第一步:(愿景和使命定义)
很棒,按照这个架构,第二步:(环境分析)
第三步:(战略制定)
第四步:(战略选择)
第五步:(战略实施)
第六步:(监控和评估)
第七步:(调整和优化)
第八步:(沟通和文化建设)
第九步:(风险管理)
第十步:(持续改进)
Pika 推出 Lip Sync。支持将生成视频中人物的嘴部动画和音频同步。#ai视频#歸藏的AI工具箱的微博视频
李一舟果不其然翻车,还是猥琐发育、闷声发财好。

推荐一个优质替代资源,我一直 pin 在公司内部飞书群组顶上。

可能是最好的中文 AI 免费知识库:http://WaytoAGI.com

顺带推荐今晚这个项目幕后操盘手的直播分享:

https://mp.weixin.qq.com/s/3DVgBCMzrqZUnkk8ASfi2Q
OpenDiT 一个专门用来加速类似Sora的DiT架构模型推理和训练的项目,GPU 加速高达 80%,内存减少 50%。#ai##sora#

主要特点有:

GPU 加速高达 80%,内存减少 50%,内核优化包括FlashAttention、Fused AdaLN、Fused Layernorm内核。

FastSeq:一种新颖的序列并行方法,专为激活大小较大但参数大小较小的类似 DiT 的工作负载而设计。

使用方便,通过一些生产线更改即可获得巨大的性能提升,用户不需要了解分布式训练的实现。

支持文本到图像和文本到视频生成的完整流程。

项目地址:网页链接
换回 Flomo 记录信息的同时发现Twitter 的信息不太好同步,就自己用 GPT-4 写了一个 Twitter to flomo 的浏览器插件。

发现现在上下文长度长了以后,写这种小项目的门槛更低了。总共用了不超过 4 个小时就搞完了。

👇下面有用 GPT-4 写这个项目的提示技巧、插件使用方法以及插件下载:

## 总结的一些技巧:

补充开发文档:

告诉 GPT 谷歌已经讲浏览器扩展的Manifest V2改为了Manifest V3,并且将对应的更改内容文档上传到 GPT,告诉他根据这个编写代码。

先实现核心能力:

建议刚开始只实现最核心的功能,对于我这个项目来说就是获取推特内容,然后传输到 flomo 。

提供必要信息:

比如 GPT 显然是不知道 Flomo 的 API 格式的,你需要把对应的文档发给他,我都是直接全选文档页面内容,然后保存成 MD 格式。

善用控制台 log 和报错信息:

刚开始如果报错可以复制报错信息让 GPT 分析并改进,如果改了几次没改好,就想办法用 log 获取更多信息,比如我这个核心功能主要有两部分,先是获取信息,然后是传输,我们需要确定是哪一步错了,就可以让他在对应阶段完成的时候在控制台打印输出的 log 信息。

及时上传代码:

发现 GPT-4 输出的代码无法与原有代码对应的时候,应该及时重新上传现在完整的代码,防止他忘的越来越多。

最重要的立刻去做:

其实没有那么难,不要想那么多我不会写提示词也没有开发经验怎么办,GPT 都会告诉你,开始问出第一个问题是最难的一步。

这是这个项目与 GPT 的完整对话记录:https://chat.openai.com/share/ef6d226e-1b38-40cf-b4fb-e6d92eb7c67e

## 如何使用

点击Github 页面右上角的 Code 按钮选择 Downlaod zip 按钮将插件文件下载到本地。

打开浏览器扩展页面,打开开发者模式,选择加载解压的扩展程序选择解压后的文件夹。

加载之后点开插件图标,点击 Setting 按钮,进入设置页面。

你可以在 Flomo 的扩展中心&API 页面找到你的专属 API,填写到Flomo URL输入框就行。

Content Prefix是你希望同步到 flomo 时内容的标签,主要填写时前面需要加#。
昨晚 Open AI 在 TT 上发布的 Sora 新视频,创建一些不存在的生物,第三个福瑞控和宝可梦爱好者肯定喜欢,太可爱了。#ai视频##sora#

提示词:创造一种从未存在过的逼真动物,自然纪实风格 歸藏的AI工具箱的微博视频
挺好玩的一个项目,根据你上传图片的风格帮你找到 Civitai 里面类似风格的 SD 模型。

找到的模型会展示模型生成的图片和得分,你可以直接前往Civitai下载模型。#ai画图#

体验一下:网页链接
微软这个研究相当强啊,可以不经过训练直接融合多个 Lora 不损失效果,而且他们提出的通过 GPT-4V 评价图像质量的方法也很有参考性。#ai画图#

项目介绍:

本项目旨在通过新的文本至图像生成方法,着重采用多重低秩适应(Low-Rank Adaptations, LoRAs)技术,创造高度个性化且细节丰富的图像。我们介绍了LoRA开关(LoRA Switch)与LoRA组合(LoRA Composite),这两种方式的目标是在精确度和图像质量上超越传统技术,特别是在处理复杂图像组合时。

项目特色:

🚀 免训练方法
LoRA开关和LoRA组合支持动态精确地整合多个LoRA,无需进行微调。
我们的方法不同于那些融合LoRA权重的做法,而是专注于解码过程,并保持所有LoRA权重不变。

📊 ComposLoRA测试平台
这是一个全新的综合性测试平台,包含480套组合和22个在六大类别中预训练好的LoRA。
ComposLoRA专为评估基于LoRA的可组合图像生成任务而设计,支持定量评估。

📝 基于GPT-4V的评估工具
我们提出采用GPT-4V作为评估工具,用以判定组合效果及图像质量。
该评估工具已证实在与人类评价的相关性上有更好的表现。

🏆 卓越性能
无论是自动化还是人类评价,我们的方法都显著优于现有的LoRA合并技术。
在生成复杂图像组合的场景中,我们的方法表现出更加突出的优势。

🕵️♂️ 详尽分析
我们对每种方法在不同场景下的优势进行了深入的分析。
同时,我们还探讨了采用GPT-4V作为评估工具可能存在的偏差。

项目地址:网页链接歸藏的AI工具箱的微博视频
Back to Top