关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
试了一下lllyasviel的Web UI分支Forge,太强了。#ai画图##stablediffusion#
在我的电脑上测试的时候图片生成速度快了一倍左右,Web UI需要3.7秒的图Forge只需要1.9秒。

而且lllyasviel还在Forge预装了很多非常有用的功能,比如提高图像质量的FreeU以及可以帮助SD1.5直接生成大图的Kohya的HRFix。

如果你平时就是用Web UI画画图不装一些奇怪复杂插件的话,或者你的显卡比较差,都推荐替换为Forge。

安装方式直接从下面链接替换整合包就行,如果你需要用你WebUI的模型文件的话可以鼠标右键用记事本打开web ui根目录的webui-user.bat文件。

把第二张图位置加上这段内容就行,文件夹目录改成你需要的目录(注意斜杠):--ckpt-dir D:/sd/novelai-webui-aki-v2/models/Stable-diffusion --vae-dir D:/sd/novelai-webui-aki-v2/models/VAE --lora-dir D:/sd/novelai-webui-aki-v2/models/Lora --gfpgan-models-path D:/sd/novelai-webui-aki-v2/models/GFPGAN --esrgan-models-path D:/sd/novelai-webui-aki-v2/models/ESRGAN --controlnet-dir D:/sd/novelai-webui-aki-v2/models/ControlNet

这里安装:网页链接
试了猎豹前首席科学家闵可锐做的这个密塔AI搜索,相当可以啊,某些方面比Perplexity还要好。

尤其是研究能力开启以后直接生成的内容比一些媒体写的报告好多了,非常全面逻辑性也很强。

下面是同一个问题跟Perplexity的对比,Perplexity开启co-pilot之后会引导你问下一个问题,密塔搜索则是自己把所有可能性都展示给你并且还搭配了思维导图了大纲。

不过现在还有些不稳定,比如有把DALL-E叫做视频生成模型,内容过长后引用链接丢失等问题。

这里体验:https://metaso.cn/s/EPCntW
试了猎豹前首席科学家闵可锐做的这个密塔AI搜索,相当可以啊,某些方面比Perplexity还要好。#ai#

尤其是研究能力开启以后直接生成的内容比一些媒体写的报告好多了,非常全面逻辑性也很强。

下面是同一个问题跟Perplexity的对比,Perplexity开启co-pilot之后会引导你问下一个问题,密塔搜索则是自己把所有可能性都展示给你并且还搭配了思维导图了大纲。

不过现在还有些不稳定,比如有把DALL-E叫做视频生成模型,内容过长后引用链接丢失等问题。

这里体验:网页链接
飞书文档《Sora模型全面指南:技术解析与商业应用前景》

关于OpenAI新推出的生成式人工智能模型“Sora”的详细介绍和学习资源。Sora模型能够根据文本指令直接生成长达60秒的视频,包含细致的背景、多角度镜头和情感丰富的角色。这一技术被认为是实现通用人工智能(AGI)的重要里程碑。

文档内容概要如下:

1. 基本介绍
正式发布时间预测、央视报道、博主解读、模型效果对比以及Sora的六大优势。
Sora可能带来的影响。
2. 技术拆解
官方技术报告(中英文对照)、腾讯科技拆解文、阿里巴巴分析文、素人笔记。
3. 演示案例
视频案例合集、官方示例。
4. 赚钱方法
提供了多种利用Sora模型赚钱的方法,如搞流量、卖账号、卖课程、套壳、投资、提示词交易、剧本创作、视频制作、原业务优化、企业服务、Sora+电商、开发与Sora相关的网站或工具。
5. 名人观点
360董事长周鸿祎的观点。
6. 适用人群
互联网关注AI视频发展的人群。
7. 使用建议
提供了快捷键搜索功能,以便快速定位到精确内容。

文档强调了Sora模型的重要性,并提供了持续更新的资讯动态、研究报告、赚钱案例和实用场景等内容。这些资源对于希望了解和利用Sora模型的读者来说非常有价值。文档还提到了与Sora模型相关的其他学习内容,如AIGC学习手册、ChatGPT学习手册和大厂AI实战应用案例库。

https://wiki.pmhub.cc/184.html
担心自己春节休息两周跟不上AI领域的节奏?听不懂朋友们说的新名词?一篇内容搞定春节期间你落掉的所有AI领域内容。#ai#

AIGC周刊59期更新了看了一下一共一万八千字,相当管饱,我尽量把两周发生的事情都塞进去了。感兴趣可以看看:网页链接

主要内容有:

✦ OpenAI发布了视频生成模型Sora,可以生成1分钟长的高质量视频。Sora支持从图像和文本生成视频,并且可以扩展和编辑视频内容。

✦ 谷歌发布了语言模型Gemini 1.5 Pro和Ultra 1.0,支持长达100万字的上下文理解能力。同时推出了付费会员计划Gemini Advanced。

✦ Stability AI发布基于扩散模型的图片生成模型Stable Cascade,支持图像变化和生成。

✦ 汇总了Midjourney图片生成模型的一些新功能,如默认版本升级和区域编辑能力增强。

✦ 介绍了一些新的AI产品,如视频生成软件Deforum Studio,自动生成UI设计稿的工具Galileo AI,以及英伟达的本地语言模型软件Chat with RTX等。

✦ 收录了一些AI领域的文章,如人工智能如何改变广告业,使用AI进行3D渲染以及Stable Diffusion潜在空间的解释等。
Sora发布当天(2月16号),全网第一个直播讲Sora的,和合伙人西堂、Link羊羊、小石等人连麦,深夜交流Sora到凌晨4点多,经过上百次讲解和完善,输出了一篇保姆级Sora的干货,全部整理到这个小册中,目前持续更新中。 西堂,985硕士,大厂程序员,视频号快速涨粉项目教练,视频号赚了5位数。 小石:材料转码,23应届,AI绘画视频实战家,制作爆款视频,23年星球累计写作50w字 小册共有3个专栏:Sora背景与优势、Sora对各行业的影响、Sora视频提示词。 限时10元,每满千人涨价10元,订阅后从置顶帖进Sora学习交流群,群里随时更新Sora最前沿的讯息。

这两天给大家科普sora和输出
sora干货,没想到很多流言蜚语出现,“割韭菜”这个词多次出现。
服了服了,外面几千块,几万块割韭菜一大把你们不去管,我这白菜价的东西,你过来管我……

举头三尺有神明,人在做天在看,没有人可以一直牛逼的,只有真正坚持利他的人才能一直活下去,我问心无愧,我的小伙伴们也问心无愧!
算法和数据双垄断后,硅基对碳基的游戏,近乎一边倒。
Civitai一直在尝试各种方法增加收入,建立稳定的商业化路径。#ai画图#

新的尝试是给社区成员推荐适合使用SD的电脑硬件配置,然后他们会从对应的购物中收取佣金,目前只有AMD平台的。

如果你有硬件购买的需求也可以参考里面的配置:网页链接
关于Sora,觉得周鸿祎分享的观点讲的很好,尤其是第四点:

大语言模型最牛的是,它不是填空机,而是能完整地理解这个世界的知识。

这次很多人从技术上、从产品体验上分析 Sora,强调它能输出 60 秒视频,保持多镜头的一致性,模拟自然世界和物理规律,实际这些都比较表象,最重要的是 Sora 的技术思路完全不一样,因为这之前我们做视频做图用的都是 Diffusion,你可以把视频看成是多个真实图片的组合,它并没有真正掌握这个世界的知识。现在所有的文生图、文生视频都是在 2D 平面上对图形元素进行操作,并没有适用物理定律。

但 Sora 产生的视频里,它能像人一样理解坦克是有巨大冲击力的,坦克能撞毁汽车,而不会出现汽车撞毁坦克这样的情况。

所以我理解这次 OpenAl 利用它的大语言模型优势,把LLM 和 Diffusion 结合起来训练,让 Sora 实现了对现实世界的理解和对世界的模拟两层能力,

这样产生的视频才是真实的,才能跳出 2D 的范围模拟真实的物理世界。这都是大模型的功劳。
Open AI 摸着谷歌过河,剩下的人摸着 Open AI过河。
有想做AI聊天机器人的可以看看这个组件库,非常全面。#ai##设计#

基本上覆盖了AI可以输出的所有数据形式的展示组建样式。交互形式也挺合理的,基本可以直接拿来用了。也可以给不懂AI的设计师当参考。

设计稿地址:网页链接
ComfyUI官方已经支持了Stable Cascade的使用,试了一下没有感觉效果比SDXL好,可能得等微调了。#ai画图#

下面链接有官方的工作流下载,我的4070Ti一张1024图片的生成时间是7秒,还可以。

部分插件可能会导致Stable Cascade工作流报错,如果报错的话可以暂时把所有插件备份,然后删掉尝试。

使用方式:网页链接
Back to Top