关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
AIGC 领域的最新工具、开源项目以及行业大事件
专栏作者:小七姐, 13 年产品经理,微软 / ZelinAI 企业服务合作提示词工程师,AI 开源社区《 通往AGI之路 》共创作者。
小册共分四小专栏:提示词学习地图、提示词编写误区、ChatGPT 最佳实践、国产大模型提示词。
关键词:AI,提示词,副业
推荐理由:小七姐可以说是AI提示词领域的大V了,如果你想要在AI绘画领域有所作为,那么一定要订阅这个专栏
Runway 的首席产品经理 Joel 约了我国内时间早上 8:30 线上 chat. (什么魔鬼时间)
刚刚看了下他的 bio,发现他还做过 Figma 的程序、Botnik 的 data science、微软的产品管理、Lunry 的自由撰稿人、Chrome 的插件开发者、哈佛大学区块链教材的作者之一。
最主要的是,他还讲单口喜剧开放麦!有加入的单口喜剧俱乐部,还有每年一次的慈善演出,实在是太酷了。
我的摇摆舞和爵士钢琴事业不知道能不能也这样。海辛:工作时间服务AI公司,下班后是摇摆舞舞者,每周三晚上在爵士酒吧演出。
刚刚看了下他的 bio,发现他还做过 Figma 的程序、Botnik 的 data science、微软的产品管理、Lunry 的自由撰稿人、Chrome 的插件开发者、哈佛大学区块链教材的作者之一。
最主要的是,他还讲单口喜剧开放麦!有加入的单口喜剧俱乐部,还有每年一次的慈善演出,实在是太酷了。
我的摇摆舞和爵士钢琴事业不知道能不能也这样。海辛:工作时间服务AI公司,下班后是摇摆舞舞者,每周三晚上在爵士酒吧演出。
想起 Instagram 当年的一个洞察
重要的不是照片像素和摄影技巧
而是希望被别人看见的原始冲动
那么,当生成一个自己任意模样的图像
几乎没有成本时
或者当图像不能当做实际发生的证明时
这背后隐藏的原始动力是什么?
又或者,根本视角不在自身,而在他者?
就像未来我们终究会死,
但我们的数字分身却可以慰藉还在世的人
重要的不是照片像素和摄影技巧
而是希望被别人看见的原始冲动
那么,当生成一个自己任意模样的图像
几乎没有成本时
或者当图像不能当做实际发生的证明时
这背后隐藏的原始动力是什么?
又或者,根本视角不在自身,而在他者?
就像未来我们终究会死,
但我们的数字分身却可以慰藉还在世的人
Snap Video 一种基于transformer的视频生成模型架构,其训练速度比 U-Net 快 3.31 倍(推理速度约快 4.5 倍)。#ai视频#
这个架构可以高效训练一个包含数十亿参数的文本到视频模型。(arxiv 的 PDF 转 HTML 居然又好了)
项目地址:网页链接歸藏的AI工具箱的微博视频
这个架构可以高效训练一个包含数十亿参数的文本到视频模型。(arxiv 的 PDF 转 HTML 居然又好了)
项目地址:网页链接歸藏的AI工具箱的微博视频
Gamma:下一代的 PPT 制作方式。
文本转 PPT,这里用 ChatGPT 生成了一段关于 ChatGPT 介绍的大纲和详细内容的 Markdown,然后将这段内容交给 Gamma,看它能做出什么样的效果。
Gamma 的基本功能是完全免费的,
而使用 AI 功能则需要相应的积分(credits),注册赠送 400 credits。
或者直接开通 Pro 账户(16美元/每月)(还挺贵)。
用我的邀请链接注册也会双方各赠送 200 credits:https://gamma.app/signup?r=5gesmvu4uy95nkg
文本转 PPT,这里用 ChatGPT 生成了一段关于 ChatGPT 介绍的大纲和详细内容的 Markdown,然后将这段内容交给 Gamma,看它能做出什么样的效果。
Gamma 的基本功能是完全免费的,
而使用 AI 功能则需要相应的积分(credits),注册赠送 400 credits。
或者直接开通 Pro 账户(16美元/每月)(还挺贵)。
用我的邀请链接注册也会双方各赠送 200 credits:https://gamma.app/signup?r=5gesmvu4uy95nkg
10个月前,我决定把公司开在@飞书 上,开启这个“危险”的探索。 这是个开工前的复盘……欢迎点赞转发给个鼓励,更欢迎提点需求和建议。如果对AI视频和RPA感兴趣,一起做点事,咱们私聊🙃😊
-------完整内容-------
网站方面#ai画图##midjourney#
正在开发网站的新社交功能
v6版本
正在完成 v6 版本的相关工作
正在开发用户最期待的角色一致性特性,尚需测试和确定监管策略
提升视觉美感
可能改进角色身体的一致性
提高 v6 的运行速度
即将推出的描述功能(预计1至2周内发布)
计划加入颜色参考功能,类似于现有的风格和角色参考
v6的加速模式
v7版本
在 v6 完成后将重点开发 v7
将打造更加清晰高效的系统
考虑将视频功能推迟到 v7 版本
其他动态
对目前的 ControlNet 进展不太满意,尤其是其外观方面
将继续推进视频功能的开发
未来六个月,我们可能会开始与一些顶尖 AI 实验室进行合作或建立伙伴关系(届时我们会拥有 MJ API)。我们也可能会与一些大型语言模型进行合作。
中国正在研发一个类似于 MJ 的项目,预计不久后将亮相。
来源:网页链接
同时他还把前几天自己的视频教程转成了文字内容,觉得视频太浪费时间的可以看文本。
AK 设想的完整工作流:
一个有趣的大语言模型 (Large Language Model) 挑战是:将我的2小时13分钟的分词器视频转换成一本书的章节(或者博客文章)形式,专门讨论分词。具体步骤如下:
为视频添加字幕或解说文字。
将视频切割成若干带有配套图片和文字的段落。
利用大语言模型的提示工程技术,逐段进行翻译。
将结果输出为网页形式,其中包含指向原始视频各部分的链接。
从更广泛的角度来看,这样的工作流程可以应用于任何视频输入,自动生成各种教程的“配套指南”,使其格式更加便于阅读、浏览和搜索。这听起来是可行的,但也颇具挑战。
LLM Tokenization课程文字版本:网页链接