关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
AIGC 领域的最新工具、开源项目以及行业大事件
MAGIC-ME 字节发布了一个针对视频生成中人物身份保持的项目。#ai视频#
可以在视频生成中保持对应输入图像人物的身份特征,看起来还行,但是用名人演示不太好看出效果。
项目简介:
提出了一种简单却高效的主题身份可控视频生成框架,称之为视频定制扩散(Video Custom Diffusion,VCD)。通过定义一 ...
可以在视频生成中保持对应输入图像人物的身份特征,看起来还行,但是用名人演示不太好看出效果。
项目简介:
提出了一种简单却高效的主题身份可控视频生成框架,称之为视频定制扩散(Video Custom Diffusion,VCD)。通过定义一 ...
1.将把V6设为默认版本(目的是对服务器进行压力测试)
•如果你更喜欢使用V5.2,请输入 /settings 并选择“V5.2版本”
•V6目前还在alpha测试阶段,可能会在不预告的情况下进行更改(但预计不久将进入beta阶段)
2.Niji V6的平移、缩放及区域变更功能现已推出
3.对V6核心模型进行了更新,在细节表现、对比度和整体连贯性上都有所提升
影视飓风这个英特尔的商单搞了个利用 SD生成分镜的项目。但是原理的部分讲的完全是GAN模型的原理,用的却是SD 扩散模型。里面还有很多不专业的部分比如定制模型其实就是找了些Lora,神经网络不是模型而是算法等。
视频地址:网页链接
影视飓风这个英特尔的商单搞了个利用 SD生成分镜的项目。但是原理的部分讲的完全是GAN模型的原理,用的却是SD 扩散模型。里面还有很多不专业的部分比如定制模型其实就是找了些Lora,神经网络不是模型而是算法等。
视频地址:https://b23.tv/rQ5RNyR
看到 a16z 的 AI 赛道观察总结,认知进步,值得参考。
7点总结:
1. Agents 不再是一个包含AI陪伴的大主题,而只属于生产力工具。
2. 强调 voice-first,通过说话用户能分享更复杂的甚至未完成的想法。
3. 强调 in-flow,最好的应用节点在用户的原有工作流里。
4. AI 陪伴,会成为每个人日常生活的一部分,像游戏一样沉浸,像真实的关系一样会进化。
5. AI社交,AI陪伴是人与AI的交互,而AI社交是AI和人群在一个虚拟世界场里的交互。
6. AI创意,被划为单独的一类,并且细分了内容生成和内容编辑
7. 个人成长类,包括个人教育、生活健康、个人金融
「分类是个工具而不是现实」
不过这样分类确实能帮助理解。
更多信息可参考原文PPT
https://gamma.app/public/a16z-Consumer-Abundance-Agenda-ieotbnzbxj81biu?mode=doc
7点总结:
1. Agents 不再是一个包含AI陪伴的大主题,而只属于生产力工具。
2. 强调 voice-first,通过说话用户能分享更复杂的甚至未完成的想法。
3. 强调 in-flow,最好的应用节点在用户的原有工作流里。
4. AI 陪伴,会成为每个人日常生活的一部分,像游戏一样沉浸,像真实的关系一样会进化。
5. AI社交,AI陪伴是人与AI的交互,而AI社交是AI和人群在一个虚拟世界场里的交互。
6. AI创意,被划为单独的一类,并且细分了内容生成和内容编辑
7. 个人成长类,包括个人教育、生活健康、个人金融
「分类是个工具而不是现实」
不过这样分类确实能帮助理解。
更多信息可参考原文PPT
https://gamma.app/public/a16z-Consumer-Abundance-Agenda-ieotbnzbxj81biu?mode=doc
1)降低拒绝率:我们对很多包含人物的图片的处理标准进行了放宽。Gemini 将从这些图片中提取文本并进行推理分析。
这将特别有助于处理包含屏幕截图的图片,这是移动用户非常常用的功能!
我们仍然不允许例如拍摄自拍并将其与健身运动员的照片合成这样的操作。绝无捷径。
2)移动端:我们已经开始在 Android(首先通过 Assistant 功能选择)和 iOS(通过 Google 应用)上推出 Gemini 的日语和韩语版本。这是继昨天开始的全球英语版本发布之后的扩展,预计几天内完成。