关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
跑了一下千问昨晚开源的图像编辑模型跟 FLUX Kontext 对比。

先说结果:
开源图像编辑独一份的中文生成和编辑能力
图像是全图重绘,相较于 FLUX 容易丢失细节
中文文字修改提示词遵循不是很好
图像美学表现相对 FLUX 较差,AI 感重

总的来说,中文编辑是它的亮点。 但美学和细节需要提升。 这可能要等社区的 LoRA。
想体验的话,可以去 Qwen chat。 选择图像编辑功能。 上传图片,输入提示词就行,目前免费。#ai创造营##ai画图#
没明白为啥要卷“人形”机器人的概念。除了酷炫科幻感,我不知道人形的优势是啥。我作为双足站立的人形生物,觉得自己的局限性太大了。请教大家,能给我讲讲吗?
Qwen-Image-Edit 开源,改字的能力很强。

可以指定多个区域改为指定内容,Qwen-Image-Edit 修改后的文字会贴合原图的字体和排版。

在线试用:chat.qwen.ai/?inputFeature=image_edit
模型下载:huggingface.co/Qwen/Qwen-Image-Edit
魔搭下载:modelscope.cn/models/Qwen/Qwen-Image-Edit
技术报告:qwenlm.github.io/blog/qwen-image-edit/

期待社区基于 Qwen Image Edit 的 LoRA 训练!!
行业初期都这样吧🥲

Invalid media: video
千问开源了 Qwen-Image-Edit 图像编辑模型。#ai创造营#

基本上 FLUX Kontext 能做的他都能做,而且还能编辑和生成中文。

等 lora 训练工具上了的话估计又会有很多新玩法了。

详细介绍:qwenlm.github.io/blog/qwen-image-edit/
一大早和美国合伙伙伴call
太忙了
根本没有时间打游戏
刚需 Agent...
Qwen 团队发布了自己的改图模型:Qwen-Image-Edit

它最核心的功能有两个:
强大的图片内容编辑能力:它既能做“大改”,比如把一张照片变成宫崎骏风格、旋转图中物体视角,也能做“小改”,比如P掉一根头发、给背景换块招牌,同时保证图片其他地方完全不变。

精准的文字编辑能力:可以直接修改图片里的中英文文字,无论是增、删、改,都能尽量保持原有的字体和风格,甚至可以像修改文档一样,一步步修正书法作品里的错字。

简单来说,这是一个既能理解图片内容进行创意修改,又能进行精细局部调整,尤其擅长处理图片中文字的AI编辑工具。
https://mp.weixin.qq.com/s/zc-vR2rIYyc29bW3MO1v-w

从今天起,我会发起一个全新的内容工作室「语言即世界」。我们希望在人工智能时代,将最前沿、深邃而性感的大脑开源。尽我们之所能,探索AI科技内容的边界。

如今,旧的世界还在延续,新的世界还未成形。但我们相信,新世界会有新世界的冒险家、新的成功与失败、新的璀璨与悲观、新的人与故事。希望与你一起,从这里探索新世界。

同时,我们也需要更多人的力量。我们现阶段会优选10位在各个领域卓越的专业人士,作为我们项目的发起人(欢迎自荐)。他们将是新世界的观察家、探路者和领航员🌍🚀如果你觉得你是我们期待的人,请随时联络我!更多内容欢迎阅读《开篇辞》。

Jump into the new world-and explore with us!😉😉
大多数的 Agent 速度都太慢了
文库 GenFlow 2.0的这个 Agent 主打一个3分钟交付结果,一等一的「实在」、「好用」。
它不仅能3分钟内并行处理5-6个复杂任务,还做到了全程可控,你可以像监工一样,实时查看进度、随时暂停修改、补充参考资料,让AI完全按你的思路来。
它内置了100多个工具,能帮你做调研,也能把你上传的文章秒变精美PPT,还能为老师一站式生成备课思路+课件+动画+练习题。
无需邀请码,无需排队,打开百度文库web/app端就能体验。
Back to Top