关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
AIGC 领域的最新工具、开源项目以及行业大事件
AI 可以生成一万个方案,但选择哪个,需要判断。
AI 可以模仿任何风格,但什么是美,需要品味。
AI 可以完美执行,但为什么要做这件事,需要人性。
当技术越暴力,越高效,越无所不能时,那些最「软」的东西反而变得最硬核。
AI 可以模仿任何风格,但什么是美,需要品味。
AI 可以完美执行,但为什么要做这件事,需要人性。
当技术越暴力,越高效,越无所不能时,那些最「软」的东西反而变得最硬核。
找到了一个coze搭建超级高效的办法
晚上深入研究了下coze的搭建,之前因为效率和实用的问题,搁置了很久。
最近因为找AI产品实习,还是得用coze搭建demo。
今天研究出来个高效的方法。用claude4.0,直接告诉他你要搭建什么coze工具,他会帮你生成一套完整的方案。
而且还可以讲解coze工作流搭建的基本思路和各种功能的使用。比网上90%以上的文章写的都好。
晚上深入研究了下coze的搭建,之前因为效率和实用的问题,搁置了很久。
最近因为找AI产品实习,还是得用coze搭建demo。
今天研究出来个高效的方法。用claude4.0,直接告诉他你要搭建什么coze工具,他会帮你生成一套完整的方案。
而且还可以讲解coze工作流搭建的基本思路和各种功能的使用。比网上90%以上的文章写的都好。
今天脑子里突然闪过 @hidecloud 的分享
“Less control, More intelligent”
趁着 DS 更新了 0528 版本,把 flomo AI 洞察的提示词改到极短,效果意外的好,多样性和细节都比之前超长的要精彩。
接下来就是上线 AB 测试看看用户选哪个了👀
“Less control, More intelligent”
趁着 DS 更新了 0528 版本,把 flomo AI 洞察的提示词改到极短,效果意外的好,多样性和细节都比之前超长的要精彩。
接下来就是上线 AB 测试看看用户选哪个了👀
以下是卧安机器人的详细资料:
• 基本信息:
◦ 公司全称卧安机器人(深圳)股份有限公司,品牌名为 SwitchBot,2015 年由李志晨、潘阳共同成立,总部位于广东深圳宝安区。
◦ 2025 年 6 月 8 日向港交所递交招股书,拟在香港主板挂牌上市,国泰君安国际、华泰国际为联席保荐人。
• 业务范围与定位:全球领先的 AI 具身家庭机器人系统提供商,致力于构建以智能家庭机器人为核心的智能家庭生态系统,产品覆盖智能操控、家务劳动、智慧管家、养老护理、安全防护及能源管理等家庭生活场景。
• 核心技术:拥有机器人定位与环境构建技术、AI 机器视觉控制技术、分布式神经控制网络技术三大核心技术。
• 产品情况:开创多个全球首款产品,如 2017 年推出全球首款手指机器人 SwitchBot Bot,2020 年推出全球首款窗帘机器人 SwitchBot Curtain,2022 年推出全球首款指纹门锁机器人 SwitchBot Lock,2023 年推出全球首款商业化增强型移动机器人 SwitchBot S10 等。产品组合涵盖 SwitchBot 品牌下涉及 42 个 SPU 的七种品类。
• 市场表现:按 2024 年零售额计,是全球最大的 AI 具身家庭机器人系统提供商,市场份额 11.9%,产品销往全球逾 90 个国家及地区,在世界各地逾 2000 间线下零售店可供购买。
• 用户数据:截至 2025 年 6 月 3 日,SwitchBot App 注册用户逾 310 万名,超 910 万台设备连接,约 55.2%的注册用户已连接两款或以上产品。
• 研发实力:截至 2025 年 6 月 3 日,全球拥有 269 项专利,包括 43 项发明专利。研发团队 219 人,占员工总数(除装配线工人外)的 50.7%,2022 - 2024 年研发开支约占各年总收入的 20%。
• 财务状况:2022 年 - 2024 年,营业收入分别为 2.75 亿、4.57 亿和 6.10 亿元,净亏损分别为 8698.3 万、1637.6 万和 307.4 万元。
• 股东与融资:控股股东集团为李先生、潘先生及万德创新雇员持股平台,持有约 44.53%股份。IPO 前进行过十四次主要融资,投资方包括松山湖机器人研究院、高瓴资本、源码资本、达晨等。
• 基本信息:
◦ 公司全称卧安机器人(深圳)股份有限公司,品牌名为 SwitchBot,2015 年由李志晨、潘阳共同成立,总部位于广东深圳宝安区。
◦ 2025 年 6 月 8 日向港交所递交招股书,拟在香港主板挂牌上市,国泰君安国际、华泰国际为联席保荐人。
• 业务范围与定位:全球领先的 AI 具身家庭机器人系统提供商,致力于构建以智能家庭机器人为核心的智能家庭生态系统,产品覆盖智能操控、家务劳动、智慧管家、养老护理、安全防护及能源管理等家庭生活场景。
• 核心技术:拥有机器人定位与环境构建技术、AI 机器视觉控制技术、分布式神经控制网络技术三大核心技术。
• 产品情况:开创多个全球首款产品,如 2017 年推出全球首款手指机器人 SwitchBot Bot,2020 年推出全球首款窗帘机器人 SwitchBot Curtain,2022 年推出全球首款指纹门锁机器人 SwitchBot Lock,2023 年推出全球首款商业化增强型移动机器人 SwitchBot S10 等。产品组合涵盖 SwitchBot 品牌下涉及 42 个 SPU 的七种品类。
• 市场表现:按 2024 年零售额计,是全球最大的 AI 具身家庭机器人系统提供商,市场份额 11.9%,产品销往全球逾 90 个国家及地区,在世界各地逾 2000 间线下零售店可供购买。
• 用户数据:截至 2025 年 6 月 3 日,SwitchBot App 注册用户逾 310 万名,超 910 万台设备连接,约 55.2%的注册用户已连接两款或以上产品。
• 研发实力:截至 2025 年 6 月 3 日,全球拥有 269 项专利,包括 43 项发明专利。研发团队 219 人,占员工总数(除装配线工人外)的 50.7%,2022 - 2024 年研发开支约占各年总收入的 20%。
• 财务状况:2022 年 - 2024 年,营业收入分别为 2.75 亿、4.57 亿和 6.10 亿元,净亏损分别为 8698.3 万、1637.6 万和 307.4 万元。
• 股东与融资:控股股东集团为李先生、潘先生及万德创新雇员持股平台,持有约 44.53%股份。IPO 前进行过十四次主要融资,投资方包括松山湖机器人研究院、高瓴资本、源码资本、达晨等。
最后点击右上角的运行按钮,等待就行。
双图和三图 Kontext 工作流的使用
接下来我们就真正到 Kontext 最独特的功能了,他支持将多张图片的元素融合在一张图片中,比如将产品放在指定环境的图片里面,让模特穿上指定的服饰等。
而且 Kontext 不止支持双图的融合还支持三图进行融合非常强大。
我们还是先将双图工作流拖放到 Liblib 的 Comfyui 界面中。
跟单图的时候区别不大,只是这次需要我们上传两张图片。
之后会自动拼合为一张传给模型,然后输入提示词选择生成图片的比例就行。
这里我们输入的提示词就是“将化妆品瓶子放在周围有橘子和花的白色石块上,保留海报文字”。
一般在多图融合的时候 Kontext 会尽量还原产品的细节,但是环境图片的细节会跟原图有出入。
她会优先保证自然度,比如上面这里石头的位置和画面角度都不适合将瓶子放在小石头上,它机会自己提取石头元素和橘子元素重新布局画面。
接下来三图也是一样的操作,我们现在可以混合更加复杂的场景,比如让模特拿着指定的化妆品站在指定的场景中。
你还是只需要设置你的三张图片、提示词和生成图像的比例,其他不需要管。
最后其实 Kontext 生成的图片分辨率不太高,所以可能很多时候大家有放大图片的需求。
索性在 liblib 的 Comfyui 有很多其他的基建,所以藏师傅就找了一个图像放大流程然后整合到了里面。
而且我还加上了一个我训练的 FLUX Lora,可以非常好的去掉 FLUX 的有你感觉,可以看到人物的肤质、服装材质和画面颜色都好了很多。
双图和三图 Kontext 工作流的使用
接下来我们就真正到 Kontext 最独特的功能了,他支持将多张图片的元素融合在一张图片中,比如将产品放在指定环境的图片里面,让模特穿上指定的服饰等。
而且 Kontext 不止支持双图的融合还支持三图进行融合非常强大。
我们还是先将双图工作流拖放到 Liblib 的 Comfyui 界面中。
跟单图的时候区别不大,只是这次需要我们上传两张图片。
之后会自动拼合为一张传给模型,然后输入提示词选择生成图片的比例就行。
这里我们输入的提示词就是“将化妆品瓶子放在周围有橘子和花的白色石块上,保留海报文字”。
一般在多图融合的时候 Kontext 会尽量还原产品的细节,但是环境图片的细节会跟原图有出入。
她会优先保证自然度,比如上面这里石头的位置和画面角度都不适合将瓶子放在小石头上,它机会自己提取石头元素和橘子元素重新布局画面。
接下来三图也是一样的操作,我们现在可以混合更加复杂的场景,比如让模特拿着指定的化妆品站在指定的场景中。
你还是只需要设置你的三张图片、提示词和生成图像的比例,其他不需要管。
最后其实 Kontext 生成的图片分辨率不太高,所以可能很多时候大家有放大图片的需求。
索性在 liblib 的 Comfyui 有很多其他的基建,所以藏师傅就找了一个图像放大流程然后整合到了里面。
而且我还加上了一个我训练的 FLUX Lora,可以非常好的去掉 FLUX 的有你感觉,可以看到人物的肤质、服装材质和画面颜色都好了很多。
然后我换了个思路,用 AI 生成 HTML 代码,再通过插件转成 Figma 设计稿,这样后期编辑就方便多了,效果也更好!分享下我的具体操作:我用的是 Claude 3.7,把想复刻的 PPT 图片(比如粉色风格的页面)丢给它,让它根据内容和配色,生成一个同款色系但布局和风格不同的设计,最后在 Figma 稍作调整比例就完成了,效果还挺惊喜的!
前两张 PPT 是一比一复刻的,最后一张我没完全照搬,而是把我预设的结论发给 Gemini,让它找一些关于“年轻人对线下二次元演出更有追求”的数据案例。Gemini 会进行DeepSearch ,提供近期研究报告里的数据和结论。然后就是沿用之前的设计风格,做出了 PPT。
不过这个过程中有些文字和样式的溢出问题,后来我换了能力更强的 Claude 4 来做页面设计,基本一次就搞定。不得不说,Claude 4 在代码理解和设计上的能力确实更胜一筹!
以上就是我用 AI 做 PPT 的一些小探索,涉及到的工具有 Claude 3.7、Gemini 和 Claude 4,后期编辑用的是 Figma。希望对想尝试 AI 做 PPT 的朋友有点参考价值!