关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
一台人形机器人平均含有1公斤的稀土、2公斤的锂、3公斤的石墨、6.5公斤的铜。中国目前占据了全球稀土供应的88%,石墨的93%,锂精炼市场的75%。

估算到2050年全球机器人的产业对这些关键矿物的需求,战略矿产资源的需求会达到8000亿美元。

——Robin Xing
晚点独家丨2 年半,字节造出千台机器人,长期目标是具身智能

今天关于智能机器人/具身的另一个独家。(现在上场的选手是字节跳动[让我看看]
AI探索指南
Lovart 的国内版本星流 Agent 今天上线了! 除了一堆能力升级之外,中文支持也更加友好,还上线了一致性无敌的 FLUX Kontext 模型#ai创造营# 价格也是相当划算,首月五折,无需邀请:xingliu.art/ 分享一下我专门为设计 Agents 探索的提示词和使用介绍🧵 专门为这种批量设计 Agent 写的一些提示词: 国风 Q 版恐怖塔罗牌海报生成 国风戏曲 MBTI 海报生成 如何用星流 Agent 生成一整套品牌 VI 设计 如何使用星流 Agent 的 FLUX Kontext…
我就找了一些比较火的耄耋表情包上传之后看看能不能给他们高清化并且换一种表现形式,还得保留那个贱贱的感觉。
先上传几张耄耋(猫爹)表情包截图,然后输入提示词。
可以说非常传神了,尤其是那个“呆住”的表情,太像了 哈哈哈哈。

在生成 UI 设计需要的素材比如图标插画上也非常好用,这里分享一下我探索的提示词,把这个提示词和你产品的描述一起给到 星流 Agent 他就会帮你生成非常契合主题的类 Airbnb 3D 写实图标。
这里我把提示词和我写的星流 Agent 介绍给他,可以看到生成的图标常符合星流 Agent 的定位。

最后就是 Lovart 时期已经很强但现在更强的视频制作能力了。
现在的星流 Agent 支持直接生成视频的音效以及语音,并且自带唇形同步,原有的配乐能力还在。
这里我为了考察他的智能程度,直接把我总结的最近很火的第一人称伪纪实爆款视频的万能公式发给了他。
然后让他根据这个公式帮我生成一个这样的视频,里面没说提示词也没说主题。
然后他就开始规划每个分镜的内容,他自己发散了一个法老监工自己金字塔的脚本,而且加上了很多现在工作环境中存在的术语,最后生成了视频和语音的提示词。
Lovart 的国内版本星流 Agent 今天上线了!

除了一堆能力升级之外,中文支持也更加友好,还上线了一致性无敌的 FLUX Kontext 模型#ai创造营#

价格也是相当划算,首月五折,无需邀请:xingliu.art/

分享一下我专门为设计 Agents 探索的提示词和使用介绍🧵

专门为这种批量设计 Agent 写的一些提示词:

国风 Q 版恐怖塔罗牌海报生成
国风戏曲 MBTI 海报生成
如何用星流 Agent 生成一整套品牌 VI 设计
如何使用星流 Agent 的 FLUX Kontext 模型
批量生产耄耋表情包
批量根据产品介绍生成 UI 设计图标
一键生产爆款伪记录类型的视频

先来广受好评的 Q 版国风戏曲塔罗牌设计。

这个提示词除了考察模型对于画风一致性的表现,也可能考量模型对于世界知识的理解,他需要了解每张塔罗牌的意义,然后找到对应的戏曲场景,再将场景还原出来。

我还把他从塔罗牌变成了MBTI 卡片。

风格也变成了非常具有设计感的极简插画版本,整体色调更加明亮,而且排版更加一致。
每张海报下面还有对应的塔罗牌的一句话介绍。

我这里虚构了一个叫“酥月记”的月饼品牌,准备看看能不能通过跟星流 Agent 的沟通产出一套可用的 VI 物料和 logo 设计。

我先是给他简单的设计需求和品牌理念,要求他生产多个 logo 的设计稿,我进行挑选。

之后他给了一个半月的版本,这个寓意不太好,我就让调整成满月,然后搞定了,非常完美了合适的一个 logo。
现在我们需要一些 VI 物料的设计,所以我就跟他说设计一些物料延展。
他完全根据品牌的主营业务判断了需要的物料类型,还有月饼包装和包装纸的设计,这太强了,以前真得会渲染才能搞。

然后这次星流 Agent 也支持了FLUX Kontext 这个一致性最强的模型。
比如我前几天买了一个小米 AI 眼镜,给他拍了张展示图,但是由于我桌子太小以及打光的原因,我对他不太满意。
这时候我就直接把原图拖到星流的无限画布,然后输入提示词。
只能说不愧是一致性保持最好的模型,眼睛后面的字和细节都还在,甚至原来都看不太清的指示灯也在,但是整个画面结构和光线明显变好了。

然后是传统艺能表情包生成怎么能少的了呢,最近最火的表情包系列就是那个圆头猫咪耄耋了。
与其做那些不伦不类的打拳击的机器人,跑马拉松的机器人,不去开发这个会剪头的,真的很需要
有意思,一个(模仿人类的和模仿机器人的AI代理)驱动的人类和机器人的数字孪生开放世界模拟器🧐😂
《Virtual Community:为人类、机器人与社会打造的开放世界平台》
🧐Virtual Community 是一个结合真实地理数据与生成式AI技术、可用于人类与机器人交互和社会行为模拟的开源虚拟世界系统,旨在推进可扩展的具身智能研究。
➡️链接:https://virtual-community-ai.github.io/
重点

🌍 真实地理数据驱动的3D虚拟城市构建:该平台利用现实世界的地理信息(如纽约、伦敦、佛罗伦萨等城市)自动生成具规模的3D室外场景,具备城市结构的真实性与多样性。
🧠 AI驱动的“虚拟社区居民”生成系统:借助大语言模型(LLM),为社区中每个虚拟人设定个性、社会关系与行为模式,实现有社会互动背景的虚拟人群构建。
🏠 自动化室内场景与语义标注:系统根据地点注释生成室内结构,并自动对场景内物体与位置进行语义标注,为机器人导航与任务执行提供基础。
🚗 交通流模拟系统:平台集成了步行者流、车辆流和公共交通系统的动态模拟,适用于自动驾驶、智能交通、城市规划等研究场景。
🤖 机器人与人类的物理交互模拟:通过Genesis物理引擎实现机器人与人之间的高真实度互动,包括“机器人跟随人类”、“群体舞蹈”、“冲突与合作”等复杂社会行为。
📦 支持多类机器人模型的仿真:兼容多种真实世界机器人模型,如波士顿动力Spot、谷歌机器人、Husky等,进行真实接触建模和动作可视化。
🗳️ 模拟公共行为与社会事件:平台支持模拟政治集会、公共提案、人机合作等场景,为社会学、政治学、伦理学等领域提供虚拟实验平台。
📈 面向具身智能(Embodied AI)研究的开放平台:项目核心目的是为AI研究者提供一个可扩展、高保真的世界模拟环境,以开展多智能体互动、人机协作、社会学习等研究。
👨‍🔬 跨学科研究团队支持:项目由多个研究者共同发起,涉及人工智能、机器人、社会模拟等多个方向,致力于推进开放世界AI系统的研究与应用。

Invalid media: video
Dia 浏览器的侧边栏终于来了#ai创造营#

这周向早起体验用户推出,下周全量
Back to Top