关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
AIGC 领域的最新工具、开源项目以及行业大事件
manus 之类的 Agent 都在一个只能执行有限功能的沙箱里面 MuleRun 为 Agent 提供了一个完全持久而且可定制的运行环境,Agent 创建者可以自定义操作系统以及可以访问的软件,系统的硬件参数等等。
而且他们搞了一套 Computer Use 开发套件,加上上面说的运行环境,Agent 就可以操作任何软件不只是浏览器。
另外在Browser Use 的时候也加上做了一些优化提高成功率的同时大幅降低了成本。
跟他们要了一些邀请码,在周刊群抽奖了。
好像早鸟注册分享playback截图或者视频就可以抽奖,奖品Macbook,Go pro,PS5,5040ti都有
被荣耀应用的各种证书、密钥等概念折磨一周后,我决定写个教程来造福后人。
应该是全网写得最清晰的非技术人士能看懂,甚至能顺着我的思路用AI编程开发出来的鸿蒙教程了。
AI Gateway 通过统一 API 接入,支持数百种模型和多家服务商,自动处理鉴权、限流、故障切换、用量追踪和账单,无需开发者手动管理各家 API Key 或切换服务商。
没有额外加价,用户可自带 Key 和合同,享受零加价的模型调用。
访谈类的文章,根本就不适合阅读
用 FlowSpeech 处理还原成音频
舒服了
王登科:AI伴侣要“活”起来,独响「响梦环」今日上线 - ListenHub
https://listenhub.ai/episode/u/68a859266fbe2a2ec04a2c82
用 FlowSpeech 处理还原成音频
舒服了
王登科:AI伴侣要“活”起来,独响「响梦环」今日上线 - ListenHub
https://listenhub.ai/episode/u/68a859266fbe2a2ec04a2c82
AI Gateway 通过统一 API 接入,支持数百种模型和多家服务商,自动处理鉴权、限流、故障切换、用量追踪和账单,无需开发者手动管理各家 API Key 或切换服务商。
没有额外加价,用户可自带 Key 和合同,享受零加价的模型调用。
ListenHub从来没有花钱买过软文,用户自己写的体验文,最真实也最动人,比花钱买来的都要好。
《万字长文深度体验Listenhub:不愧是国产AI播客的顶流!以及最适合使用它的7类人推荐》
https://mp.weixin.qq.com/s/lIRswR20a3Cu4YPFF16NPQ
万字长文深度体验Listenhub:不愧是国产AI播客的顶流!以及最适合使用它的7类人推荐
《万字长文深度体验Listenhub:不愧是国产AI播客的顶流!以及最适合使用它的7类人推荐》
https://mp.weixin.qq.com/s/lIRswR20a3Cu4YPFF16NPQ
万字长文深度体验Listenhub:不愧是国产AI播客的顶流!以及最适合使用它的7类人推荐
前阵子有个离谱的短剧火爆全网,上线短短3个月,就狂吸了1亿5000万美元票房。
后来很多人去搜这部剧,发现根本就搜不到,大失所望
但是一位朋友真的把这部剧拍出来了
在此和大家一起欣赏
《特朗普爱上在白宫当保洁的我》
后来很多人去搜这部剧,发现根本就搜不到,大失所望
但是一位朋友真的把这部剧拍出来了
在此和大家一起欣赏
《特朗普爱上在白宫当保洁的我》
今天higgsfield的 draw-to-video非常惊艳,只需上传一张静态图,在上面绘制涂鸦、文字或箭头等元素,即可生成具有电影质感的视频画面,指哪儿打哪儿,一发布就直接爆了。
这个效果应该不是训练一个视频编辑模型,因为它可以基于minimax、veo3、seedance来生成的。
推测是把用户的涂鸦信息转为prompt,直接给视频模型生成,或者用该prompt生成尾帧,然后基于首尾帧来生成视频
其实Higgsfield不是首创了这种涂鸦交互,8月初Jaaz.app就支持在画布上,通过涂鸦、打字、箭头来指挥agent生图,原理就是把用户的涂鸦信息转为prompt,然后结合参考图生成对应的效果图。
更早的时候,3月在公司内 AI群里分享过GPT4O的涂鸦P图案例,是用户自发探索出来的能力。估计当时已经有创业公司在思考怎么把这种交互进行产品化,当时写了这篇文档《当大模型越来越像人,人和模型应该如何交互》https://ix5mo5od606.feishu.cn/wiki/S7rMwMCyxiwsO1kQszDcTZcFnFf?from=from_copylink
刚刚在Twitter看到AI创作者Brett的一段话,很有感触,在此分享:
The best AI artists aren’t just good at prompting—they’re good at directing.
They know how to generate, filter, combine, and remix until something original emerges.
最出色的 AI 艺术家,不只是会写提示词,更擅长于‘导演’。
他们懂得如何生成、筛选、融合与重组,直到独一无二的作品浮现。
Invalid media: video
这个效果应该不是训练一个视频编辑模型,因为它可以基于minimax、veo3、seedance来生成的。
推测是把用户的涂鸦信息转为prompt,直接给视频模型生成,或者用该prompt生成尾帧,然后基于首尾帧来生成视频
其实Higgsfield不是首创了这种涂鸦交互,8月初Jaaz.app就支持在画布上,通过涂鸦、打字、箭头来指挥agent生图,原理就是把用户的涂鸦信息转为prompt,然后结合参考图生成对应的效果图。
更早的时候,3月在公司内 AI群里分享过GPT4O的涂鸦P图案例,是用户自发探索出来的能力。估计当时已经有创业公司在思考怎么把这种交互进行产品化,当时写了这篇文档《当大模型越来越像人,人和模型应该如何交互》https://ix5mo5od606.feishu.cn/wiki/S7rMwMCyxiwsO1kQszDcTZcFnFf?from=from_copylink
刚刚在Twitter看到AI创作者Brett的一段话,很有感触,在此分享:
The best AI artists aren’t just good at prompting—they’re good at directing.
They know how to generate, filter, combine, and remix until something original emerges.
最出色的 AI 艺术家,不只是会写提示词,更擅长于‘导演’。
他们懂得如何生成、筛选、融合与重组,直到独一无二的作品浮现。
Invalid media: video