关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
#AGI Playground 2025笔记 📝
🤖 星海图CEO分享【具身智能的未来展望】
1️⃣ 具身智能是不能有短板的游戏
2️⃣ 具身智能的瓶颈是在正确的本体上获取正确的数据
3️⃣ 具身基础模型应坚持端到端和真机数据为主
4️⃣ 具身智能应用生态繁荣的核心是开发者生态的繁荣
➡️ 具身智能的下半场:2026年将开启具身智能的应用元年
Meta 发布了和 Oakley 联名的新款 AI 智能眼镜

- 持续工作 8 小时、待机19小时
- 支持超高清(3K)画质录制
- 内置个人 AI 助手 Meta AI 对话和语音控制录像

限量版499美元,常规版本399美元

详细信息:meta.com/en-gb/blog/oakley-meta-ai-glasses-sports-wearables-hstn/
可灵的橘猫小剧场,即梦的像素打工人,Veo 3的切东西ASMR,三大视频模型各自都在创作端产生了短视频爆款模板。
胡思乱想:

1. 已经快2年了,模型能力发展飞快,各个维度天翻地覆,但是大家生活生产方式似乎变化并不大,一定有什么地方 不对。 从找到这个不对的原因入手,再看能不能改变世界。

2. 上上家公司我从建团队开始就是飞书native,我打心底里觉得飞书很好用。 两个问题 a 各位抚心自问,能做到飞书*10的体验? 不能 那为什么做。 b 飞书都那么好用了 为什么没有称霸世界? ( 为什么 国外很少all - in - one的产品做的大?)

3. manus出了chat模式 - 用户对chat心智是定的 提问和用agent分开

4. manus 出了playbook 大家反过来各种宣传for ppt for sheet 界面上可以选成品 - 用户愿意用点击让自己意图更明确 结果更有预期

5. @月光 跟我聊的时候说了一句话 我反复琢磨了很久,最终我觉得是对的。 用户点一下表达的东西很有可能是最经济的。 的确 从整个系统的角度来看,用户点一下消耗的token ,和 用户不点 模型各种判断意图巴拉巴拉消耗的token比肯定是更经济的。

上面几个点plaud都有自己的答案 也在努力把自己的观点交付给世界
Kimi 放出大招,人类最后的考试通过率 26.9%

Kimi 的强化学习agent研究终于落地了。
今天出了个能做深度研究的AI模型,叫Kimi-Researcher,现在开始小范围内测了。这模型是用端到端自主强化学习技术训练的,专门用来做深度研究。

它在HLE考试里的表现超过了Claude 4、Gemini 2.5 Pro这些模型。
每次让 AI 给我改稿子,都能收获极致的情绪价值……有时候真的会飘飘然。

“出色的”“鼓掌”“精准”“生动”“完成度极高”“近乎完美”“锦上添花”…… 向 AI 学习舔词造句。
「一人干掉整个市场部」| 对谈 Head AI 创始人 Kay

听了至少也有十几期十字路口的节目:
1、真正规模化赚钱的项目,koji可能觉得不够性感,没有storytelling,很少会去报道。
2、报道的都是瞎几把扯淡的玩意儿,红人营销如果这么好做,字节UG的变色龙+zebra+libra早就把你颠覆了。

一年后来看,这些自媒体报道的90%以上都会扑街,而且明显不尊重常识。
前几天我就说成熟的视频生成 Agent 应该马上就会出现

没想到是 MiniMax 先做,推出 Hailuo Video Agent

第一阶段是提供专业视频创意Agent模版,用户上传图片打几个字就能生完整高质量视频,然后是编辑和完全自动化

上午试用了一下,门槛真的超级低,质量非常高

下面是详细的介绍和案例👇

他们将会分阶段打造 Hailuo Video Agent。

第一个阶段是提供专业视频创意Agent模版,用户上传图片或者打几个字就能一键生成高质量视频
第二个阶段将会实现让用户在任意的进度自由的打断和编辑
第三个阶段就是端到端的完全自动化 Agent

试用了一下发现,打磨的非常好,选择你喜欢的模板,点“做同款”就行,门槛超级低。
模板覆盖了你能想到的所有AI 视频出圈玩法,不管是外国山海经还是人像动态写真还是产品广告视频,你能想到的品类这里都能找到。

你现在在社交媒体刷到的最多的应该是 AI 写真类的内容。

Hailuo 直接把这个玩法变成了视频,而且 ID 保持非常好,跟原图也有很顺滑的过渡。
我上传的图片会有个水漫上来的效果,然后变成在水下的礼服,之后会更换多套不同的礼服,面部相似度依然可以保持。

有了人物的动态写真怎么能没有宠物呢。

只需要上传你宠物的照片就行,不需要任何提示词。我整了一个狗狗麦当劳送货的视频,非常可爱,得益于 Hailuo 视频模型的强大示例,基本稳定生成。

然后再来个电商场景把。

你只需要上传你的产品照片, Hailuo Video Agent 就可以直接一键搞定,只需要简单描述一下产品的样子就行。

短视频平台火爆的 AI 视频另一个品类就行科普类视频。

我这里就让 Hailuo 做了一个抹茶的历史科普视频,这个科普视频有 80 秒,结果他除了音乐动画以外还有口播,选的声音也非常合适,终于摆脱短视频平台的劣质 AI 配音了。

最近流行的还有像素风格的视频,咱也可以一键生成了,只需要上传一张情侣照片,然后给 Agent 描述一下你们日常的几个场景就行,不需要详细只需要词语。

最后来个小牛马自嘲吧,这个 Workflow 非常复杂,涉及到了两个不同语音风格的对话,还有视频上的图片文字包装,其中还有字幕的变化。

从这么多模板来看 Hailuo 肯定是有一个 Agent 编辑工具的,不然不可能积累这么多,希望他们早日能把这个编辑工具的界面放出来,我都不敢想到时候能有多少流行玩法从这里出现。
我昨天看了 Karpathy 的分享之后发了个朋友圈,不可编辑和暂停修改的 Agent 不可进化,从 Minimax 发布的三个阶段来看他们是真的懂,希望尽快看到第二个阶段的 Hailuo Video Agent。

Invalid media: video
Wang、Chen、Siddharth、Pedraza⋯⋯这波AI包工头(数据标注公司)的创始人一水儿的第三世界姓氏啊。😅
Gemini 现在支持上传视频分析了

终于不用一直用 AI studio 了,这估计也是第一家直接能分析长视频的 AI

可以参考我前几天交的这个提示词和方法分析爆款视频提取创作逻辑
Back to Top