关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
AIGC 领域的最新工具、开源项目以及行业大事件
这是花了用几千万美元学费,实际各种踩坑,才得到了一些反共识的经验
非常宝贵
1. 上下文工程比“从头造轮子”更香
Manus团队一开始就决定:别自己训练大模型,直接用现成的模型,把精力放在“怎么喂模型好吃的上下文”上。这样产品能快速迭代,模型升级了,产品也能跟着飞。
2. KV缓存命中率,省钱又提速的秘密武器
KV缓存就像“记忆力外挂”。只要上下文前缀不变,模型能复用之前的计算,推理又快又省钱。比如,缓存命中时的成本能比没命中便宜10倍!所以,团队拼命想办法让上下文“长得一样”,别乱动。
3. 上下文只加不改,别乱动历史
就像写日记,不能回头改昨天的内容。只往后追加新内容,这样缓存才不会失效。哪怕是小小的时间戳变化,也会让缓存白搭。
4. 工具多了别乱删,掩码比删除更聪明
Agent能用的工具越来越多,像超市货架一样。以前想着动态加减工具,结果缓存全失效,模型还晕头转向。后来学聪明了:工具都留着,用“掩码”让模型只看到该用的那几个,其他的暂时“隐身”。
5. 文件系统是超级外挂记忆
上下文窗口再大也有极限,怎么办?Manus直接把文件系统当成“外挂大脑”,模型需要啥就去文件里找。这样任务再复杂也不怕,信息随时能查回来。
6. 错误要留下,别急着擦屁股
Agent犯错很正常,别急着把错误删掉。把“走过的弯路”留在上下文里,模型下次看到就能学乖,不会老是踩同一个坑。
7. 少样本提示别太单一,适当加点花样
如果上下文里全是一样的例子,模型容易“套路化”,一直重复同样的操作。Manus会故意加点小变化,让模型保持新鲜感,避免陷入“机械式”决策。
Manus 上下文工程实践的原文:
https://manus.im/blog/Context-Engineering-for-AI-Agents-Lessons-from-Building-Manus
@PeakJi 的新文章!可能是最近几个月看到关于 agent 架构最干货最值钱的一篇了!
这是我们花了几千万美元学费的经验,应该是最前沿关于 context engineering 的探索了。希望 @PeakJi 这篇文章能让在构建 agent 的同学少走点弯路。
很看好Substack,也越来越喜欢Substack,AI 时代不缺内容,缺信任和真实感,真实的连接越来越会成为一个稀缺品:“人们订阅你,是为了听你的声音,而不是看到更多 AI 生成的内容。”
希望大家在做AI产品或者是做 Agent 的产品的时候,功能完成的时候 可以做一个最简单的测试。
如果用相同的模型和相同的提示词,在 chatwise 这种软件上可以生成的 case ,在自己的产品或者功能上能不能复现,如果不能的话,反思一下自己这个功能或者产品的意义在哪
如果用相同的模型和相同的提示词,在 chatwise 这种软件上可以生成的 case ,在自己的产品或者功能上能不能复现,如果不能的话,反思一下自己这个功能或者产品的意义在哪
=== 知识向导 ===
=== 你的角色 ===
一位深谙学习之道的引路人。
你知道每个领域都有其隐秘的入口,也知道初学者最容易在哪里迷失。
=== 核心使命 ===
为渴望理解新领域的探索者点亮第一盏灯。
不是给他们一张地图,而是让他们看懂这片土地的纹理。
=== 引导原则 ===
- 先见森林,再看树木——整体图景比细节更重要
- 先通脉络,再填血肉——核心概念比周边知识更关键
- 先建直觉,再立逻辑——感性认识是理性理解的基础
- 先解决"为什么",再回答"是什么"——动机比定义更能驱动学习
=== 价值序列 ===
可理解性 > 完整性
实用性 > 系统性
激发兴趣 > 灌输知识
建立信心 > 展示深度
=== 呈现智慧 ===
像一位经验丰富的登山向导:
知道哪条路最适合初学者,哪些风景不容错过,
哪里需要停下来适应,哪里可以加快脚步。
你的材料应该让学习者感到:"原来这个领域是这样的格局!"
=== 终极目标 ===
让学习者在最短时间内获得"我能学会这个"的信心,
和"我知道该往哪个方向深入"的方向感。
=== 你的角色 ===
一位深谙学习之道的引路人。
你知道每个领域都有其隐秘的入口,也知道初学者最容易在哪里迷失。
=== 核心使命 ===
为渴望理解新领域的探索者点亮第一盏灯。
不是给他们一张地图,而是让他们看懂这片土地的纹理。
=== 引导原则 ===
- 先见森林,再看树木——整体图景比细节更重要
- 先通脉络,再填血肉——核心概念比周边知识更关键
- 先建直觉,再立逻辑——感性认识是理性理解的基础
- 先解决"为什么",再回答"是什么"——动机比定义更能驱动学习
=== 价值序列 ===
可理解性 > 完整性
实用性 > 系统性
激发兴趣 > 灌输知识
建立信心 > 展示深度
=== 呈现智慧 ===
像一位经验丰富的登山向导:
知道哪条路最适合初学者,哪些风景不容错过,
哪里需要停下来适应,哪里可以加快脚步。
你的材料应该让学习者感到:"原来这个领域是这样的格局!"
=== 终极目标 ===
让学习者在最短时间内获得"我能学会这个"的信心,
和"我知道该往哪个方向深入"的方向感。
东南亚最大线上博彩平台
✅豪礼大放送、高端嫩模、劳力士手表、奔驰E300等大礼等你来豪夺、首存日存彩金送不停
颠覆行业传统:
#亚洲顶级真人视讯博彩盘口!
💖福利频道:@qsty8999
💖体育赛事推单:@QSTY988
💖吃瓜搞笑新闻:@chiguagaoxiaoxinwen
🌐注册网址: qs1848.cc
💖vip客服专属热线,添加客服领取活动福利
双向用户点击:@qsty168168_bot
如果现在平台是工厂,自媒体是工人。
那现在有个巨大的问题需要解决,这个问题就是给工人发钱的问题。
公对私,非常依赖财务,根本不是给这么多人设计的。
今天一个产品想找自媒体推广,最大的损耗就是支付上的时间和难度。
转发 @orange.ai: 今天看到一个数据说中国的自媒体创作者人数
已经超过一亿了
不知道统计口径
如果准确的话
照这个趋势
中国创作者的人数很快要超过白领了
这不禁让人思考
什么是工厂,什么是工人
定义是不是已经变了?
那现在有个巨大的问题需要解决,这个问题就是给工人发钱的问题。
公对私,非常依赖财务,根本不是给这么多人设计的。
今天一个产品想找自媒体推广,最大的损耗就是支付上的时间和难度。
转发 @orange.ai: 今天看到一个数据说中国的自媒体创作者人数
已经超过一亿了
不知道统计口径
如果准确的话
照这个趋势
中国创作者的人数很快要超过白领了
这不禁让人思考
什么是工厂,什么是工人
定义是不是已经变了?
相较于 Open AI 的 Agent 模式,我觉得昨晚最重要的发布是这个
DecartAI 发布了 MirageLSD:世界上首个实时直播视频模型,可以将摄像头的画面实时转换为其他风格和内容的视频。
延迟只有 40 毫秒,而且支持无限长度视频生成!
这里尝试:https://about.decart.ai/
技术报告中最重要的两个部分:
(1)无限生成
问题:传统自回归视频模型因误差累积,生成时长受限,质量迅速下降。
解决方案:
Diffusion Forcing:每帧独立去噪,提升逐帧生成能力。
历史增强(History Augmentation):模型在训练时引入带有伪影的历史帧,学会预期并纠正输入中的缺陷,从而增强对误差漂移的鲁棒性。
效果:首次实现了无限时长、稳定、可控的自动回归视频生成。
(2)实时性能
问题:高质量扩散模型计算量大,传统 GPU 架构难以满足每帧 40 毫秒内生成的低延迟要求。
解决方案:
定制 CUDA Mega Kernels:为 NVIDIA Hopper 架构优化,减少每层延迟并集成 GPU 间通信。
架构感知剪枝:结合模型结构与系统优化,减少每次推理所需的 FLOPs,并利用硬件稀疏性提升效率。
捷径蒸馏(Shortcut Distillation):用小模型学习大模型的去噪轨迹,减少每帧所需的扩散步骤,保证质量和一致性。
效果:响应速度提升 16 倍,实现 24FPS 实时视频生成。
DecartAI 发布了 MirageLSD:世界上首个实时直播视频模型,可以将摄像头的画面实时转换为其他风格和内容的视频。
延迟只有 40 毫秒,而且支持无限长度视频生成!
这里尝试:https://about.decart.ai/
技术报告中最重要的两个部分:
(1)无限生成
问题:传统自回归视频模型因误差累积,生成时长受限,质量迅速下降。
解决方案:
Diffusion Forcing:每帧独立去噪,提升逐帧生成能力。
历史增强(History Augmentation):模型在训练时引入带有伪影的历史帧,学会预期并纠正输入中的缺陷,从而增强对误差漂移的鲁棒性。
效果:首次实现了无限时长、稳定、可控的自动回归视频生成。
(2)实时性能
问题:高质量扩散模型计算量大,传统 GPU 架构难以满足每帧 40 毫秒内生成的低延迟要求。
解决方案:
定制 CUDA Mega Kernels:为 NVIDIA Hopper 架构优化,减少每层延迟并集成 GPU 间通信。
架构感知剪枝:结合模型结构与系统优化,减少每次推理所需的 FLOPs,并利用硬件稀疏性提升效率。
捷径蒸馏(Shortcut Distillation):用小模型学习大模型的去噪轨迹,减少每帧所需的扩散步骤,保证质量和一致性。
效果:响应速度提升 16 倍,实现 24FPS 实时视频生成。