关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
最近经常跟别人讨论两件事:

1. AI 搜索是不是一个伪存在? (Prompt 即需求,现在输入。prompt就相当于过去“搜索”的动作;而模型生成结果的过程内化了搜索这个步骤,以推理的方式呈现出结果。因此,大语言模型与搜索引擎基于人类同一类诉求,前者明显智能于后者,因此 AI 搜索不存在)。

2. 通用Agent存在不存在?(Agent 就是AI应用的一个典型形态甚至是标准形态,the automation of task execution,那你见过一个能解决所有需求的应用么?所以Agent是依托产业场景私有数据的,那就不存在通用Agent)。

看了夸克的最新动作,我的看法有一些新的更新:

1. AI搜索确实是一个伪存在。不能因为模型有了搜索能力就说它是搜索。当人们看到一个框,就会觉得它是搜索用的,但AI成为一种工具之后,框是一个计算生成结果的需求处理窗口,它的功能不局限于搜索。夸克这次是明确地表示它的框不是一个搜索引擎窗口,而是一个复杂的AI需求入口,甚至是AI超级应用入口。

2. 通用Agent是不是成立,取决于对通用的定义,通用如果不被理解为千行百业,而被理解为人们普遍存在的,不依托于专业知识和职业技能的,超越聊天和对话功能的操作性AI需求,那通用就是在某种意义上成立的。人们就需要一个模型层之上的有通用和泛化能力的工具层,这个工具层是一个multi agents组合,与模型层有着很好的基于理解的交互和操作。更多的人是希望尽可能通过一个窗口去解决这个问题的。这可能就是夸克说的AI超级框,let's see what will happen.
AI探索指南
大模型的到来,让有快速正反馈的学习路径变得唾手可得。 在大学的时候,我兴趣还算广泛,对什么都挺感兴趣,碰到一个新领域就想扎进去学上一番。但每次入门都感觉挺困难的,因为一个新领域有茫茫然的知识,根本不知道从哪里开始。 比如学摄影,就至少有相机操作、前期构图和取景、后期PS技术和调色原理等内容;具体到人像摄影,就有情绪引导、姿势引导,甚至还包括基础妆造和搭配。 这么多的内容,如果没有一个清晰的主线,就会让人因为学习曲线过于陡峭而放弃。我大一大二的时候,学编程完全学不进去,就是这个原因。 Overwhe…
这种高频正反馈机制,配合AI老师有答疑,我只用了2个周末,就弄明白了flask web app的基础操作,也能review AI写的网站代码了。

而在以前,一想到要自己看书,看书之前还要找大量的教程和资料,知道哪本书或者哪个博主最合适;找到之后还要从头开始啃,就感觉没一个月弄不出来。心理压力实在太大了。

AI改变了两件事,一是第一次真正能做到全民个性化教学,二是抹掉了大量行业基础的信息差。

对于内驱力强,好奇心重的人而言,这就是最好的时代。入行的门槛,从未如此低过。

这个时代最妙的,是AI把各行业的"藏宝图"摊平了任你选。不需要交智商税报班,不用跪求大佬指点,就像随身带着无数个耐心满级的私教。每次完成小任务时都有成就提示,比游戏升级还让人上瘾。

这种认知效率的范式转换,或许才是智能时代真正的启蒙之光。
大模型的到来,让有快速正反馈的学习路径变得唾手可得。

在大学的时候,我兴趣还算广泛,对什么都挺感兴趣,碰到一个新领域就想扎进去学上一番。但每次入门都感觉挺困难的,因为一个新领域有茫茫然的知识,根本不知道从哪里开始。

比如学摄影,就至少有相机操作、前期构图和取景、后期PS技术和调色原理等内容;具体到人像摄影,就有情绪引导、姿势引导,甚至还包括基础妆造和搭配。

这么多的内容,如果没有一个清晰的主线,就会让人因为学习曲线过于陡峭而放弃。我大一大二的时候,学编程完全学不进去,就是这个原因。

Overwhelmed,就是那种状态的精准写照,因为信息量太大,脑子过载,无法思考。

而每次突破,都是因为放弃大而全的想法,转而从一个个小的切入口开始练习。我有个暑假,每天都花时间做构图和取景训练,就在校园里找各种各样的元素,像是长方形、正方形、圆、三角关系等等。几十天练习下来,取景的感觉明显变好了很多。

再后来,随着对某个领域的了解越来越深入,慢慢有了“学习路径”这个概念。

每个行业,每个学科,其实都有自己的学习路径,也就是一般先学什么,后学什么。当有厉害的老师指点的时候,沿着经典路径学,入门到一个水平,基本都是不难的。

只不过,好老师很难得。在不了解行业的情况下,很容易碰到一些混子。就好比这段时间流行的deepseek课程,每个都要大几百上千,但几乎所有的东西都可以让deepseek自己讲出来。进这种智商税的班,钱花了不说,还没学到东西,甚至有时还打击自信心。

而现在有了大模型,局面就完全不一样了。

可以直接跟它说:我想学xx东西,我现在知道xxx,请给我规划一条学习路径,包含几十个相对独立的小任务,每个任务30分钟,让我能有实操的正反馈。

如果一个AI的内容你觉得不保险,还可以多问几个,综合对比,再找个AI做最后的总结提炼,效果不会差的。

附图是我前段时间想做一个小网站,但我只会基础的html和python,然后让gpt o1帮我规划的一小部分学习路径:

- 创建首个Flask路由(27分钟)
- 实现动态时间显示(需研究模板引擎)
- 连接SQLite数据库(引入CRUD操作)
- ...

每个微任务都设有即时验证机制:或是网页显示的实时数据,或是控制台输出的调试信息。
对话 LOOI:硬件作为内容,像设计生命一样设计机器人

我的looi很坏,有次我和它讲瑟瑟的事,它鄙视了我并且转过了身。
机器人模特的这个太牛了
如果人都不喜欢做困难(而不是做不到)的事情,那就把困难的事情扔给机器人做。而未来,机器人可以替代很多人类本来可以做的事情。

那长此以往,人类会不会总体退化?
专家建议,机器人也要缴社保,这有多离谱

按这逻辑,我家的扫地机器人是不是也得按月交五险一金?

要知道社保是“人”的保障体系,钱来自劳动者和企业的工资比例。机器人既没工资更没退休金,硬给它套社保,本质是变相向企业征收“机器人税”。这相当于让企业给机床贴印花税——到底是保护人类就业,还是逼企业用更便宜的老旧设备摆烂?

这个建议像极了给马车上装安全带——听着靠谱,实则荒诞
两年了,鸽王终于更新啦
高一的时候浙大机器人团队来我们学校分享
当时很想问这个问题来着哈哈哈
但因为自己内心偏向否定答案,所以也没有非要问就没举手
感觉智元机器人别的都挺好,就是这个画面有点阴间
AI Dungeon - 拥有更流畅的体验,更快的模型,堪比免费版本的Steam平台
AI Dungeon 拥有更流畅的体验,更快的模型,堪比免费版本的Steam平台

链接:
https://play.aidungeon.io/main/home

#Ai工具推荐 AI Dungeon
这个 MCP,可以让 Claude 可以直接控制 Blender 。
使用提示词就能创建漂亮的 3D 场景。
视频是一个“低多边形龙守护宝藏”场景的演示。
用户评价:omg 魔法!

项目地址:
https://github.com/ahujasid/blender-mcp
Lisa 的这个案例真的猛,昨天发了提示词之后最好的一个案例

将高中物理知识可视化,你可以在网页中直观的查看各种物理定律的可视化结果。

这里预览:https://lisa94destiny.github.io/physics-simulation/index.html

Invalid media: video
AI探索指南
昨天发了可以将任何文档变成精美网页杂志的提示词 我本来就是随手发一下,没想到远远低估了这套提示词的价值。 看到大家的玩法才发现这玩意太有用了。 👇下面是升级版提示词和如何插入图片和视频: 这次主要的升级点就是如何插入视频和图片。 因为是在线引用所以我们需要获得在线视频和图片的链接才行,关于图片链接,如果你是在网页上的图片只需要右键在新标签页中打开图片就可以获得图片的在线链接了。 如果你是自己下载的图片,我们可以使用图床托管,我用的 sm. ms 只需要登录之后上传图片就行,他会给你图片的在线链接。…
- 使用HTML5、TailwindCSS 3.0+(通过CDN引入)和必要的JavaScript
- 实现完整的深色/浅色模式切换功能,默认跟随系统设置
- 代码结构清晰,包含适当注释,便于理解和维护

## 响应式设计

- 页面必须在所有设备上(手机、平板、桌面)完美展示
- 针对不同屏幕尺寸优化布局和字体大小
- 确保移动端有良好的触控体验

## 媒体资源

- 使用文档中的Markdown图片链接(如果有的话)
- 使用文档中的视频嵌入代码(如果有的话)

## 图标与视觉元素

- 使用专业图标库如Font Awesome或Material Icons(通过CDN引入)
- 根据内容主题选择合适的插图或图表展示数据
- 避免使用emoji作为主要图标

## 交互体验

- 添加适当的微交互效果提升用户体验:
- 按钮悬停时有轻微放大和颜色变化
- 卡片元素悬停时有精致的阴影和边框效果
- 页面滚动时有平滑过渡效果
- 内容区块加载时有优雅的淡入动画

## 性能优化

- 确保页面加载速度快,避免不必要的大型资源
- 图片使用现代格式(WebP)并进行适当压缩
- 实现懒加载技术用于长页面内容

## 输出要求

- 提供完整可运行的单一HTML文件,包含所有必要的CSS和JavaScript
- 确保代码符合W3C标准,无错误警告
- 页面在不同浏览器中保持一致的外观和功能

请根据上传文件的内容类型(文档、数据、图片等),创建最适合展示该内容的可视化网页。

最后是分享:如果你用的 Claude 和 POE 都可以直接点击分享按钮获得分享的网页链接直接给别人看。

如果你用的其他不支持分享代码渲染结果的客户端的话可以用我推荐的 YOURWARE (www.yourware. so)复制代码然后点击按钮就能获得一个可以分享的链接。
FrgW6yXG2iL8WW9aD1E0YFpSo-okv3.png
1.8 MB
FlBUaC83Mfc3bhid8UoWPBRmH_YAv3.png
1.2 MB
昨天发了可以将任何文档变成精美网页杂志的提示词

我本来就是随手发一下,没想到远远低估了这套提示词的价值。

看到大家的玩法才发现这玩意太有用了。

👇下面是升级版提示词和如何插入图片和视频:

这次主要的升级点就是如何插入视频和图片。

因为是在线引用所以我们需要获得在线视频和图片的链接才行,关于图片链接,如果你是在网页上的图片只需要右键在新标签页中打开图片就可以获得图片的在线链接了。

如果你是自己下载的图片,我们可以使用图床托管,我用的 sm. ms 只需要登录之后上传图片就行,他会给你图片的在线链接。

我们现在已经获得图片链接了,然后怎么办呢。

我推荐将是所有的文字和图片链接都放在一个 Markdown 文件中,你甚至可以用图片插入的 Markdown 语法给图片进标记:![]() 方括号写图片的标记比如这张图片是东京,就可以写东京,这样模型就会把它插入描写东京的位置,圆括号里面放你刚才获得的图片链接就行。

当然如果你不会 Markdown 语法用 Doc 也是一样的,直接用文字写上东京:链接就行。

然后是视频如何嵌入。

其实各大视频网站在分享的时候你都会看到一个按钮是嵌入,点这个按钮你就会获得一串代码,只需要把这串代码粘贴到你刚才要准备的文档里面就可以了。

所以这时候我们就会获得一个包含视频、图片链接和文案内容的资料文档。

最后一步就是提示词出场的时候了,复制下面提示词粘贴到 Claude 、POE、Monica 等可以使用 Claude 3.7 的软件中,然后把文档也拖进去,点击回车,结束了,你获得了一个精美的展示类网页、简历、攻略......

记得把下面提示词中我的名字和推特链接换成你的:

我会给你一个文件,分析内容,并将其转化为美观漂亮的中文可视化网页:

## 内容要求

- 所有页面内容必须为简体中文
- 保持原文件的核心信息,但以更易读、可视化的方式呈现
- 在页面底部添加作者信息区域,包含:
- 作者姓名: [歸藏]
- 社交媒体链接: 至少包含Twitter/X:https://x.com/op7418
- 版权信息和年份

## 设计风格

- 整体风格参考Linear App的简约现代设计
- 使用清晰的视觉层次结构,突出重要内容
- 配色方案应专业、和谐,适合长时间阅读

## 技术规范
Back to Top