关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
AIGC 领域的最新工具、开源项目以及行业大事件
真正自主的代理,它能够独立完成复杂的任务,而不仅仅是生成想法
演示看起来非常牛皮,希望能用一下
官网展示了各种具体的用例,点开会直接开始回放
这个演示方式值得学习
下面是Gemini总结的产品核心理念和具体用例介绍:
🌟核心理念:
自主执行力: Manus AI 不仅仅停留在生成想法的层面,它能够将指令转化为实际行动,交付最终结果。
类人工作模式: Manus AI 模拟人类的工作方式,例如,它可以解压缩文件、浏览网页、阅读文档,并从中提取重要信息。
云端异步工作: Manus AI 在云端异步运行,用户可以随时关闭电脑,任务会在后台持续执行,完成后会通知用户。
持续学习和记忆: Manus AI 拥有自己的知识和记忆,可以从用户的反馈中学习,并在处理类似任务时应用学到的知识,提高效率和准确性。
人机协作新范式: Manus AI 被视为人机协作的新范式,旨在扩展人类的能力,放大影响力,并将人类的愿景变为现实。
“心智与手” (Mens et Manus): 软件的名字“Manus”来源于拉丁语 “Mens et Manus”,意为“心智与手”,象征着知识必须被应用于世界,产生实际影响。
案例总结
视频中展示了 Manus AI 在三个完全不同的任务中的应用,突出了其通用性和强大的执行力:
1️⃣案例 1:简历筛选
任务描述: 筛选 15 份简历,为强化学习算法工程师职位推荐合适的候选人,并根据其强化学习专业知识对候选人进行排名。
Manus AI 的操作:
接收数据: 用户上传包含 10 份简历的 ZIP 文件,随后又补充上传 5 份简历。
自主处理: Manus AI 解压文件,逐页浏览并分析每份简历,提取关键信息。
智能分析: 根据岗位要求和候选人简历中的项目经验、强化学习专业知识等进行评估。
生成结果: Manus AI 生成排名建议,将候选人分为不同等级(例如:高级候选人、具有基本强化学习经验的候选人、无强化学习经验的候选人),并提供候选人资料和评估标准等支持材料。
灵活调整输出格式: 用户提出希望以电子表格形式呈现结果,Manus AI 立即学习并执行,安装必要的 Python 库 (pandas, openpyxl),编写 Python 脚本,并将结果整理成 Excel 电子表格。
这是我人生中第一次导一条产品发布片,也是我职业生涯以来最自豪,最具想象力,最圆满的一个作品。搞 AI 20 个月,交出这样的答卷我是真的尽力了,也非常满足。话不多说,大家自己去感受吧。 manus.im
这里我们可以要求 Claude 用 CDN 引用 TailwindCSS 来写组件样式,Tailwind CSS 封装了一套非常美观和简洁的样式,可以让 Claude 直接调用,确保在色彩、响应式和基础组件的美观度不出大问题。
🌟提示词:
方括号[]的部分就是你需要填写的部分。
我需要创建一个[具体描述你的页面/组件类型],请帮我生成美观且响应式的HTML+CSS代码。
## 设计参考
我希望设计风格类似于以下参考:
[上传参考图片或描述设计灵感来源]
## 技术要求
- 请使用HTML、TailwindCSS和少量必要的JavaScript
- 引用Tailwind CSS(v3.0+)通过CDN
- 页面需完全响应式,在移动设备和桌面端都能良好显示
## 图片资源
- 请使用Unsplash API提供的图片作为内容图片
- 根据内容主题选择合适的关键词
## 图标要求
- 使用Font Awesome或Material Icons等专业图标库 (通过CDN引用)
- 避免使用emoji作为图标替代品
## 交互细节
[描述任何需要的交互动画或效果,例如:]
- 按钮悬停时有轻微放大效果
- 表单输入框聚焦时显示渐变边框
- 卡片在悬停时有阴影加深效果
## 特别注意
- 确保代码干净且有适当注释
- 提供完整可运行的HTML文件,包含所有必要引用
- 优化视觉层次和间距,确保设计美观专业
5️⃣如何生成设计稿:
昨天群里一个朋友提了一嘴能不能转设计稿想了一下,居然还真可以,而且可以帮你生成带自动布局的 Figma 设计稿和对应可复用的组件。具体的方法也很简单
只需要将你生成的代码部署到线上,如果你用 Claude 或者 POE 都有这个功能,如果你用的软件没有发布能力的话可以用这个 http://yourware.so 产品。
获得了线上的链接之后,我们只需要使用 http://html.to.design 这个 Figma 插件就可以很好的将网页转换为
🌟提示词:
方括号[]的部分就是你需要填写的部分。
我需要创建一个[具体描述你的页面/组件类型],请帮我生成美观且响应式的HTML+CSS代码。
## 设计参考
我希望设计风格类似于以下参考:
[上传参考图片或描述设计灵感来源]
## 技术要求
- 请使用HTML、TailwindCSS和少量必要的JavaScript
- 引用Tailwind CSS(v3.0+)通过CDN
- 页面需完全响应式,在移动设备和桌面端都能良好显示
## 图片资源
- 请使用Unsplash API提供的图片作为内容图片
- 根据内容主题选择合适的关键词
## 图标要求
- 使用Font Awesome或Material Icons等专业图标库 (通过CDN引用)
- 避免使用emoji作为图标替代品
## 交互细节
[描述任何需要的交互动画或效果,例如:]
- 按钮悬停时有轻微放大效果
- 表单输入框聚焦时显示渐变边框
- 卡片在悬停时有阴影加深效果
## 特别注意
- 确保代码干净且有适当注释
- 提供完整可运行的HTML文件,包含所有必要引用
- 优化视觉层次和间距,确保设计美观专业
5️⃣如何生成设计稿:
昨天群里一个朋友提了一嘴能不能转设计稿想了一下,居然还真可以,而且可以帮你生成带自动布局的 Figma 设计稿和对应可复用的组件。具体的方法也很简单
只需要将你生成的代码部署到线上,如果你用 Claude 或者 POE 都有这个功能,如果你用的软件没有发布能力的话可以用这个 http://yourware.so 产品。
获得了线上的链接之后,我们只需要使用 http://html.to.design 这个 Figma 插件就可以很好的将网页转换为
新的提示词是解决了相关问题,以及同样只需要给Cursor直接发提示词就好了,不需要做任何额外的操作,相对而言比较新手友好。
👇
我想开发一个{类似小宇宙的播客app},现在需要输出高保真的原型图,请通过以下方式帮我完成所有界面的原型设计,并确保这些原型界面可以直接用于开发:
1、用户体验分析:先分析这个 App 的主要功能和用户需求,确定核心交互逻辑。
2、产品界面规划:作为产品经理,定义关键界面,确保信息架构合理。
3、高保真 UI 设计:作为 UI 设计师,设计贴近真实 iOS/Android 设计规范的界面,使用现代化的 UI 元素,使其具有良好的视觉体验。
4、HTML 原型实现:使用 HTML + Tailwind CSS(或 Bootstrap)生成所有原型界面,并使用 FontAwesome(或其他开源 UI 组件)让界面更加精美、接近真实的 App 设计。
拆分代码文件,保持结构清晰:
5、每个界面应作为独立的 HTML 文件存放,例如 home.html、profile.html、settings.html 等。
- index.html 作为主入口,不直接写入所有界面的 HTML 代码,而是使用 iframe 的方式嵌入这些 HTML 片段,并将所有页面直接平铺展示在 index 页面中,而不是跳转链接。
- 真实感增强:
- 界面尺寸应模拟 iPhone 15 Pro,并让界面圆角化,使其更像真实的手机界面。
- 使用真实的 UI 图片,而非占位符图片(可从 Unsplash、Pexels、Apple 官方 UI 资源中选择)。
- 添加顶部状态栏(模拟 iOS 状态栏),并包含 App 导航栏(类似 iOS 底部 Tab Bar)。
请按照以上要求生成完整的 HTML 代码,并确保其可用于实际开发。
如果你对这套提示词是怎么迭代写出来的感兴趣,尤其是为什么我不会写代码为啥提示词里能表述这么多编程专业词汇,你可以看看这篇文章:https://mp.weixin.qq.com/s/xbFqY9DwTwwZskgBmeqAxA
上期,聊了稀疏注意力。这期,聊注意力机制的另一大改进方向:线性注意力。嘉宾是 MiniMax 高级研究总监,负责 MiniMax-01 模型网络架构的钟怡然。他开发了 1 月中旬开源的 MiniMax-01 中使用的线性注意力架构。
怡然在 2021 年线性注意力还是“美好的泡泡”时就开始关注它的实现。这我一个 AI 研究者关注与投入小众方向的过程。
(本期因录音 bug,音质不太好,有波动,不时出现“变声期”,请见谅。)
经常被问到平时都用什么 AI 工具,于是整理了一下我和 @海辛Hyacinth 在工作流中常用的工具合集。
*由于工具迭代太快,本条将永久动态更新。
*都是我们做项目用的工具,你永远可以相信我写的推荐。
🖼️🖼️ 主力生图工具
▶ Whisk & ImageFX(也就是 Google 家的 Imagen3)
写实风格能达到以假乱真的程度,而且还免费。
·
🖼️ 辅助生图工具
▶ midjourney:曾经的王者,但用过 Whisk 之后用不回去了,希望 V7 加油。
▶ 即梦:如果你需要生成中国风和中文字,这是最好的选择。
▶ Flux:开源最佳,适合搭配 ComfyUI 工作流使用。
·
🎨 修图工具
▶ PS 的创成式填充:虽然生图很拉,但缝缝补补很合适。
▶ Krea 的编辑器:其实就是 Flux 的局部重绘,但前端交互做得超好。
▶ MJ 的编辑器:常用的是 Retexture,局部调整不推荐。
▶ 个人忠告:抠局部细节的时候还是直接P吧。因为当生成区域小到一定程度时,inpainting 对关键词的响应就会极弱,与其浪费时间抽卡,真的不如直接上行活。
·
🔍放大工具
▶ 图片放大用 Maganific & Krea:老实说 Maganific 用多了其实也没那么好用,Krea 更经济实惠。
▶ 视频放大用 Topaz。
·
📽️ 视频生成工具
▶ 目前我们用得最多:可灵 & Pixverse
▶ 风格化场景我们用:Hailuo
▶ 创意特效我们用:Pika
▶ 转绘我们用:ComfyUI
·
🐋 我们在哪用 DeepSeek?
▶ 我用 ima
▶ 海辛用官方app 和 元宝
·
其他想到再补充。
*由于工具迭代太快,本条将永久动态更新。
*都是我们做项目用的工具,你永远可以相信我写的推荐。
🖼️🖼️ 主力生图工具
▶ Whisk & ImageFX(也就是 Google 家的 Imagen3)
写实风格能达到以假乱真的程度,而且还免费。
·
🖼️ 辅助生图工具
▶ midjourney:曾经的王者,但用过 Whisk 之后用不回去了,希望 V7 加油。
▶ 即梦:如果你需要生成中国风和中文字,这是最好的选择。
▶ Flux:开源最佳,适合搭配 ComfyUI 工作流使用。
·
🎨 修图工具
▶ PS 的创成式填充:虽然生图很拉,但缝缝补补很合适。
▶ Krea 的编辑器:其实就是 Flux 的局部重绘,但前端交互做得超好。
▶ MJ 的编辑器:常用的是 Retexture,局部调整不推荐。
▶ 个人忠告:抠局部细节的时候还是直接P吧。因为当生成区域小到一定程度时,inpainting 对关键词的响应就会极弱,与其浪费时间抽卡,真的不如直接上行活。
·
🔍放大工具
▶ 图片放大用 Maganific & Krea:老实说 Maganific 用多了其实也没那么好用,Krea 更经济实惠。
▶ 视频放大用 Topaz。
·
📽️ 视频生成工具
▶ 目前我们用得最多:可灵 & Pixverse
▶ 风格化场景我们用:Hailuo
▶ 创意特效我们用:Pika
▶ 转绘我们用:ComfyUI
·
🐋 我们在哪用 DeepSeek?
▶ 我用 ima
▶ 海辛用官方app 和 元宝
·
其他想到再补充。
让语音秒变正式文档,真正实现"开口即成章"。
主要是能自动优化语言表达,去掉口头禅,让内容更加流畅、正式,非常适用于会议记录、写作辅助、语音笔记整理等场景。
核心功能
- 实时语音转文字
- 自动润色文本
- 自动复制到剪贴板
- 全局快捷键录音
- 简洁的网页界面
GitHub:https://github.com/chrischoy/WhisperChain