关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
【Lora 推荐】 可以生成文字海报的 FLUX Lora。

非常适合用来做一些资讯和主题的封面图。触发词:text poster。

模型下载:huggingface.co/Shakker-Labs/FLUX.1-dev-LoRA-Text-Poster
Notebook LM 产品负责人和 Karpathy 都聊了一下这个产品目前需要优化的部分和欠缺的功能。

我整理了一下,一个比 Notebook LM 更好的 AI 播客 PMF 这不就出来了?

1. 移动应用开发:需要专门的移动应用;更便捷的音频控制,特别是在屏幕锁定时。

2. 交互功能:播放过程中能够中断并提问的能力;提出或请求后续剧集的选项。

3. 简化内容生成:简化基于兴趣点生成额外剧集的流程;减少收集资料和定制内容所需的时间和精力。

4. 分享和群组功能:与家人或朋友分享剧集的能力;群组收听体验的潜在功能。

5. 内容质量和呈现:对信息上下文化的积极反馈;避免枯燥的事实陈述。

6. 资料来源管理:目前主要依赖维基百科;建议提供快速资料来源选择器,并提供推荐。

7. 自定义指令:保存自定义指令模版的能力。

8. 离线功能:在网络连接不佳的地方可以本地保存内容的选项。

9. 与其他AI工具的集成:目前使用NotebookLM pod和ChatGPT Advanced Voice的组合进行问答。

10. 基于图像的播客生成:建议从单张图片生成简短播客;利用图像识别技术识别地标自动提取高质量资料,并提供简短的审核选项。
卧槽,来了朋友们,Comfy org 发布 ComfyUI V1 版本。

新手使用 ComfyUI 最大的问题终于被官方解决了。

发布跨平台的 ComfyUI 安装包,你现在可以一键安装 ComfyUI 了。

同时更新全新的 UI 界面解决很多体验问题,并且增加模型库和工作流管理。

发布完整桌面包特性:

代码签名和安全:ComfyUI 现在可以打开而不会触发安全警告。

跨平台:适用于 Windows / macOS / Linux

自动更新:通过自动更新保持在 ComfyUI 的稳定发布轨道上。

推荐的 Python 环境:不再手动设置的烦恼。

ComfyUI Manager默认安装:直接从 ComfyUI 注册表安装节点,访问最新的版本节点。

Tab 页面:您现在可以使用标签页打开多个工作流程并在它们之间切换。

自定义键位绑定:您现在可以定义真正的自定义键位绑定,而不会受到浏览器级命令的干扰。

自动模型资源导入:可以通过在安装过程中选择该目录来重用现有的 ComfyUI。

全新的用户界面:

顶部菜单栏:已将许多操作合并到顶部菜单栏,扩展开发者现在可以轻松地在那里附加自定义菜单项。

更容易访问模型和日志:通过右键单击托盘图标快速访问模型、自定义节点、输出文件和日志。

模型库:轻松浏览所有模型,并将它们作为检查点加载器直接从库中拖放。

工作流浏览器:现在可以在工作流浏览器中保存工作流以便快速访问,或者将它们导出到不同的目录。

自动模型下载:ComfyUI 现在允许用户在工作流中嵌入模型的 URL/id 并自动下载。

加入等待列表:https://www.comfy.org/waitlist
昨天我的治理AI在DAO中独立投出了第一票。这是一个75,000 USDC的拨款提案,AI经过考虑后投了反对票。它认为提案缺乏具体财务指标和预算细节,也未能阐明资金如何提升DAO的价值。附图是Agent同步提交到链上的说明,前面的数字2在合约中代表反对。

这个治理AI通过读取链上数据获得提案内容,做出决策,我此前已将投票权delegate给它控制的钱包。它能自主形成判断并直接在链上投票,不需要我的参与,也不需要我的批准。今后这个AI将长期运行,持续参与治理。

有朋友开玩笑说8年后的美国总统可能是个AI。8年可能过于乐观,但AI参与国家治理大概率将成为现实。要治理国家,先从参与治理一个DAO开始学起把。
非常屌的概念应用演示。

实时将你所处的环境变成各种虚拟游戏地图。

感觉 MJ 想做的那种 3D 生成就是这样的类型。

目前这个演示是用 Runway 的 V2V 做的,不知道可以实现实时转换还需要多久。

原作者是 Reddit 的 u/jesser722

Invalid media: video
如果不是专业的创作者的话,别用 AI 搞那种又长效果又不好的 AI 长视频了。

整个很有特点的 IP 形象然后运营就可以。

这个巫师猫咪的 IP 的视频在Ins Reels已经有 1200 万播放,很多人进行混合二创,起飞了。

原作者的推是:Cheeseball_sol
ChatGPT进阶教程,3分钟翻译完一本书

把今天用AI翻译整本书的脚本代码开源了,也顺带说下思路:

1、书的文本太长了,超过了LLM的上下文限制,更是远超了多数模型4096的输出token。所以文本需要分割,但是分割得不能太短,短的话会上下文不足会影响翻译质量,所以最好是接近LLM最长输出长度的;
2、分割翻译容易导致上下文同类表述翻译风格不一致,所以最好的是先提取文本高频词汇,直接在system prompt里限制;风格方面可以通过few-shot实现前后风格的接近;
3、从提高翻译质量和不要有机翻感的目标来说,可以做两步,一是直接定义风格(比如鲁迅),特定风格不容易有机器感;二是两步或更多步翻译,给AI更多的token进行思考,尤其是第二次翻译可以实现对前面内容的反思。
Notebook LM 团队成员和作家 Steven Johnson 分享了他使用这个工具的 8 个专家提示。

有的方法还挺好的,比如按项目把所有需要的内容都给他整理,或者跟它沟通完后让他生成总结整理到另一个笔记本。

- 将最近 10 个文档上传到一个笔记本中,然后提出问题开始尝试。即使最近的文档不相关且完全随​​机。

- 创建一个“全能笔记本”,包含你大多数时间工作的一般知识在内的资源。然后跟它交流,就跟团队中的另一个成员一样。

- NotebookLM 在需要管理、连接和综合来自多个来源的信息的情况下非常有用。比如使用 Gemini 和 Gems 探讨后利用 NotebookLM 整理,再加上谷歌文档的内容,都扔给它整理和整合。

- NotebookLM 的建议问题是一种很好的资源。模型实际上将帮助询问引导浏览材料的问题。直到您想到要询问的问题为止。

- 请求 NotebookLM 以不同的方式提供信息,比如FAQ、简报文件、时间轴、目录、学习指南,甚至播客。

- NotebookLM 也是一个用途广泛的创意工具,在办公室或教室之外也可以很好地使用,很多人在撰写奇幻和科幻小说或开发游戏时使用它,他们在进行世界构建和复杂背景故事工作。

- 将信息源转换为音频概述,只需在音频概述面板中点击“自定义”,输入希望主持人从的来源中关注的要点的简短描述,就可以生成对谈播客。

- 整理跟NotebookLM的记录,你可以在一个笔记本上进行谈话 — 你提出问题,然后追问问题,甚至要求它优化你的想法,在对话结束时,你可以请求 NotebookLM 总结对话中的关键要点,形成一个单一的笔记并放入那个笔记本中。

感兴趣可以看看:blog.google/technology/ai/notebooklm-beginner-tips/
戴上 Meta Rayban,来不及体验 AI 功能,先自拍三张为敬~
☕️ 把周末最美好的时光,留给Dario Amodei的雄文《慈爱机器》

你若和我一样热爱Claude,无需我介绍这位了不起的创造者。Amodei的洞见之作不仅展现了他对AI发展的长期洞察,更以跨学科的融汇贯通展开了惊艳的论证——AI 如何普惠全人类。

邀请你慢下来,品味这封来自未来的手札。在床头翻阅、散步时与AI漫谈,或在休闲时光中与友人分享其中的灼见。这份极为稀少的精彩智慧,饱含科学与人文精神,鼓舞我们乐观前行。

https://darioamodei.com/machines-of-loving-grace

「就如同一口神奇的井,你越是汲取,它就越丰盈。」
Back to Top