关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
和 AI 一起写了一部小说集,前半部分是我的故事,后半部分是 AI 根据我的文本仿写的故事。

@Simon阿文 给每个故事都设计了插画,我们将这些故事印成了册子,这本册子也会参与厦门的AI艺术超级明星作品展。

猜测哪些是人类写的故事,哪些是 AI 写的故事,也许是阅读本集的乐趣之一。( ´▽` )ノ
24、25 年会是下一代浪潮最关键的两年 | AI 年终复盘 - 42章经

年终呕心之作,我敢说任何人都可以通过听这期播客快速拉齐信息和认知差,成为最懂当下 AI 市场的人
飞书的滚动截图+Kimi简直是神器。

为了看下RealityKit的所有Shader,由于官方文档里没找到,只能从软件的下拉列表里慢慢扒拉。但有了上面两个工具:
1. 飞书滚动截图负责拉全部数据(图1)
2. Kimi负责把图片内容整理成表格(图2)
3. 贴到文档生成结果:https://xz3t11cmy1.feishu.cn/wiki/EAn5w0w74idu1ckBIE5coiQTnMh

第一轮出初步结果只需要不到10分钟,很方便!
同样试了GPT4,在OCR的处理环节就卡住了。

尽管如此,过程中还是遇到了一些问题:
1. 由于源头是图片且其中夹杂了logo,会有一些识别不准确、串行的现象
2. 图片太大内容太多,需要提示Kimi分页分多次给结果,不过这一点也还能接受,瑕不掩瑜
3. 一共186个shader,但第一次出的结果只有175个,其中一部分丢了,尝试过把源图片和整理结果再次丢给一个新会话校对但没有成功,还是需要人工核对,会花一些额外的时间。

总体来说还是节省了大量的时间,感谢@KimiChat ,也感谢Kimi布道师@杨昌 老师!
fashion, Wong Kar Wai style, slow shutter, night, cinematic, lonely, street, photography, 8K, hyper realistic, super detailed, hong kong art movie, windy, motion blur by yanfoto
推荐给 AI 小白的 3 篇文章和 1 个工具

这几年,因为做「躺岛」和「新世相」,我认识了大量的从事媒体、营销、消费品等行业的朋友。

在这些领域的朋友中,我可能是他们中最了解 AI 的人之一。因此,我总是能接收到很多的问询:“给我介绍下 AI 吧!是什么、有什么用、怎么用?”

于是我从之前的阅读笔记中,整理出 3 篇文章和 1 个工具(当然是 @小宏 的 Monica),推荐给盆友们~
最近突然意识到,我的思维模式被AI彻底改变了!
在遇到任何问题的时候,第一时间想到的已经是“我要怎么问AI才能得到更好的答案”,AI的思考能力已经在最近半年进化到了真的可以实战的程度。

比如最近开年的阶段,很多人(包括我)都在写2024年的工作规划,原本要是自己写,肯定千头万绪折腾很久,但这次我选择和AI一起完成这件事儿,通过 以下6个问题,最终形成了我的2024年工作规划:

1.作为一个职场规划导师,请你教会我OKR都包含哪些内容,为什么是高效的规划思路?还有哪些高效规划的思路?
2.你觉得有哪些优秀的方法论可以指导我写年初的工作规划,这些方法论分别有哪些侧重点?
3.我的工作内容是「xxxx」,请你用以上方法论分别帮我写一份工作规划的草稿
4.你觉得根据答案,哪个方法更高效一些?或者说对于一份年度规划来说,哪几种方法更能让老板觉得你的规划更好,并且在之后的工作中可以执行度更好?
5.请你用A+B+C方法完整帮我撰写一份2024年年度工作规划,需要重点撰写以下工作内容:「xxx」
6.请你以专业的职场规划导师身份,根据以上规划,为我今年和未来的职业规划给出3-5条建议

在这6个问题之后,我选择了OKR+GROW结合的方式写完了规划,这份规划包含了以下内容:
⏺️年度总体目标
⏺️每个目标拆分的数据指标
⏺️对项目现状的评估
⏺️工作计划的时间节点
⏺️具体可执行的工作内容
⏺️更深更高的职场和工作思考

这些问题不依靠AI也可以直接得到答案,但AI的优势就在于可以一直重复给出答案,完整不重复,写到最后对我来说启发的价值远大于交差(而且基本不会写错别字)#AI的神奇用法 #AI工作流

当然啦,以上能力肯定是做成了直接就能用的版本、依然是放在「AI帮个忙」里,欢迎大家试用:
奥特曼在YC W24 启动会上的演讲要点:

- 奥特曼暗示我们可能已经非常接近实现通用人工智能(AGI)

- 他建议应该以通用人工智能的实现为前提进行创业和技术开发。(不要再瞎折腾)

- GPT-5可能会相对于GPT-4有一个指数级的跳跃,尽管GPT-4已经领先近两年,至今无人超越。

- 这个进展将会给初创企业和现有公司带来了许多问题和挑战。(AGI将覆盖一大批创业者)

- 建议使用最先进的模型(State of the Art, SOTA),而不是花费太多时间进行微调和优化。(徒劳无功)

- 最正确的做法是设想一个“上帝般的”模型正在运作,然后基于这种设想来构建最好的产品。(要及其有远见)

- OpenAI API将继续变得更快、更可靠、更便宜。然而,性能和成本之间始终存在平衡。例如,尽管电池技术已显着改进,但 iPhone 仍将保持 1-1.5 天的电池寿命以优化性能。

- 不建议建立产品业务主要致力于解决当前 GPT4的限制的内容。因为大多数限制将在 GPT-5 中部分/全部修复。(你会被覆盖)

- 初创公司更需要情境优化,而不是行为优化。通过 RAG 等提供更多信息可能比微调更有益。
🧪卧槽,这个竹叶组成的龙的图可太惊艳了。

但是探索页面原提示词的成功率非常低,十几次才能有一张,我修改了一下,现在基本上一次就能出来。

原提示词的主要问题是画面主体的龙的单词太靠后,导致权重太低,同时类似照片照片这种词,还有一些无意义的介词太多也稀释了前面一些关键提示词的权重。

删掉了这些词调整提示词顺序,并在最前面加上了“Chinese dragon made of bamboo leaves(竹叶组成的中国龙)” 之后就好了很多。

提示词:
Chinese dragon made of bamboo leaves, moment bamboo leaves are swept up by the wind, forming a vague shape of a dragon in mid-air, The dragon shape is ethereal and almost transparent, The scene is set in a lush bamboo forest with sunlight filtering through, , Close-up, casting dynamic shadows, blending seamlessly with the natural surroundings, Taken on: high-speed camera with a focus on capturing motion, X prompt, hd quality, natural style --ar 9:16 --stylize 750 --v 6.0

#晚安提示词 #Midjourney #Catjourney
lk4VaKa7ahH2ZB907UBCLqnYUXy2v3.png
13.1 MB
麻了,ComfyUI链接万物了这下,有人推出了ComfyUI Lora训练节点。

可以直接在Comfy UI中训练Lora模型。而且设置挺简单的,可以直接在comfyui里面手搓妙鸭了。

训练结束后模型会保存在ComfyUI lora文件夹里面,训练后刷新就可以使用和测试。老哥甚至想在Comfy UI中集成Tensorboard。

你可以在这里安装这个节点,里面也有作者的教程,非常详细:https://www.reddit.com/r/comfyui/comments/193vnxg/lora_training_directly_in_comfyui/
[解读] 纽约时报起诉OpenAI及微软非法使用其版权内容进行大语言模型训练和应用

关于此案,上周发的视频太长不看,整理成文章供大家参考。欢迎大家关注,持续为您带来该案件和类似事件的报道分析。

“Life Transformer” 专注于人工智能技术与商业、法律和社会生活的交叉领域。“Transformer”一语双关,既指Google经典论文中的深度学习算法架构,又暗示在技术迅速发展之下,我们每一个人都应做好转变的准备。我们将探讨技术如何重塑世界,也将探索我们如何于新世界里获得自由和自在。
Back to Top