关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
在线摇人。有没有对 AI 搜索感兴趣的朋友,愿意全职一起干?还没拿到投资,暂时只能用爱发电。😂
🎨 Claude Artifacts 神奇用法:人人都能制作的在线画板,全程不到三分钟?

「人工智能意味着计算机正在学习我们的语言,而不是我们必须学习它们的语言。」 ——Naval

几天前,Claude 带来目前最强的免费大模型3.5 Sonnet, 其综合能力领先GPT-4o ;而新特性 Artifacts 因为其超强的编程能力和所见即所得的实时交互,令AI研究者们尖叫不已。在我看来, Artifacts 正在引领一种全新的创作范式。Hans准备了一系列小教程,展示其惊人的能力边界。

与其说是教程,不过是实际操作的录屏:在此次绘画工具制作全流程中,你将看到一个好用的软件产品从想法、实现、完善到版本迭代只有短短几分钟,是如此简洁、优雅;甚至不需要理解任何编程语言,自然地对话,毫无门槛。唯一需要的,是你的好奇心。

尽量亲自尝试吧——几句话就能生成复杂作品的神奇体验,是很难借助用他人的语言来充分感受的。 Enjoy ~

🦜 One more thing:

如果你是Claude 和ChatGPT 双栖用户,可以把我的GPTs ——Prompt for me当成兔子洞;它不仅能针对Claude 写出结构化的Prompts,还收集了不少 Artifacts 精华案例,一定能打开你的创作灵感。

https://chatgpt.com/g/g-jaTKZXfJ0-prompt-for-me-gpt-claude-gemini

Time to build~

Invalid media: video
Claude 3.5 Sonnet + Replit,极简制作3Blue1Brown风格Manim动画

前2天做的关于理想汽车财报亮点的视频在推上还比较受欢迎,今天又尝试了做小米的,这次是多次沟通修改的。

这里我解释下,不是Claude直接生成最后的视频效果,而是让Claude先用Manim库生成Python脚本,之后本地运行Python脚本渲染生成MP4。

我也看到一些用户反馈Manim本地安装各种依赖比较难,不用着急,今天推荐一个非常好用的平台——Replit。

Replit是一个在线的集成开发环境(IDE),可以让你直接在浏览器中编写、运行和分享代码,无需进行复杂的本地环境配置,非常适合快速原型设计和学习新的编程语言或框架。

Replit官方为Manim做了一个开箱即用的模版和拓展。

链接:https://replit.com/@ArnavBansal/manim

下面视频对应的提示词:

「提取附件财务报告的要点,使用Manim库编写动画进行展示。动画要多样化,显示效果要华丽。

首页标题页背景改成橙色,文字白色;其他页背景改成灰色#ececec,白色文字改成 黑色文字,橙色保持不变,请给到完整代码

make it better,让动画效果更丰富

很不错,成功运行了,请你再努力下,make it better,幻灯片转换优化,字体大小优化、动画优化等

CLaude先总结这篇财报的亮点,接着基于这些亮点,写了代码。」

注:这里示例用的是小米2024年第一季度业绩公告,44页PPT样式的PDF。

Invalid media: video
开源社区终于有一个好的视频转绘项目了!

还提供了 Colab 笔记,直接运行就可以,不需要摆弄麻烦的 Comfyui 流程和一堆模型了。

Diffutoon 能够以动漫风格渲染出细节丰富、高分辨率和长时间的视频。它还可以通过一个附加模块根据提示编辑内容。

项目地址,里面有 Colab 笔记可以直接运行:https://github.com/modelscope/DiffSynth-Studio/tree/main/examples/Diffutoon

Invalid media: video
感觉AI设计的更有仿生性
🎬 用 AI 让老照片动起来,还原拍摄场景,就很棒 ❤️

Invalid media: video
写一个游戏需要几个步骤?答案是6。
视频全记录,只做加速,毫无删减。

Claude Artifact 应该是对代码小白来说,最好用的写代码工具了。
没有之一。

游戏代码放在Github,可以下载html,放浏览器里直接玩。
https://github.com/orange2ai/dogandbone

Invalid media: video
赛博活佛 Andrej Karpathy 新课程 LLM 101 !

会教你从零开始构建一个专门讲故事的 LLM 应用,这个应用可以与AI共同创造、完善并绘制小故事。

使用 Python、C 和 CUDA,并且只需很少的计算机科学知识。

最终目标是让你对人工智能、LLMs和深度学习有比较深入的理解。

下面图片是一部分大纲。

项目地址,目前只有目录,还在施工,可以先点个Star:https://github.com/karpathy/LLM101n
下午demo show这么快就在小红书上有总结了…
小红书还是这个活动的官方合作内容平台,你是真不给面子啊
一点小感慨:还是要做有钱人的生意,搞值钱的流量

昨晚把自己网站的支付策略重新调整了下,上线后就睡觉去了

醒来后发现有几笔订单,心里非常开心(算是第一次真正意义上的靠网站赚到了美金,也感谢@哥飞 和各位群友给的建议)

我计算了一下自己的睡眠时间,推算出大概1-2小时能出一单,然后脑海里就已经开始幻想着未来日入百刀的模样了(虽然单价很低,只有3美元)

不过今天白天一天,等到了现在这个点都没有再出一单,心情经历了从焦躁到失望再到郁闷……

后面想了想,会不会是跟地区和时区有关,于是到lemon squeezy的后台看,发现果然昨晚凌晨出单的都是美国地区,而现在美国已经是凌晨了

之前看大家在群里讨论,都会比较关注是哪个国家来的流量,自己当时还没什么感觉。

果然只有当亲自下场做了之后,才知道不同国家的付费习惯和能力可以对收入带来那么大的冲击

以后去获客的时候,也提醒自己应该更关注高价值地区的流量情况,而不是自嗨着关注大盘UV是否过了1k、2k、3k…
这五天,我作为论文作者参加了世界上最大的AI顶级学术会议,采访了20+优质论文作者,参加了大厂、顶级创业公司、VC的内部聚会,平均每天睡眠5hr + 800ml 冰美式。takeaways:

LLM验证了大模型范式,而这个新范式的潜力远不限于文字生成。在计算机视觉,大模型范式带来的变量正在被释放:大语言模型可以提升物体定位算法的效果、微调后的Stable Diffusion能够找到人体关节的坐标、新模型生成可交互的2.5D场景...我正在整理一份视觉领域的最新变量,如果你感兴趣,欢迎关注点赞转发,我会发给你。
deepseek coder现在支持生成代码一键在网页端运行啦
特别好玩大家快来试试!🥳试过才知道👻

链接:
https://chat.deepseek.com/coder

推荐一个简单的提示词:用 HTML、CSS 和 JavaScript 实现一个好看的音乐播放器的所有逻辑,允许用户上传音频文件,正常输出,样式美观,显示当前音乐名,并通过 canvas 实现音乐频谱可视化。
传奇程序员约翰卡马克想要转型ai,然后ilya给他推荐了这27篇论文,说看完这些论文就会对当前ai领域在发生什么有一个全面的理解。

这个太棒了。无数大佬都说学ai最重要就是多读paper多测demo,但是论文千千万,精力又是有限的。可以有真大神ilya帮忙梳理一套论文那是完全不一样的。

而且现在有了gpt的帮助,包括一些插件比如consesus,比如mr.ranedeer,等等,小白也可以最无痛的看论文了。甚至可以针对这27篇论文,让gpt帮自己定制一个专属的学习计划和专属教材。

另外加上一个超好用的小技巧,我之前学神经网络和机器学习基础的时候一直在用的,就是让gpt针对每个知识点学完以后马上问问题来靠自己,比如让自己用自己的语言陈述一下这个知识点,然后gpt就可以测试自己对每个理论或者知识点的理解透不透,如果不透马上可以针对这个知识点给你傻瓜式解释到你绝对懂为止。这种流畅的学习体验,和没有gpt时代是完全完全不同的,曾经的自己如果这么厚一踏专业全英文论文摆在面前,坦白说连翻来的勇气的没有。(只针对人生的前30多年一篇学术论文都没看过的我)。但是现在,我看到ilya推荐的论文清单,只有兴奋。因为我马上可以为这27篇论文,指定一个24小时的gpt老师和专属针对性的学习和练习计划,里面涉及的技术问题的讲解,我也很有信心gpt的讲述方法可以让读过中学的人都有办法理解,如果不理解,可以再换一百个角度一百个比喻来讲解。这种信心,我觉得是和gpt前的时代完全不同的。

我让gpt把27篇论文简单梳理。摘要。分不同阶段。再提供一下论文的下载链接。如果有必要,让它逐步针对27篇论文,把里面的理论体系形成一整本立体全面相互关联的一本教材也不是不可以的。这种学习体验像魔法一样。所以我感觉可能未来外卖小哥快递小哥保安小哥自学ai成为各个领域大神的故事会越来越多,越来越常见。认为自己因为没有专业背景没读过相应大学专业没做过相应的工作所以不行也不敢尝试,这种想法慢慢会被ai改变。

ai will make human more human
Back to Top