关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
从昨天到今天
累计花了10小时在AI编程上
0代码基础做出了两款产品

一款是Chrome插件,提交待审核ing
一款是黄叔精选,正在部署到云上
欢迎关注公众号“降噪AI”体验

先说说两个产品的功能
再说从Claude到Cursor的使用体验

Chrome插件名称“Tab Group Organizer”
支持自定义域名分组
支持对分组自定义设置颜色
一个很简单的需求

之前在生财看过教程
但那会用GPT4生成代码一直报错
现在Claude3.5出来后,直接开干
大概花了2-3h完成
优化了一些功能

“黄叔精选”是一个移动端H5网页
每天我会看到一些好文章
使用DeepSeek API做金句和摘要处理后
输出到一个JSON文件内
然后网页解析
每屏显示一篇文章
可以上下划
可以搜索

都很简单
过去我尝试学习过全栈
真的头都大,各种技术栈
没有一个月,每天几小时下不来
时间成本不划算
最近看到Cursor后又心痒痒
于是拿Claude练手
发现效果很好

用了几个小时后
意识到需要在两个窗口间来回倒腾代码
其实非常麻烦
特别是对代码熟悉了一些后
我开始定位到具体函数内去优化
眼睛都能对瞎了

直到大家和我说用Cursor
打开后世界都变了!
它可以自然语言和Claude交流
然后一键同步,自己就把代码中需要调整的部分自己给改过来了

这样省去了大量的来回处理代码的时间
只需要测试就行了

也是用了Claude,再用Cursor
你才能感受到它的丝滑

社群的张成总结的很好:
“你所有的行为,编写,看结果,看错误,都在一个上下文里”

AI编程给人的感觉就是
把AI当成人,不断指挥它干活
把需求拆解清楚,让它写代码

当然现在的边界情况是简单产品
其实进入到深水区后,依然会遇到很多卡点
不过没关系,迈出的这一步很重要

同时,我也意识到
研发工程师、产品经理变天的时代要来了
用好Cursor的,会碾压不用的
特别是初阶岗位

哎,写一篇文去了。。。
Reddit 老哥用 FLUX 训练了自己的 Lora 去社交媒体说是自己拍摄的,从来没人怀疑。

Lora 训练素材:

15 张现有的照片,都是用专业相机和灯光拍摄的,拍了 5 张新照片,以涵盖不同的角度和距离,以更好地充实数据。

使用 Civitai 的 FLUX Lora 训练功能训练。

来源:https://www.reddit.com/r/StableDiffusion/comments/1f2yun6/i_am_using_my_generated_photos_from_flux_on/
Claude Artifacts 已经向所有付费和免费用户在全平台开放。

他们做了个视频展示 Artifact 是如何被构建出来的。

完全从自身需求出发,敏锐的发现问题,并且找出符合逻辑的解决方式,好的功能都是这么来的。

另外 Artifact 也可以帮助 Claude 获取最好的代码相关合成数据。

来源:https://www.anthropic.com/news/artifacts

Invalid media: video
试试我做的新玩意:分歧终端机——让7个AI给你们的吵架评评理!

我经常在网上看到各种小作文和吵架帖,但从来都是当乐子看,上周五这种争吵发生在我头上,我们都认为自己有理,最后不得不去大群里找人评理。

我就想,能不能找一堆 AI 角色,让他们来评评理,到底支持谁?所以就有了「分歧终端机」。使用方法是:吵架双方说出自己的理由,选择7个AI角色,然后就能看到这些裁判到底支持哪一方。

完全免费、不需要登陆/注册,只是单纯好玩的小项目。结果不要太认真,毕竟一切听老婆的!

最后附上网址: https://www.pingli.app
最近这半年陆陆续续接到好几个朋友的电话想咨询一下和大模型相关的问题,有技术相关背景的朋友,也有完全和这个圈子不相关做实体产业的长辈。和他们聊了聊,关心的问题比较集中,主要是模型的能力边界,模型如何结合自己的场景以及如何快速落地。

其中有一些感受:
1. 这一轮新的机器学习浪潮在多种模态上都有了显著的提升。不仅仅是大家熟悉的LLM,VLM和e2e audio,Gen image/video/audio等提升都很大,并且是有解锁一些新的能力和场景的。所以想把它们使用好,要获取的上下文会非常的长,并且要对其中要点进行充分的理解又避免不了结合训练方法和训练数据进行学习。这中间出现了需要由人来弥合的鸿沟。

2. 结合1想要给朋友解释清楚也不是一件容易的事情。如何用简练的语言和一些结合他背景的比方先把上下文先灌给他是挺难的,但这件事情上人会比LLM更有优势,人拥有了更多对沟通对象的了解,比如你们之前共同经历所积累的黑话等。再上下文构建完成以后,就需要以此为基础带着他一起推理,这个阶段更需要对模型有高屋建瓴的理解,也常常会倒逼着我去思考一些更本质的问题。

3. 通过这样的交流感受最大的是刚开始完全不了解所带来的焦虑感,以及大致了解清楚以后的释然,放心焦虑开始思考如何更好的使用这么强大的工具。
Anthropic 这事做的还挺好的。

他们发布了一个页面展示 Claude 系统提示的变化。

每一个版本的系统提示都在里面。

这个页面查看:https://docs.anthropic.com/en/release-notes/system-prompts#july-12th-2024
Cursor AI :编程效率工具 + Obsidian 完美搭档_哔哩哔哩_bilibili

Cursor AI :编程效率工具 + Obsidian 完美搭档

这个视频发布24小时后,推上已有1.4万人观看,帮我涨了近100关注者,干货很多,欢迎观看

在本期视频中,我将详细介绍Cursor的各项功能和使用方法,包括:

Cursor Tab自动补全代码
Cursor命令行直接操作
Cursor与Obsidian笔记软件的完美结合
Cursor Composer一键生成代码和网页
如何利用网页搜索增强Cursor的回答
Cursor使用技巧和小窍门

如果你想提升编程效率,解放双手,千万不要错过这款AI神器!赶快下载Cursor,一起体验AI编程的乐趣吧!
使用 claude,cursor+deepseek code 完成 LLM Playground 的应用

例如:siliconcloud,openrouter,deepseek 的 api 都可以。

我完全不了解 next.js 技术栈,目的是想看看不懂编程的清况下的可行性

用next.js有一个原因是部署真的太方便了:
https://llm-playground-ten.vercel.app/

整体过程:
1. claude 生成框架
2. cursor+deepseek code修改,直到实现功能。

cursor 我没有付费

整个耗时 5 小时,耗时主要的原因是我不了解 next.js 技术栈,需要补的知识很多。

一些感受:
1. 重头开始了 4 次,修改 prompt。整体生成框架,最后是 sonnet 更胜一筹,这一步不能太复杂的 prompt,尽量简单,到 cursor 的时候再丰富,就好办一些。
2. cursor 中,我用的 deepseek code 模型,效果也不错。但是有幻觉,sonnet 也是如此,而且这两个模型幻想的内容很相近(有趣)。
3. 好的点:
- 基于 vscode 实现,整体的开发、编辑体验很好
- 编写测试用例的体验很棒
- 添加修改部分功能的体验很棒
4. token 的消耗很大,浪费比较严重
5. 看不懂技术很难进行一些细节的调整,细节往往是幻觉的重灾区

Invalid media: video
下面几张图都是用 FLUX 流程跑的。

强大的基础模型加上丰富的生态。

太离谱了,这个色彩表现和图片质量。

FLUX 带给开源图像生态的变化才刚开始。
国内的 AI 行业发展似乎停滞了
某些方面甚至还有点倒退......
卧槽,字节开源了 FLUX Dev 的 Haper SD Lora。

只需要 8 步或者 16 步就可以用 FLUX 生成图片,大幅减少 FLUX 的生成时间。

模型下载:https://huggingface.co/ByteDance/Hyper-SD/blob/main/Hyper-FLUX.1-dev-16steps-lora.safetensors
周末花了1个小时搞了一个类似于黑神话悟空攻略AI问答的东西

网址:https://wukong.today/

比如:如何打过黑神话悟空的广智
https://wukong.today/c/6f60021e10c1375b8a7761f25497af0492ca4b88

感觉国外更需要的是:西游记 问答这种东西
ComfyUI-Nexus 这个插件🐂🐸

可以让 ComfyUI 支持多人协作,而且协作人不需要安装任何东西,打开链接就行。

- 最多支持 15 个并发用户
- 只能在云服务的 ComfyUI 上运行
- 观察他人工作流程的旁观者模式
- 一名用户主持,其他用户远程加入
- 支持工作流自动备份

项目地址:https://github.com/daxcay/ComfyUI-Nexus?tab=readme-ov-file
靠……我用v0和Cursor,一天做了个网站并上线Vercel,不敢相信。
Back to Top