关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
有不少对 AI 感兴趣的朋友,都陆续问过我:他们想付费使用 ChatGPT 4 或 Claude 3.5,但是因为没有海外的信用卡,没有美区 Apple ID ,被卡在了支付环节,不知道如何完成付费订阅。

之前这个问题,一直没有很好的解决方案。直到最近,在朋友推荐下,我发现了一个神奇的支付网站:https://bewildcard.com/i/39WV9QFC,能够完美、合规地解决这类支付问题:

这个网站用手机浏览器就能打开,它的神奇之处在于:
1️⃣ 订阅便宜 50%:使用和 GPT 4 及 Claude 3.5 功能完全一样的原生界面!并且他们把订阅价格打了下来,原本 GPT Plus 每个月需要 20 美金,现在只需要 9.9 美金 = 相当于每个月直接节约 50%, 一年下来能节约 840+ 元人民币~
2️⃣ 支持微信支付宝支付:如果你有其他 Ai 工具订阅需求,比如 AI 最强图片生成的 Midjourney、最强视频生成的 Runway 等,只需要缴纳 70 多人民币的服务费,就能在长达两年的时间内,直接用微信和支付宝完成各种海外工具的订阅,再也不需要海外信用卡了💳
3️⃣ 国人友好:不需要魔法🪜,中国的手机号就能注册,关掉 vpn 后也能正常使用~
4️⃣ 购买 api:对于开发者来说,还能在网页上购买 OpenAI 的 api,快速解决支付问题。

之前有支付问题困扰的朋友,可以去尝试下。我和身边 AI 圈的朋友,已经玩了好几个月了,在这里免费安利给大家~
;; 作者:李继刚
;; 版本: 0.8
;; 模型: claude sonnet
;; 用途: 深度理解一个概念的本质
(defun 哲学家 (用户输入)
"主函数: 模拟深度思考的哲学家,对用户输入的概念进行本质还原"
(let ((洞见 (演化思想 (数学意义 (还原本质 概念)))))
(SVG-Card 洞见)))

(defun 演化思想 (思考)
"通过演化思想分析{思考}, 注入新能量"
(let (演化思想 "好的东西会被继承"
"好东西之间发生异性繁殖, 生出强强之后代")))

(defun SVG-Card (洞见)
"调用Artifacts创建SVG记忆卡片"
(design_rule "合理使用负空间,整体排版要有呼吸感")
(设置画布 '(宽度 800 高度 600 边距 20))
(自动缩放 '(最小字号 14))
(配色风格 '((背景色 (宇宙深空黑 玄之又玄))) (主要文字 (和谐 粉笔白)))
(设计导向 '(网格布局 极简主义 黄金比例 轻重搭配))

(禅意图形 '(卡片核心对象 洞见))
(自动换行 (卡片元素 (概念 禅意图形 还原本质))))

(defun start ()
"启动时运行"
(setq system-role 哲学家)
(print "我是哲学家。请输入你想讨论的概念,我将为您分析。"))
;;; 使用说明:
;; 1. 初次执行时, 运行 (start) 函数
;; 2. 调用(哲学家 用户输入)来开始深度思考
用 cursor 做了个工具,把播客/音频内容,删除口水话和语气助词后,直接转成排版好的对话网页,并且适配手机端。

不知道有没有机会开发成一个小产品呢?🧐

这条线上下一个想做的小作业:把幽默喜剧类播客内容转成这种格式,并且会有AI高亮的笑点,点击后AI会给你解释为什么好笑🤣
对话机器人专家王田苗:10% 的人设计机器,40% 的人服务机器,50% 的人享受爱好

#AI 远见人物——新一篇
王田苗是中国知名机器人专家,孵化过九号机器人、天智航等公司。

【这次我们不仅聊了他对具身智能的观察
-通用技术突破已发生,但产业落地不会那么快,具身智能要去具体场景去进化。
-今年下半年到明年,人形机器人一定会有泡沫,但产业发展也需要泡沫。

【也聊了科学家创业
-20 年前,王田苗是中国第一批做创业孵化的科学家,他与朋友一起于 2002 年成立的博创兴盛就是孵化器,在意识到自己的短板后,他选择放手让学生干。
-科学家的常见短板:缺乏商业思维,更多从技术创新而需求出发,从事而不是人(人的激励、动力)出发
-他认为科学家创业是否有望成功有两个分水岭:1.是否 All in(或者放手,让学生 all in) 2.是否能获得商业思维

(and——我很喜欢文中的一张插图:
在南极,当一只阿德利企鹅遇到“基地漫游者者”机器人🐧🐧🐧
周末听了Reid Hoffman前段时间在斯坦福讲的一节AI商业课,收获了一个对我认知冲击很大的观点:基于LLM的产品,或许可以成为认知层面的GPS。

怎么理解这个观点呢?让我们先从手机地图说起。在没有电子地图的时代,大家出门都是靠纸质地图,但是纸质地图有两个比较突出的问题,一是比例尺固定,无法放大和缩小,二是无法快速定位到自己当前的位置。这就带来了问题,如果我要出个远门,要么我得做很多很多功课,要么我得找个懂路线的高手带着我,不管是哪种方式,认知或金钱成本都很高。

但是有了手机地图以后,这个问题就慢慢被解决了。比如我要从北京开车去新疆,放在之前光是路线这块就是个很头疼的事情,而现在我只需要打开手机地图设置起点终点,一眼就可以看到接近3000km的路线,路上要经过哪一个高速,哪里有加油站,哪里堵车,都看得清清楚楚,这个时候我心里已经有数了。当我启程的时候,它会在每一个路口引导我往哪个方向走,提醒我接下来的服务区,帮我绕过堵车的路段…. 在长途自驾时,正是因为有了手机地图,我的大量精力可以从繁琐的路线规划上抽离出来,专注于欣赏路上的风景。

那么,让我们从更抽象的角度来思考手机地图,它做了什么事情?

首先,当用户需要做一件本来很复杂的事情(规划驾驶路线)时,它提供了一套宏观的总体解决方案,让用户感知到它的靠谱,愿意使用它。
其次,当用户实际使用它(开启导航)时,每一步都在合适的时间给用户提供了详细的指引,让用户不再需要为繁琐的细节而担心,只需要相信它,它便会带领用户一步步到达终点。

从这种角度讲,手机地图实际上是一个非常伟大的发明,它提供了一种强大的安全感。正是因为有了它,没出过远门的人也可以放心地开始踏上旅途;在陌生的城市里,因为有它,旅行者可以放心地探索城市的每个角落,不用担心找不到回去的路。在它的赋能下,每个人能去的地方更远了。

对于LLM产品来说,其实也是类似的。在OpenAI o1模型的介绍中,我们可以看到它在一些任务中的表现已经可以和PhD媲美,在丰富的世界认知和强大推理能力的加持下,在「地图导航」以外的领域,LLM也可以为用户提供强大的安全感。

之前,面临高山,用户可能望而却步,但是有了LLM之后,TA只需要说出来TA的目标是什么,剩下的,就交给LLM。它不仅会告诉你它完全可以帮你处理这件事,还会在每一步给你详细的指引,而对于用户来说,只需要顺着指引向前走,享受这个过程,最后,与目标不期而遇。这就是认知层面的GPS。

话说,人生不也是一段长途旅行吗?有个GPS当向导,或许会走得更远。
读取品牌logo,定制商务名片
用Claude直出的效果,相当符合品牌调性
感兴趣的可以看我的连续对话记录:https://monica.im/share/chat?shareId=eKQkxdzaphhlcFhl
虽然还没有试过固定提示词,但是想直接用的已经可以参考对话记录直接用起来了
我一直有一个小需求,是用我的 AI 音色把文字内容做成播客。
可就是这么一个小小的需求,各种方法用了一圈,都特别麻烦。
要么就得自己训练模型...
要么就是2B服务,后台难用的一批...
要么就是只能微信使用,还收费99一个声音...
试完发现就只有 Fish Audio 可以满足我的需求。

- 简单,录音十秒就能克隆自己的声音,还支持上传录音文件克隆朋友的声音
- 易用,打开网页就可以直接合成声音,不用下载APP,不用打开小程序,非常方便
- 免费,其他平台克隆一个声音收100,非常离谱,Fish Audio 克隆声音不要钱,生成500字以内也不要钱,一般内容几百字对个人来说完全够用(更多字数订阅10美金/月也不贵说实话)

Fish 不仅能克隆自己的声音,还提供了一个声音共享社区,里面有各种用户上传的上万种有趣声音可以体验,坤坤,赛马娘,孙笑川,高启强...打开你的想象空间...

另外附上这条推的音频版,全部使用 Fish Audio 克隆和生成,使用剪映美化声音、增加背景音防止被其他人克隆,可以试听一下。

Fish Audio 的网址,记得收藏,以后你一定会用到
https://fish.audio/
用 cursor 开发了 10 个小项目后的,处理的报错和“疑难杂症”的 10 个心得,👉适合 0 代码基础新手:

1、心态调整:是 AI 就有幻觉,会出错很正常,要相信用适当技巧,能解决问题;

2、有报错,先截图或者复制报错信息给 cursor,让它分析原因,给出修改任务;

3、反复出现报错,可以用左侧栏下方的时间线,把 AI 修改过的文件先调回上一个正常版本,尽量不在反复出错的版本上修改,这里麻烦的点是只能一个一个文件调回老版;

4、⚠️关键的正常版本开发好后,在电脑复制一个文件夹副本,可以在 cursor 把项目改乱,以及修改了太多文件之后,直接用副本文件夹;

5、如果你自己已经认识到,当前项目容易报错,一定要严格执行上面的“3”和“4”之后,再结合报错信息提给 cursor 修改;

6、如果用 composer ,注意多用 save all 先看看效果,而不是用 apply all;

7、❗️新手我建议多用右侧栏的 AI 对话(command+L) 而不是 composer(command+k),因为右侧栏支持发送截图,针对单条代码和分析进行提问,以及更细的分析,有利于我们分析问题,时间长了新手也可能看出不合理和胡说八道的地方😉

8、可以尝试换模型解疑难杂症,点击对话栏最下方尝试换 GPTo1🍓,GPT4O👨‍⚕️,cursor-small🧑‍⚕️ 这三位“其他科室”的专家来解决;

9、如果还是解决不了,推荐一下最近发现的“编程老中医㊙️”——claude dev,它最近花 5 分钟帮我解决了一个耗了3 小时,还线上咨询了几名工程师都没有解决的问题,且这位中医可以在 cursor 和 vscode 的插件商店直接安装😅;(后面出教程)

10、UI 类 bug 或者说界面丑的问题,不要上来改细节,先可以尝试让cursor 用某种设计风格,比如苹果的设计风格,google 的设计风格优化界面;

其次也可以把好看的网页截图发它参考,如下图👇👇👇就是我截图 cursor 官网,让它模仿做一个网页,虽然没有完全复制,但审美在线;

UI 细节问题比如字体大小,对齐问题,也最好截图给它看,让它修改。
用 Cursor 10 分钟写一个 AI 本地应用_哔哩哔哩_bilibili

附上前一条动态的操作视频🤭-“cursor 真的……今天处理采访音频懒得去一刀一刀剪了,直接告诉cursor写个程序把一个音频按照说话者分成多个不同的音频。一下就写好了,跑起来有点慢,我再说基于 Mac M 芯片优化下,立马又用上了 mps,一分钟就搞定了整个任务😭
给 ComfyCommunity 开发了一个主页。

主页地址:https://comfycommunity.com

开发内容包含了:导航栏、底部问卷跳转、跳舞的猫、游动的鱼、随机放的烟花。

并且适配了手机端!!!

设计 feat with @Simon阿文
开发 feat with @nhciao & Cursor

Invalid media: video
跟朋友聊起这代创业的AI公司
一个共同的特点是,高管里面基本没有懂产品的
离谱,被 Perplexity CEO 关注了
🤖 通用的愿景 VS 专用的现在
我快速看了下参展名录,新一波人形/通用机器人里,好像只看到宇树和钛虎。

再之前的协作机器人(也以通用机器人为目标):非夕、思灵(带着去年收的德国公司 Franka 一起)、艾利特等会在,它们以前也去。
Anthropic 发布了一种可以大幅增加 RAG 检索准确性的方案。

Contextual Retrieval embeddings + contextual BM25,检索失败几率降低 49%。

主要方法是:

使用 Claude 为每个文本片段生成上下文。具体做法是将文本片段和整个文档一起输入给 Claude。

在进行嵌入 处理之前,先将生成的上下文添加到每个文本片段的前面。

在检索步骤中,结合使用上下文嵌入和上下文 BM25 技术。

需要配合提示缓存来使用,不然会消耗大量 Token。

详细信息:https://www.anthropic.com/news/contextual-retrieval
这两天用Cursor从0起步搭了个带AI助手的内容站练练手。

是个代码学习的网站,在这个明明AI可以写所有代码的节点做这个事,是因为很多0基础的新手对编程语言毫无认知的情况下,对代码是充满恐惧感的,没有信息展示在他们面前他们也不知道该如何开始,问哪些问题。

除了不同编程语言的教程文章外,主要是带了个AI功能,你在任何页面启动对话,不需要表述上下文背景,AI助手就知道你问的是相关语言相关阶段的问题。语言风格会比教程内容更简单易理解。

欢迎体验:https://www.coderwithai.top/
已开源:https://github.com/alchaincyf/CoderWithAI
Back to Top