关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
好奇一个技术问题:现在各家的「联网搜索」都是用的什么引擎?都是自建的爬虫系统,还是有一些公开的引擎调用?
我去,Deepseek 看来是搞到卡了!

目前所有服务全部恢复正常

而且开启晚上 12 点到早上八点时段的消耗优惠

V3 半价,R1 7.5 折

同时重新打开了 API 充值,冲啊朋友们
AI探索指南
🌶,藏师傅的顶级 AI 白嫖指南 一个能够低成本使用各种顶尖模型,同时支持完善的搜索能力,还不用担心封号和降智的方案。 主要包括: - 如何低成本甚至免费的获得各种顶尖模型 API ? - 如何将各种顶尖模型混合使用完成任务? - 如何为他们增加各种附加功能,比如 AI 搜索? 可以在这里查看:https://mp.weixin.qq.com/s/dJjtKQ4tsg23Uzoj1MPL3g 主要介绍我用的 AI 客户端 ChatWise https://chatwise.app/ ,设置非常简…
剩下的就简单了,你刚才应该已经从 AI studio 获得了创建的谷歌 Gemini 的 API Key 了。只需要在模型设置这里将 API Key 贴进去就行。

为模型接入搜索、Artifacts和推理:

ChatWise 的联网是我见过最强大最便宜的,其他的软件实现联网都需要一个模型 API 才行,他直接用你本地的浏览器搜索结果,完全免费不说用的还是谷歌的搜索结果。

首先你在聊天界面输入框这里,点击地球图标就能启用搜索。

他在搜索这里会有一些非常牛批的功能和设置,我来介绍一下。
- 首先是搜索引擎这里我们选择谷歌这里就是你本地的谷歌浏览器搜索结果不需要付费。
- 然后是用于生成搜索关键词的模型,这里我推荐火山的 Deepseek V3 上下文长,而且很便宜,Chatwise 会用这个模型帮你生成搜索词和总结网页的搜索结果,然后在把润色后的结果给你当时选择的模型参考回答。
- 然后是搜索关键词语言,我们简中互联网的信息质量大家都知道的,ChatWise 可以指定搜索的结果,比如在学术内容的搜索上只搜索英文内容。
- 最后**一个更骚的,可以屏蔽指定网站的搜索结果**,这个的好处是,比如 CSDN 这种网站 AI 是没办法读取任何信息的。然后你设置了 10 个网页的搜索上限,结果里面 6 个是 CSDN,实际上就只搜了 4 个。

只需要点击输入框叶子图标就可以自动启用 Artifacts,可以看到图面里面 Artifacts 甚至还帮我画了 mermaid 流程图。

最后一个 ChatWise 的强大功能是可以为,没有推理能力的模型加上推理能力,想要使用这个功能的话,只需要在你输入问题之前加上 @ think 就行
🌶,藏师傅的顶级 AI 白嫖指南

一个能够低成本使用各种顶尖模型,同时支持完善的搜索能力,还不用担心封号和降智的方案。

主要包括:
- 如何低成本甚至免费的获得各种顶尖模型 API ?
- 如何将各种顶尖模型混合使用完成任务?
- 如何为他们增加各种附加功能,比如 AI 搜索?

可以在这里查看:https://mp.weixin.qq.com/s/dJjtKQ4tsg23Uzoj1MPL3g

主要介绍我用的 AI 客户端 ChatWise https://chatwise.app/ ,设置非常简单而且有很多很强大的功能,尤其支持完全免费的 AI 搜索能力,而且搜索结果质量甚至比 Perplexity 还要高很多。

基础的聊天能力是免费的,搜索功能需要付费,如果你有需要,可以用藏师傅的优惠码「guizang」填写之后会有 8 折优惠。

模型白嫖方案:

主力模型是两套,分别是 DeepSeek R1 和 V3 以及 Gemini2.0 Flash Thinking。

Deepseek R1 和 V3 可以参加火山的邀请活动,直接获得 45 块钱的 Token 额度加上免费的 50 万都够用很久了。

Gemini 的话谷歌更是大方,个人使用完全可以免费,没有任何套路,你只需要去 AI studio 左上角创建一个 API 就行。

可以在 XAI 的 API 平台领取 150 美元额度,等个一两周 Grok 3 的 API 开放可以用。

另外 Elevenlabs 搞了一个赞助 AI 开发者的活动里面也有比如欧洲顶尖 AI 模型 Mistral AI 的 25 美元API 额度。

比如 Claude 3.7 和 o3-mini 这种模型,可以谷歌搜 Claude 三方 API 这种,排在前面的都不错,还不用担心封号和降智。

我一般就是在这类平台冲个 50 块钱,然后很久都用不完。

如何使用这些 API 和模型:

ChatWise 配置模型需要在软件左下角点击设置,然后进到模型设置页面,之后点击左下角的「」号,在里面找到 Volcengine。

我们只需要去火山方舟的后台找到 API Key 就行,然后点击Deepseek V3 和 R1 的开通服务。然后点击下面的 API Key 管理复制我们的 API Key 填入刚才 ChatWise 的输入框就行。
金山快译 - 金山旗下多场景的翻译服务
金山快译 金山旗下多场景的翻译服务

链接:
https://kuaiyi.wps.cn/txt-translate

#Ai工具推荐
我奶奶都看得懂的解读,关于Deepseek刚开源的DeepEP

1. DeepEP 是干嘛用的?
想象一下,你要训练一个超级大的“AI大脑”(比如 GPT 这种大模型)
这个里面有很多“小专家”(Experts),每个专家处理不同的任务
当数据传给这些专家时,需要把数据发给它们(分发),处理完后再把结果汇总(合并)
这个过程需要大量的通信,就像在各个办公室之间送文件一样
但传统的方法效率很低,经常会出现以下问题⬇️
1️⃣ 快递太慢:数据在 GPU 和网络之间来回传,浪费时间
2️⃣ 堵车:太多数据同时传输,导致网络瘫痪
3️⃣ 算力浪费:GPU 在等数据的时候干着急,没法工作
DeepEP 就像是一个超级高效的“物流公司”,专门优化这种通信过程,让数据传得更快、更不堵车,还能让 GPU 一边算一边等数据,不浪费时间

2. 它有哪些厉害的功能?
1️⃣ 超快“分拣中心”
FP8/BF16 支持:用更少的数据位数(比如 FP8 是半精度浮点数)传输,省带宽、省时间,还能保持结果基本准确
硬件直连:专门为Hopper GPU 设计,直接利用显卡内部的超高速通道(NVLink)和网卡(RDMA)传输数据,就像给快递车装上了火箭引擎🚀
2️⃣ 智能“交通调度”
虚拟车道隔离:给不同的任务(比如训练和推理)分配独立的网络通道,避免互相干扰(就像高铁和公交车走不同的轨道)
自适应路由:自动避开网络拥堵路段,但可能会稍微增加一点延迟(适合对延迟要求不高的场景)
3️⃣ 边算边传(不堵车)
零 SM 占用通信:在传输数据时,GPU 的计算单元(SM)可以继续工作,不用停下来等数据(就像你边做饭边接电话,互不打扰)
双微批重叠:把一个小批次的数据分成两次传输,中间插着计算任务,充分利用时间差

4. 性能有多牛?(举个栗子🌰
假设你要给 64 个专家(EP)分发数据:
🚲普通方法:传输速度46GB/s,延迟300us(像骑电动车送货)
✈️用DeepEP:传输速度46 GB/s,但延迟下降到了160us(相当于坐超音速飞机送货)

而且,它还能根据你的硬件环境(比如用多少 GPU、多大的网卡)自动调优,就像有个AI调度员帮你安排最优路线

这波还是在Nv上的优化,dpsk你不会真的在拉nv市值吧hhhhh
然后第五天来个大的🤣🤣🤣
Back to Top