关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
迭代了一个图像生成提示词扩展的提示词

试了一下效果不错,如果你也不知道怎么写复杂提示词或者脑子里没画面可以试试。

对 FLUX 这类不自带提示词扩写的 DiT 模型尤其管用。

右边图片的原始提示词为:简洁广告片,人像摄影,中国女性。
救命,有没有朋友能做个URL to Summary Card的产品啊

类似下面这种推特卡片,但能自定义尺寸;元素包括品牌名,Logo,Tagline,功能介绍和网址,最好还带Open Graph

早期两个功能:介绍整个网站/品牌的homepage to card和具体功能的website to card

理论上每个page都能生成一张名片,这市场不比link in bio工具还大啊;域名都想好了,早期叫twittercard.ai起量,之后扩大用户群体改成businesscard.ai,最后换品牌域名charta.ai
Ideogram 2.0 这个排版能力真的拉满了。

我自定义了色板和每部分的标题内容,生成的酒店官网。
技术小白入门大模型微调,原来如此简单~

我和wildcard的客服人员,都挺有耐心的。我们一共换了3个卡号,换了3个 OpenAI 账号,花了两天时间。终于,充了 10 美元。

不过这些都不重要,重要的是,在等的过程中,我先用智谱glm-4-flash 微调了一下。

1、

才放了不到2000条的B站评论数据集,效果就已经比较明显了(图一)。

还是感谢GPT-4o mini 微调的免费,让我知道技术小白也是可以自己微调大模型的;

感谢智谱AI大模型开放平台,注册就送了10 多块钱的额度。才花了3块7毛钱的额度,训了不到 10 分钟,模型就微调好了(图二)。

2、

之前我一直以为微调的门槛老高了,直到今天测完才发现,真的是有手就行,有数据就行,比填写在线表格还简单。

唯一难的地方,可能在于数据集的获取和梳理。因为是测试,我就在网上找了别人的数据集。

印象中质量最高的,是UP主林亦的“AI哔友”,所以我找到了该项目的 GitHub(图三),直接把几个数据集给下下来了。

感兴趣的话,也可以从这里扒:https://github.com/linyiLYi/bilibot/blob/main/data/test.jsonl

3、

不过,林亦代码的格式,跟 OpenAI 和智谱要去的不一样。

于是我就用 Excel 的公式,把里面的数据给提取了出来(图四)。接着,再用 Excel 的公式,组装成符合要求的格式。

这些公式,我也是拿着代码让 Claude 帮忙写的,没有一次性成功,重新让它一步一步来才改好。

4、

为什么一定要提这一档子,是因为我发现:

只要会和AI 一起用 Excel,那么市面上很多的数据集,都可以为我所用,完全不用自己一条一条去爬。

举个例子,之前很多群友跟我说,他们做 SEO 时候,总觉得AI 生成内容机器味儿过浓。

那么这个时候,他们就可以用别人抓取reads.alibaba.com 网站上13个分类领域3000+个页面形成的数据集:https://github.com/Tim-Saijun/industry-article-dataset/blob/main/all_filter_2120.jsonl

———

流量玩家学会微调之后,“找-抄-超”又能更快一步了。

最近,我还发现了篇中国科学院大学AI 生成小说的论文,据说效果已经接近人类写手的水平。
在人潮涌动的世界机器人大会上,我们看到了“万亿美金”的新起点 |【经纬低调研究】

今年,人形机器人是最热的赛道之一,总结浓缩了多位创始人有意思的话:1、“机器人的软硬一体非常重要”(今年和明年是不同技术路线、不同应用场景“八仙过海各显神通”的一年);2、“大部分人对社会的成本结构一无所知”(太多优秀的人长于软件,但机器人需要硬件,这是一个互相融合的系统,这也是中国供应链的优势);3、“人形机器人比自动驾驶更缺数据”(如果数据无法突破,人形机器人也很难真正突破,真机数据、仿真数据如火如荼,整个机器人赛道都饥不可耐地想吃下更多数据)
在无人的角落发表一些关于机器人的想法:
机器人领域第一原则:视频都是假的。
能后空翻的,一定不会只演示走路;
能走得稳的,一定不会站着;
能站起来的,一定不会坐着给你写诗;
能坐着的,也不用吊绳给你撑着;
但凡能真的带点AI的,就不会反复重复同一个动作,分毫不差。

综上,确实还没有能打的
Back to Top