关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
日本一家机器人公司做的月球车。机器人形态和车辆形态完美结合。挺有意思。

Invalid media: video
大语言模型走红之后,LUI(Language User Interface)或CUI(Conversational User Interface)这个概念也火了,即基于自然语言或者对话的交互方式。但在模型能力还不够强的时候,所谓LUI或者CUI就很可能变成罗永浩做锤子TNT操作系统的笑话:“回车,回车,往左一格,输入…” ,显而易见的是,语言在大多数时候下是不适合需要精确控制的交互任务的。

但是真正的LUI/CUI现实生活中已经有了,例如老板说:“小张,给我准备一个第三季度的汇报ppt,要高端大气上档次。”“看一下去年我们前十大客户是谁,做个按销售金额排序,拆分项目的表出来。”,这都是典型基于自然语言的交互(狗头

因此如果模型够强大,LUI/CUI的重点并不是interaction,而是instruction,让每个人都能过上Boss的生活。不如换个名字,叫BUI(Boss User Interface)更加符合预期。
最近我做了一个打标助手GPTs,感觉特别实用,推荐给大家!

主要功能:上传任意一张或多张图片,打标助手就会自动识别图像内容,并返回给你适用于 AI 模型训练标注的图像描述。
使用链接:https://chat.openai.com/g/g-tOuLKW5VD-label-assistant

🔸 支持一次性上传 10 张图片进行标注(图一)
🔸 识别效果上,精准度明显优于 Clip 和 Blip2 这两个打标常用的AI模型(图二)
🔸 风格兼容上,几乎没有限制(图三)
🔸 还可以结合Dalle3,根据返回的描述生成同类图(图四)

What’s Next!
因为 ChatGPT 中一次最多只能上传10张图片,且返回的标注需要手动复制,效率有限。
于是@晨然的好奇屋 和我决定把这个GPTs工具化,做一个真正可以批量打标,并批量下载标注的平台。

这两天就会发布,大家期待一下吧!( ´▽` )ノ
「用 ai解决 100个实际需求」
输入自己的系列碎片化的资料,让ai分析这些资料之间的关联性和逻辑性,提出可能的主题和结构思路。(实现效果85 分)
然后基于原始资料,以 v5最详细的标准编写一篇分析报告。报告风格要求专业、深入、有洞察力。(实现效果 70 分,可能还需要一个步骤或着 prompt 优化)。
必须赞一下小作笔记,刚更新 ai 对话卡片功能真赞,可以换头像名称,还可以挑选对话。@谢广志
#ChatGPT对话大赏 #AI工作流
🎁 现在可以免费领取 1 年 Rewind.ai Pro:http://rewind.ai/founder(不过目前 Windows 还没出)
🤔 之前其实已经卸载了,现在下载了回来。因为 Rewind 除了倒带,还可以用 GPT-4 支持的 Ask Rewind。(至少现在他们依旧是这么宣传的)
🤯 结果离谱的事情是…出现了下图。这算是 CEO 的感恩节礼物,但是…实在不好评价……

这不是幻觉的问题,GPT-4 刚刚出的时候确实有这种情况,但是现在调 API 很少遇到这种回复。更何况我早期用 Rewind AI 也是回答的 GPT-4 😮‍💨

总的来说倒带搜索功能还是可以,不过英文检索比其他语言强一些(而且要记得在设置里设置)

---

都说到这了,还有些其他产品收着 GPT-4 的费用,实际上「有可能」在混用 3.5 和 4,我不说是哪个国外的产品(我也由于其他原因没有续订),毕竟我只说「有可能」,原因在于:

如果你是一个 GPT-4 长期使用的用户,你应该明显能感受到它的「智商」。对于上述某产品,我 Chat 第一句就直接让它翻译某句话为中文,结果给我来句「我没听懂你的意思」类似的话。这样的情况还不止一次,主观感受上起码五六次(在几天之内),但是时间比较久了没截图,所以仅供参考。

🤷
Monica新版上线啦!
怀着忐忑又兴奋的心情等待各位的反馈😀
用AI帮忙做事儿遇到最大的问题是无法验证他对我未知领域的帮助是否是正确的,就像我让他帮我翻译成英语,但如果我原本就不懂英语,我要怎么验证他翻译的是对的呢?
关于翻译只是一个例子 还有很多其他case都存在无法验证的问题😵
Back to Top