关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
AI降本增效,一开始最好简单粗暴。

差生文具多,如果要做优等生,先得抛弃对工具无休止的追逐。

哪怕是AI博主,也应该回归基本,主动熵减,把日常使用的AI工具控制在 20个以内。

我的工作场景主要围绕AI职场办公,智能体开发和媒体制作。如果按付费意愿,真正会坚持用的会有以下几个:(无广)

1.主力AI模型
GPT+Claude
平替:豆包+文小言(移动版)+kimi
GPT越来越有被Claude替代的趋势,尤其是代码。但是GPTs还是增强了我的使用粘性。豆包的TTS语音国内无法被替代。文小言有一些我喜欢的功能,比如信息聚合订阅。

2.主力IM
飞书
平替:Notion+企微
我知道Notion很强。但是鉴于复杂的操作+国内网络不稳定+数据安全是真不太喜欢用。
创业以来我觉得最值得投入学习时间的并不是任何一款AI软件,而是飞书本身。好的SaaS就是最佳实践的产品化。企微是出于私域+客户对公不得不用。

3.数据分析
Excel+GPT+各平台数据看板
平替:飞书多维表单
Excel没有平替。AI只是帮我解锁高阶功能,比如VBA和宏。多维表单的插件生态值得投入时间学习。

4.设计
Midjourney+ideagram
平替:Canvas+稿定设计+佐糖
比起Mj,Ideagram的出图更具场景感,配合简单工具出海报+商图+封面+运营位都很方便。

5.PPT
PPT+islide插件+彩璇PPT
平替:Gamma,aippt
目前没有同时满足不要钱、支持定制模板、不科学上网、智能还可控性强的方案。但是PPT+islide已经增效超过50%。Gamma是应急神器。
彩璇PPT比较小众,是一个方便做课件分享+编辑的平台,对咨询师/老师有刚需。

6.剪辑
剪映(含AI)+即梦AI
初学者够用,为了省事就用字节系的。

7.文本创作
飞书文档+flomo+GPT
平替:记事本
简单点好。如果开发一个支持flomo api导出直接AI生成标题/思路/文章大纲的工作流会不会有需求?

8.智能体开发
Coze/Dify
平替:百度智能体
目前还在钻研工作流场景。已经做了20多个Bot。Coze/Dify各有千秋,百度则是打通了支付环节和数字人形象的交互。待继续钻研好和大家分享。

9.代码辅助
Cursor+Claude
平替:字节豆包Marscode

10.工作流编排
Coze+飞书+各类Github(开源项目)
通过飞书机器人平台把各类BOT接入到飞书群里。实现在IM办公软件中使用自己调试过的AI数字员工。

#AI工作流
prompt:逻辑之刃

扔进一篇文章,直接抽骨架出来

https://mp.weixin.qq.com/s/IFHOJfP3V7TM865inhKWvA
收到了中国美术学院彩虹闪闪的领航员证书!
手搓机器人第三版
马上要出咧(你是瞅啥?瞅你咋滴)

项目逐步从兴趣共学转化往科创与商业化落地

核心是控制成本与迭代创新
10月还没结束,国产AI就在投流上杀疯了

10月还没结束,部分国产AI就在投流上杀疯了。比如,Kimi10月投放量飙升,20天投出1个多亿,接近整个Q3的总和。

而在巨量的投放金额之下,部分AI自媒体已接满了商单,成为本轮AI浪潮中少数「真正赚到钱」的AI创业者。

通过深扒12家国产AI150+投流素材,我们初步发现了AI自媒体们的“掘金密码”。

下面是调研出来的“非共识”:

1、Kimi主攻渠道,已经不是我们印象中的B站信息流,而是字节系的穿山甲

2、2024年的国产AI,更像是披上AI外皮的教培。

虽然各家主打功能和目标用户都有所侧重,但教育始终是各产品的重点布局方向。

3、对国产AI 来讲,或许哪里有“求上岸”,哪里就有增量人群

4、如果普通人要学某款AI,最好的办法就是看数据最好的几个广告。

它们比常规教程更赏心悦目,他们比极客的分享更通俗易懂。而且,看完之后我们的网感也会更上一层楼。

更多详情,见链接:
Kimi一个季度花了一亿多买流量…😅现阶段没有什么用户忠诚度可言,纯粹是教育市场和烧钱了呀…
而Kimi App+Web差不多32M的MAU,豆包在60M左右

资料分别来自:公众号瑞琦和杨昌,由App growing统计;AI产品榜
重磅,敏神更新了 Flux 版 ic-light 模型。

可以:自动抠像、利用 flux 能力生成准确的背景、自动匹配光影合成,生成新的图片。

能想到对肖像、电商、美术等行业都会有很大帮助。我自己试了下除了人像以外,product id 也保存得不错。

试用地址:huggingface.co/spaces/lllyasviel/iclight-v2

项目地址:github.com/lllyasviel/IC-Light/discussions/98
Clone的《西部世界》第一集开始 |CyberRobo

人类能制造工具这一能力估计是其他什么文明的科技发展里程碑。
清华黑客松第三名!周五参加声网大会时突然想到这个idea,周六中午开始开发,一天时间build一个多模态ios应用,队友起的“智图ai”这个名字我也很喜欢。

-初衷是参会时发现所有人都在举着手机拍ppt,突然想到我相册里有超过一半是ppt照片、但却几乎没有再看过。没有删掉、是因为觉得哪天会再看,没有再看、是因为查看相册的效率太低了。

-所以做一个图像理解将ppt照片里的信息结构化提取、便于查阅回顾、甚至再进一步进行知识管理,似乎是客观存在的刚需。

-今天中午开发完后,刚好@orange.ai 橘子老师来分享干货认知,于是就边听分享、边把ppt随手用app拍下来,然后自动提取信息、自动生成总结和思维导图,一切都是丝滑交互、几乎无感。

-橘子老师的分享非常棒、长达20来页,可称ai产品顶级认知。不过我只保留了其中5页分享给大家看,想听完整分享还是要去找橘子老师哈哈。

-有幸获得第三名,运气非常好!感谢主办方和评委,更感谢后端+prompt开发的队友、感谢产品建议+做ppt的队友!

-第一次参加黑客松,并且是以产品+前端开发的角色,也是更加意识到组建一支团队的意义。

这个产品方向确实挺有意思、并且还有一些新功能计划加上,虽然还没想好在做ai播客项目之余、如何推进这个项目,仍然诚邀对这个方向感兴趣的技术开发同学联系我、前端/后端/模型侧都可,也欢迎产品和市场(尤其出海)的同学联系我,大家一起开发出更多ai时代的好应用!
请指出为什么这张图是AI生成的。
手搓机器人成长记—基于Arduino的桌面机器人,简化版Looi_哔哩哔哩_bilibili

终于突破了人脸识别跟踪了,从rust的 opencv,到 node的opencv,分类器,又换了tensorflow,一路下来换了10几个方案,最后用了face-ip算是暂时解决了。

很难得的是,克制了自己想要直接动手改代码的冲动,全程AI辅助完成了。
Mac 上最顺手的翻译和OCR软件大更新。
支持了一大波各种大模型 API。
同时智谱还赞助了一个免费的 API,开箱即用,善莫大焉。
独立开发者和大模型公司的这种合作还是很好的,各取所需。
大模型生产力绘图,来了!
全文:https://mp.weixin.qq.com/s/bJbZ9bwPXxlpyREqLKhDvA
下面这些图,都是Claude这类大模型帮我绘制

内容涵盖海报,PPT,思维导图,中国水墨风画,名片,游戏界面,物体 等等

AI 大模型尽管不是为制作图片而生,但是绘图能力现在也出奇的好。

相比mj, sd 这些生图方法,大模型制图能够真正意义上制作 海报,架构图,思维导图,流程图等生产力绘图,具备巨大的优势。

同时,在简笔画,留白大写意这种作品上,也有着出奇的表现。

我花了两天的时间探索大模型绘图的各种可能,按之前的习惯,写成了系统论述文章发布。

目前来看,大模型理解能力已经很好,输出的上下文会是一个不小的限制。如果输出的上下文能够更长,一句话生成一个复杂的app,一个PPT,都是可以的,这也是轻易可预见的未来!

和AI的成长性相比,人类还是太渺小了
Back to Top