关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
如果 Gemini 3 在今天发布
Google 将会绝杀称王
OpenAI 这个造假问题有点严重啊
除了那个很离谱的 52.8>69.1 的问题
有人发现他们的 SWE-bench 少跑了23道题
如果算上这部分,其实 GPT5 还不如 Claude 4 sonnet
那为什么不跑这23道题呢?
GPT-5 这篇写的还挺不错的欸
我想,他大约忘了,作文原是自己要说的话,叫机器代说,不过是借了别人的嘴,日久天长,怕连舌头也会缩起来的。
聪明的人造了工具,糊涂的人拜它为神。
我怕我们正站在祭坛前,脸上带着愉快的笑。
GPT5 初评总结:
1. 最强最认真的全栈工程师,水平很高,改bug认真,不会乱改一气,前端审美和代码能力不如 Claude
2. 幻觉很低,医疗健康类可信度高,代码靠谱
3. 写作能力严重下降,情商下降,难道是智商提升的代价?
4.长上下文精细度很高,这点其实很重要
5. 价格很低,Claude 什么时候降价?
最近收到最多的反馈:你们的幻觉真低

既能有增量信息创作能力又能保持低幻觉

这背后默默的技术积累还是能被用户感知到的

酒香不怕巷子深,竟然是真的?
8 月 10 日(周日)下午 在北京世界机器人大会 欢迎面即🤖

我不是展商(xs)
小红书运营11个月,终于达到万粉,总收入 19425元。

虽然小红书粉丝没什么用吧,但确实是说明终于融入了社区、找到了感觉。

运营小红书也确实有一些方法论,特别是最近,终于找到了多快好省的方法,涨粉速度飞快,也没什么成本。

其实明眼人只要稍微观察一下我的小红书账号,就能明白我的方法是什么,不过我还是把方法直接分享给大家:

1. 原则,小红书是个社区,社区最需要的不是信息,而是讨论和情绪,发布能引起情绪共鸣的内容是社区最喜欢的

2. 内容形态,个人体感图文稳定一些,也比较简单,封面极其重要,是双列内容社区的核心,封面必须3:4比例

3. 内容源,你的X内容,截屏,就是最好的内容源,大道至简,多快好省

4. 粉丝不重要,完全交给推荐算法,就靠内容本身的点击率、互动率

5. 官方运营,小红书也不是光靠算法,里面有很多人在运营,请和运营保持良好的沟通,很有帮助

6. 变现,蒲公英废了,MCN 除了虚实传媒,其他都疯了,返点到50%非常离谱,总体商业价值不如公众号,但胜在简单一些,也不依赖粉丝,主要靠内容网感,有好内容就是王道。

基本就是这些了,更多的可以观察下我最近的20条,经验都在里面了。
最近我很关注机器人,看完王兴兴宇树的万字访谈,对话祥峰投资郑俊聪,我总结了3点收获:

收获一:四足机器人和双足机器人各有优势

王兴兴和我们大小马之前嘉宾傅盛和哲伦班长的观点类似:非人形机器人更快进入人类家庭生活。

虽然现在双足的人形机器人更火,但很可能会更晚进入家庭,原因有3点:

原因1、大家对人形机器人期待更高,因为更像人,稍微出错大家容忍度比较低。

如果是四足机器人,更像猫猫狗狗,只要有些一定的智能和功能大家就愿意接受,参考扫地机器人。

原因2、人形机器人一旦出错,重心高后果更严重,而四足机器人明显更稳。

原因3、人形机器人容易出现恐怖谷效应,可能有伦理问题。

当然,王兴兴也在访谈中提到,随着技术进步,这些问题都可能被解决掉。事实上,大模型出来之后,他迅速意识到双足的机会来了,并推出了双足机器人!

宇树从刚成立就专注机器人上,当时这个赛道并不热,而祥峰投资从5年前,也就是宇树早期2020年Pre-A+轮和2024年C轮都投资了宇树,最近宇树快上市,眼光不错,希望之后有机会邀请祥峰郑俊聪总来大小马播客聊聊。

收获二:宇树像10年前的大疆?

这个类比很有意思,早年我第一份工作:2014年在互联网公司战投部,其中一项工作就是看无人机赛道。

当时我们把市面上所有能买到的无人机都深度测试了一遍:大疆、零度、亿航等等,当时我明显感觉:虽然都叫无人机,但体验差别是非常大的,只有大疆稳定性最好,最靠谱。

10多年过去了,无人机赛道上大疆遥遥领先,几乎没对手。

当时的无人机,确实很像现在的机器人:你很容易就能撺出来一个机器人,但要想做出稳定靠谱的机器人,且软硬件配合好,再结合人工智能,真帮消费者解决问题,那是难上加难。

近期我们也会把市面上能买到的消费机器人买来深度体验,感兴趣可以关注我。

收获三:宇树“农村包围城市”?

5年前波士顿动力的机器人最火,当时王兴兴就表示:宇树要“农村包围城市”,做低成本、高可靠性和实用性的机器人,先满足一些简单的、客户能接受的市场点。

创业最怕做“大而全”,王兴兴还说到一个观点很有意思:

“做产品很多时候追求的是:抓住客户愿意买单的核心需求点就行,“够用”。其他很多方面能省则省、能简化就简化。就像手机,要是把电池容量做得特别大,结果手机又大又重,客户并不买账,而且成本也会很高。所以很多时候,不是追求个别部分的最优,而是要追求整体最优。”

这话我很赞同,但如果这话放到汽车行业,又会有很多头脑简单的人喷“鸡贼”了,这种人明显不懂商业。

做产品、做公司和做投资,很多时候是“取舍”的艺术:不做什么,比做什么更重要。

推荐原文:http://t.cn/A6FkmZBs
Anthropic 和吴恩达公司一起出的 Claude Code 教程

可以搭配前几天的 Claude Code 最佳实践一起食用,详细的内容有:

协调多个 Claude 子 Agent 同时处理代码库的不同部分

在 GitHub 问题中标记 Claude,并让它自主创建、审查和合并拉取请求

将杂乱的 Jupyter 笔记本转变为干净、可用于生产的仪表板

使用 Playwright 等 MCP 工具,这样 Claude 就能发现你的 UI 出了什么问题,并自主修复它

课程地址:https://learn.deeplearning.ai/courses/claude-code-a-highly-agentic-coding-assistant/lesson/66b35/introduction
AI探索指南
今天尝试分析了一下目前整个AI 图像和视频内容创作者面临“富饶中的贫困”的问题,顺便看看即梦是如何解决的。#ai创造营# 另外很多朋友问如何才能成为即梦这类 AI 工具的超创,这次终于有一个明确的成长计划了 即梦 AI 创作者成长计划加入后可以获得最高每条 2 万积分+每周每人最多 2000 元的现金激励。 填我的邀请码会优先审核 我们目前的图像视频模型能力已经完全具备了产出优秀作品和内容的能力 只是由于在产品能力整合和创作者生态培养上存在的问题,导致看起来整个行业进入了一个瓶颈。 目前整个AI…
从最开始只有视频和图像工具,到现在支持 图像生成、视频生成、唇形同步、音效生成、视频图像超分、故事 Agent 等功能,视频和图像模型都在头部,还有即梦 Action 和 AI 音效唇形同步等工具,几乎覆盖了全链路AI 内容生产的需要。

而且在内容生态上即梦应该是这些平台中最关注的一个了,无论是在在产品上还是在产品之外。

产品上即梦的首页探索页面是所有同类产品最成功和活跃度最高的,我现在几乎每天都会来看看,每次都会发现非常优秀的作品,可以一直给我惊喜,作品的发布链路和探索页面的结合流程非常的顺畅,而且一直有各种活动引导大家去发布内容。

在产品之外的创作者生态方面。

即梦对于创作者和超级创作者的扶持也超级给力,除了即梦本身的积分支持外,还会有剪映之类的这种辅助工具的支持,而且创作者可以在发现页面相互启发和交流,极大的丰富了平台的内容生态。

他们也会帮我们这种创作者对接一些资源,跟创作者一起探索变现路径。

以前很多朋友也咨询我怎么样才能成为这些平台的超级创作者享受一些权益,我都没办法回答。

因为整个行业这方面的成长路径都不太透明,看起来就是大家只想要大牛,但是不想培养大牛。

即梦这次要跳出来改变这个现状,最近他们更是扩大了对于创作者的扶持力度,推出创作者成长计划,一步步帮有潜力有天赋的创作者成长为超级创作者。

整个计划分为潜力新星、进阶探索和超创三部分,详细的每个等级的权益和扶持内容可以看图里的部分。

介绍一下整个计划的特色:

分层激励,权益精准匹配:整体覆盖了潜力信息、进阶创作者和超级创作者三个主要的成长路径,从最基础的积分等创作激励到顶级的资源倾斜都有,完全覆盖了从创作-成长-突破的闭环。

多维度的收益激励叠加:主要的激励措施包括了积分奖励(最高每条 2 万积分)、流量扶持(多平台都有+现金(最高2000元每人每周))、生态资源(商单、展映、模型提前测试),不止关注收益还关注你的影响力。

稀缺资源对接:除了这些常见的平台奖励外,创作者成长计划还有字节整个体系提供的各种稀缺和高价值资源,比如国际影节、字节系商单等平时几乎不可能接触到的资源。

全类型创作覆盖:这次的成长计划面向了全类型创作者,视频和平面图片创作者都可以参加,改变了行业上重视频轻平面的问题。

扫描下面二维码直接报名。(使用邀请码【1001】可优先审核,但请记住:比快速通过更重要的,是你终于决定让世界看见你的那一刻。)

内容到这里就结束了,我是歸藏欢迎加入即梦 AI创作者成长计划,希望不久的将来能在超创群看到各位。
今天尝试分析了一下目前整个AI 图像和视频内容创作者面临“富饶中的贫困”的问题,顺便看看即梦是如何解决的。#ai创造营#

另外很多朋友问如何才能成为即梦这类 AI 工具的超创,这次终于有一个明确的成长计划了

即梦 AI 创作者成长计划加入后可以获得最高每条 2 万积分+每周每人最多 2000 元的现金激励。

填我的邀请码会优先审核

我们目前的图像视频模型能力已经完全具备了产出优秀作品和内容的能力
只是由于在产品能力整合和创作者生态培养上存在的问题,导致看起来整个行业进入了一个瓶颈。

目前整个AI 图像和视频内容创作者面临“富饶中的贫困”,主要问题是:工具多、门槛高、创作容易变现难,产出作品容易成长难。

首先是技术门槛和创作自由的矛盾:
AI 产品虽然一直能力在进步,但是依然非常技术化,而且跟原有的内容创作方法和逻辑有区别,创作者需要掌握剪辑特效等原有的内容创作工具也需要掌握即梦这些生成工具的提示词书写等,上限高下限也低。

内容价值和商业变现的脱节:
虽然有前面那些问题,AI 还是事实性的降低的优质内容的创作门槛,依然有很多优秀的创作者做了很多优秀的作品,但优质的AI 作品缺乏曝光渠道,现有的内容平台要么打压要么有原创保护等问题,没有系统的成长路径指引和资源对接,导致曝光又难以变为收入,严重打压优秀创作者创作热情。

创作生态碎片化:
一个作品的完成需要用到多种工具,分布在不同的平台,相对来说,即梦算是发展的不错,几乎集合了所有AI 内容创作的相关工具,剩下的也可以用剪映补齐。但整体来说,AI领域的创作生态还是很碎片化。体感上来说,就是模型、产品上的能力上已经很好了,但是反而我这两年见过的很多能做出优秀作品的创作者慢慢没声音了

AI 图像视频模型产品上的能力上已经很好了,但是反而我这两年见到很多能做出优秀作品的创作者慢慢没声音了。

从行业发展的角度来说,在 AI 创作者的成长、扶持乃至变现上,需要平台做的更多。现在的创作者不仅需要工具,更需要成长平台。

我盘了下,发现注意到这些问题并且在积极解决的就只有即梦了,我们看下他们是怎么做的。

作为前年就成为即梦超级创作者的我几乎见证了即梦这两年的发展。
Anthropic 和吴恩达公司一起出的 Claude Code 教程#ai创造营#

可以搭配前几天的 Claude Code 最佳实践一起食用,详细的内容有:

协调多个 Claude 子 Agent 同时处理代码库的不同部分

在 GitHub 问题中标记 Claude,并让它自主创建、审查和合并拉取请求

将杂乱的 Jupyter 笔记本转变为干净、可用于生产的仪表板

使用 Playwright 等 MCP 工具,这样 Claude 就能发现你的 UI 出了什么问题,并自主修复它

课程地址:learn.deeplearning.ai/courses/claude-code-a-highly-agentic-coding-assistant/lesson/66b35/introduction
今天我们的新产品 FlowSpeech 正式发布
FlowSpeech 是全球第一个书面语转口语的 TTS
可以读网页,可以念小说,可以讲PPT,还能翻译外语。
它是你的 AI 嘴替,随时替你说话。

这听起来非常不炸裂,但它却是基于我们真实的用户的真实痛点所做的有用的小产品。
为什么在行业都在吹概念,追模型,卷 Agent 的时候,
我们选择花一点时间做一个这样的小产品呢?
作为 AI 应用公司,我们当然希望自己成为天空中的独角兽。
但做产品的本质,是帮助一个个真实的人。
FlowSpeech 的需求来自一位80岁的美国老人,这是他的故事。

ListenHub 在 5 月上线后,我们很快有了一万的注册用户。
在所有的用户中,年龄最大的一位,是一位美国老人。

有一天他在网上看到了 ListenHub,但是不太会用我们的软件,就写邮件问我,有没有使用教程。
我当时第一反应是,我从未想过给 ListenHub 写教程,因为它太简单了。

在 AI 圈子里都觉得过于简单的产品,在大众眼里依然是复杂得无从下手。

于是我回复他的邮件说:我们目前还没有教程,但是这就写,写好了发给您。
我立即打开 Notion,写下了一份最简单的教程,然后发给了这位美国老人。
他看完教程,终于把 ListenHub 用了起来。
后来我们邮件又往来了数次,我也逐渐了解到他的故事。

他在 1957 年参军,今年应该已经有 80 多岁了。
长期的肺纤维化疾病和数次的中风,已经让他失去了说话的能力。
但这并没有打垮他,他组建了一个数万人的线上病友社区。
他把 ListenHub 当作自己嘴替,用 AI 生成播客内容,在社区里输出,帮助病友。

播客很好,也只是万千表达方式中的一种。
我们希望我们的用户能够自由自在地用声音表达。
于是我们决定做一个通用的 AI 嘴替,可以读网页,可以念小说,可以讲PPT,还能翻译外语。‘

让你的 AI 嘴替,随时替你说话。
这就是 FlowSpeech 的缘起。

FlowSpeech 如何使用?
直接在浏览器访问 http://ListenHub.ai 即可在网页内直接使用。

iOS 下载:在 App Store 搜索 ListenHub 即可下载,FlowSpeech 会在下周上线到 App 里。

安卓下载:紧张开发中,即将上线。

还有…API 吗?

很多朋友问我们,ListenHub 里的声音,能不能做成 API,接到自己的产品里?

对,我们即将推出 FlowSpeech 的 TTS API 服务,敬请期待。

Invalid media: video
GPT-5 的相关信息已经加入到了代码库里面做好发布准备了,Pro 会员可以用 GPT-5 Pro 的模型#ai创造营#

- 免费:访问我们的旗舰模型 GPT-5
- Plus:访问具备高级推理能力的 GPT-5
- Pro:访问 GPT-5 pro,使用更多计算资源以提供对最难问题的最佳答案
Back to Top