关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
AIGC 领域的最新工具、开源项目以及行业大事件
为什么文心一言被豆包超过了?
最近字节豆包的下载量、日活、留存已超文心一言。
但百度的同学一提到这就说豆包的模型不如文心。
当然我是认可模型层面豆包是不如文心的,
那为什么从数据层面上看文心的数据不如豆包呢。
人际沟通有个法则叫麦拉宾55-38-7法则。
人际沟通中他人对你的第一印象主要来源于三个方面:
55%来源于外表、打扮;
38%来源于说话的语气、情绪、口吻;
7%才是说话的内容。
对应到chatbot产品上,则是:
外表=产品交互设计、易用性;
语气=TTS的自然度、情绪、对话文字的口吻;
内容=大模型生成的文字。
不可否认,文心一言的模型确实要比豆包强,
但这也仅仅只占了用户体验7%,
而占用户体验大头的交互设计、TTS、口语化程度却远不如豆包。
因此,百度的同学是不是该反思自己的数据为什么不如别人?
而不是天天把模型当成遮羞布安慰自己没有完全输。
最近字节豆包的下载量、日活、留存已超文心一言。
但百度的同学一提到这就说豆包的模型不如文心。
当然我是认可模型层面豆包是不如文心的,
那为什么从数据层面上看文心的数据不如豆包呢。
人际沟通有个法则叫麦拉宾55-38-7法则。
人际沟通中他人对你的第一印象主要来源于三个方面:
55%来源于外表、打扮;
38%来源于说话的语气、情绪、口吻;
7%才是说话的内容。
对应到chatbot产品上,则是:
外表=产品交互设计、易用性;
语气=TTS的自然度、情绪、对话文字的口吻;
内容=大模型生成的文字。
不可否认,文心一言的模型确实要比豆包强,
但这也仅仅只占了用户体验7%,
而占用户体验大头的交互设计、TTS、口语化程度却远不如豆包。
因此,百度的同学是不是该反思自己的数据为什么不如别人?
而不是天天把模型当成遮羞布安慰自己没有完全输。
人形公司一旦发布新产品,总要播放一段VCR,视频里的机器人颤颤巍巍、如履薄冰,还没走几步,就轮到一个通常戴眼镜穿牛仔裤的理工男登场,上来就是对机器人一顿拳打脚踢。
机器人心胸宽广,无论怎么踹,都顽强站稳,继续走他的路,继续颤颤巍巍、如履薄冰。
这些机器人公司的每一次路演,都放佛是对机器人的公开处刑,令人很是同情。
机器人心胸宽广,无论怎么踹,都顽强站稳,继续走他的路,继续颤颤巍巍、如履薄冰。
这些机器人公司的每一次路演,都放佛是对机器人的公开处刑,令人很是同情。
这几天Kimi突然在二级市场火了,做二级市场的朋友也开始跟我打听,“Kimi真的很厉害吗?区别在哪里”。
我蛮惊讶的,但不是很意外。
一直以来,无论是chatgpt还是sora两波浪潮,中国AI环境里各种要素有一种“弱者思维”:OpenAI做了,你为什么不做?/OpenAI都没做,你为什么要做?
这样的环境体现在中国AI创始人身上就是不太“敢”或是“能”去做创新的技术战略。在技术路线分散的时候,为一项技术路线赢取支持是一件太难的事情。大家都避免去“赌”。
比如sora赛道的几家中国公司,其实在Sora破圈前就已经自研出了类sora的架构-- diffusion transformer(U- ViT,CVPR2023)。
但是为什么直到sora出现之后,“长视频”这个点才引起了大家的追逐?
因为即使是在已知架构可以带来提升的前提下,“把视频长度做长”这件事在当时仍然是风险远远大于收益的一件事,谁也不知道60秒的视频生成会不会引起全民关注,进而给公司能带来多少资源以支撑自己进一步做下去。
但今天我们看到了什么?
虽然长文本在研究领域一直是比较热的话题,但在工业界,就像sora爆发前的“长视频”一样,大家都觉得这是一个“重要但不紧急”的事项。
去年十月份,月之暗面率先对外介绍自己的“长文本”战略,并且在机器之心独家详细解释了“为什么长文本是重要的”背后逻辑。
在Kimi指数狂扫A股的时候,百度、阿里、360开始紧急上线自己的“长文本”能力。
系统化的战略认知能为一个人带来战略眼光,坚定并真实的信念感能为一个人吸引到同频的支持者,脚踏实地的快速迭代能为一个人时刻校准方向。所有的一切形成了一种不偏不倚的理性勇气,勇气带来了创新,创新带来了领导者地位。
某种角度看,月之暗面已经成为中国的OpenAI。
我蛮惊讶的,但不是很意外。
一直以来,无论是chatgpt还是sora两波浪潮,中国AI环境里各种要素有一种“弱者思维”:OpenAI做了,你为什么不做?/OpenAI都没做,你为什么要做?
这样的环境体现在中国AI创始人身上就是不太“敢”或是“能”去做创新的技术战略。在技术路线分散的时候,为一项技术路线赢取支持是一件太难的事情。大家都避免去“赌”。
比如sora赛道的几家中国公司,其实在Sora破圈前就已经自研出了类sora的架构-- diffusion transformer(U- ViT,CVPR2023)。
但是为什么直到sora出现之后,“长视频”这个点才引起了大家的追逐?
因为即使是在已知架构可以带来提升的前提下,“把视频长度做长”这件事在当时仍然是风险远远大于收益的一件事,谁也不知道60秒的视频生成会不会引起全民关注,进而给公司能带来多少资源以支撑自己进一步做下去。
但今天我们看到了什么?
虽然长文本在研究领域一直是比较热的话题,但在工业界,就像sora爆发前的“长视频”一样,大家都觉得这是一个“重要但不紧急”的事项。
去年十月份,月之暗面率先对外介绍自己的“长文本”战略,并且在机器之心独家详细解释了“为什么长文本是重要的”背后逻辑。
在Kimi指数狂扫A股的时候,百度、阿里、360开始紧急上线自己的“长文本”能力。
系统化的战略认知能为一个人带来战略眼光,坚定并真实的信念感能为一个人吸引到同频的支持者,脚踏实地的快速迭代能为一个人时刻校准方向。所有的一切形成了一种不偏不倚的理性勇气,勇气带来了创新,创新带来了领导者地位。
某种角度看,月之暗面已经成为中国的OpenAI。