关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
AIGC 领域的最新工具、开源项目以及行业大事件
蛮有意思,想感受下全自动驾驶技术,用眼看路,用脑思考跟自然生物演化历程很相似。
在寒武纪时期生物大爆发正是因为有了眼睛的出现,从单目到双目再到双目的位置,高等生物捕食者的前方有一双眼睛👀。
汽车的视觉实现方案可以移到未来机器人上面,生物体的眼睛会面临“老眼昏花”,而机器只需要更换新的摄像头升级系统就好。
机器的一双眼睛可以运用半导体制程,最终导向就是越来越小性能越强,成本也越来越低。
涵盖了机器学习系统的设计、构建、投产、优化、运转和维护工作。
详细的学习内容有:
• 机器学习基础:涵盖机器学习的基本原理和方法。
• 特征工程:探讨如何有效地处理和转换数据,以提高模型性能。
• 生产级机器学习系统:介绍如何将机器学习模型部署到生产环境中。
• 计算机视觉与自然语言处理:涉及图像和语言数据的分析和应用。
• 推荐系统:讨论如何构建个性化推荐引擎。
• MLOps:聚焦于机器学习操作的实践,包括模型的部署、监控和维护。
• TensorFlow、Google Cloud、VertexAI:介绍这些工具和平台如何支持机器学习项目的开发和部署。
课程地址:https://www.cloudskillsboost.google/paths/17
1.用你的个人微信向上一步扫码登录的小号发消息,查看你是否能收到消息;
2.如果收不到消息,进入在sealos中创建的应用,点击日志查看错误原因;
到了这里,你就拿到了一个可以在微信中对话的 AI 机器人了,后续我会再写一遍分享,说明下如何通过 工作流(Workflow) 将滴答清单、flomo、Cubox 加入到微信机器人对话中。
2.如果收不到消息,进入在sealos中创建的应用,点击日志查看错误原因;
到了这里,你就拿到了一个可以在微信中对话的 AI 机器人了,后续我会再写一遍分享,说明下如何通过 工作流(Workflow) 将滴答清单、flomo、Cubox 加入到微信机器人对话中。
今年几乎所有有KOL属性的B站up主都在开辟新能源车和AI这两块的内容,因为这两个领域的甲方在今年的投放增量最明显,新能源和AI本身的池子在扩大,另外B站也是这两类甲方没法绕开的PR阵地。
对于新能源汽车来说,这类客单价高、决策链路长的消费品,本身的购买决策偏向于理性。虽然B站现阶段很难说转化率有多高,但汽车手机这种品类的产品口碑和市场认知是在B站这个平台上形成的,这就是为什么就算大家都在说B站商业化的各类问题,但手机汽车品牌在B站投放的总预算每年一直在上升。
对AI企业来说,全中国再也找不到像B站这样,年轻人多、用户整体教育层次高、内容时长长(能相对完整地把AI企业宣传点传达出去)、对新事物接受度高、对科技有基础认知的平台了。和新能源车不太一样的是,AI大模型或者其他AI应用现阶段是完全可以在B站形成高转化的。所以不管是AI大模型,还是硬件终端产品(比如ai手机、aipc),或者是云智能产品,几乎有一个算一个,都给了B站不少预算。
综合这两个领域能看到,B站的一个优势就是“心智影响力”,也就是能够影响市场认知和消费者判断,这是B站在商业化上很重要的一个立足点和具有差异化的独特价值。另一个是数码科技等泛知识内容在B站本身具有沉淀,这个基础决定了这类投放会相对更受欢迎。
所以说B站up主商业化不行也是分情况分内容类型的,据我所知,AI/科技垂类一定体量以上的up主,在过去一年都活的还不错。2023年很多这个赛道的up主都接到了两位数的商单,今年的流水应该还会增加。
对于新能源汽车来说,这类客单价高、决策链路长的消费品,本身的购买决策偏向于理性。虽然B站现阶段很难说转化率有多高,但汽车手机这种品类的产品口碑和市场认知是在B站这个平台上形成的,这就是为什么就算大家都在说B站商业化的各类问题,但手机汽车品牌在B站投放的总预算每年一直在上升。
对AI企业来说,全中国再也找不到像B站这样,年轻人多、用户整体教育层次高、内容时长长(能相对完整地把AI企业宣传点传达出去)、对新事物接受度高、对科技有基础认知的平台了。和新能源车不太一样的是,AI大模型或者其他AI应用现阶段是完全可以在B站形成高转化的。所以不管是AI大模型,还是硬件终端产品(比如ai手机、aipc),或者是云智能产品,几乎有一个算一个,都给了B站不少预算。
综合这两个领域能看到,B站的一个优势就是“心智影响力”,也就是能够影响市场认知和消费者判断,这是B站在商业化上很重要的一个立足点和具有差异化的独特价值。另一个是数码科技等泛知识内容在B站本身具有沉淀,这个基础决定了这类投放会相对更受欢迎。
所以说B站up主商业化不行也是分情况分内容类型的,据我所知,AI/科技垂类一定体量以上的up主,在过去一年都活的还不错。2023年很多这个赛道的up主都接到了两位数的商单,今年的流水应该还会增加。
卧槽,发现一个巨牛批的 AI 视频剪辑工具,这才是完全以 AI 功能构建的视频剪辑产品。
Captions 这个产品可以自动识别超长视频的有价值判断并且自动剪辑成多条适合传播的短视频。
生成的短视频可以选择对应的字幕模板,并且支持AI 自动在对应的视频片段添加音效、贴纸等增加氛围的内容。
此外还支持AI眼神注视、AI 降噪、 AI 唇形同步、 AI 调色等一系列自动化的 AI 能力。
最重要的还是网页版本的,任何平台都能用,这要完善一点不得把剪映干稀烂?
可惜的是暂时还不支持翻译,看选项后面会有自动字幕翻译。
这里体验:https://www.captions.ai/
Captions 这个产品可以自动识别超长视频的有价值判断并且自动剪辑成多条适合传播的短视频。
生成的短视频可以选择对应的字幕模板,并且支持AI 自动在对应的视频片段添加音效、贴纸等增加氛围的内容。
此外还支持AI眼神注视、AI 降噪、 AI 唇形同步、 AI 调色等一系列自动化的 AI 能力。
最重要的还是网页版本的,任何平台都能用,这要完善一点不得把剪映干稀烂?
可惜的是暂时还不支持翻译,看选项后面会有自动字幕翻译。
这里体验:https://www.captions.ai/
简单体验了一下AI 生产力工具 Flowith,太强了。
很开心有人能对 AI 原生产品的 UI 和交互有如此深入的思考。
整个产品在生成式 UI 的探索上比现在的所有产品都要靠前。
而且很好的结合了无线画布和思维导图的优势,巧妙的用卡片来承接对应不同数据格式的展示,卡片样式的适配也非常多。
在输入的时候还会巧妙的利用光效对用户进行引导。
一个小问题,Midjourney 图片生成的时候传输的提示词貌似有问题,不应该直接传输中文。
这里尝试:https://flo.ing/
很开心有人能对 AI 原生产品的 UI 和交互有如此深入的思考。
整个产品在生成式 UI 的探索上比现在的所有产品都要靠前。
而且很好的结合了无线画布和思维导图的优势,巧妙的用卡片来承接对应不同数据格式的展示,卡片样式的适配也非常多。
在输入的时候还会巧妙的利用光效对用户进行引导。
一个小问题,Midjourney 图片生成的时候传输的提示词貌似有问题,不应该直接传输中文。
这里尝试:https://flo.ing/
📖 https://github.com/hardhackerlabs/book
我们最终决定用开源的方式来发布这本书,因为我们产品还在增长,所以 star ⭐️ 仓库,关注内容的持续更新!😘
微软这个VASA-1通过照片和声音生成人物说话视频的项目强的有点离谱。
从显示效果来看基本不存在瑕疵了。视频生成的技术瓶颈又一个被突破。
项目特点:
✦ 可以捕捉到大量的情感和表情细微差别以及自然的头部动作,从而增强真实感和生动感。
✦ 支持接受可选信号作为条件,例如主眼注视方向和头部距离,以及情绪偏移。
✦ 能够处理超出训练分布的照片和音频输入。它可以处理艺术照片、歌唱音频和非英语语音。
✦ 支持表情和姿势的编辑。
✦ 在离线批处理模式下以每秒 45 帧的速度生成 512x512 大小的视频帧,在在线流模式下可支持高达每秒 40 帧的速度,之前的延迟时间仅为 170 毫秒。
项目地址:https://www.microsoft.com/en-us/research/project/vasa-1/
从显示效果来看基本不存在瑕疵了。视频生成的技术瓶颈又一个被突破。
项目特点:
✦ 可以捕捉到大量的情感和表情细微差别以及自然的头部动作,从而增强真实感和生动感。
✦ 支持接受可选信号作为条件,例如主眼注视方向和头部距离,以及情绪偏移。
✦ 能够处理超出训练分布的照片和音频输入。它可以处理艺术照片、歌唱音频和非英语语音。
✦ 支持表情和姿势的编辑。
✦ 在离线批处理模式下以每秒 45 帧的速度生成 512x512 大小的视频帧,在在线流模式下可支持高达每秒 40 帧的速度,之前的延迟时间仅为 170 毫秒。
项目地址:https://www.microsoft.com/en-us/research/project/vasa-1/