关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
AI探索指南
Open AI CEO Sam 昨天还发了一篇《我希望有人告诉我的事情》应该是他今年的一些思考,我这里翻译一下,每一句加上一些自己的看法,顺便当自己的总结: Sam:乐观、专注、自信、强大的驱动力和个人关系是启动事务的关键。 我:第一句看起来有点正确的废话,这里感觉驱动力和个人关系是他想要强调的事情。驱动力这个我今年感触很深,以前我是不可能省下玩游戏的时间写东西的。 Sam:协作的团队、冷静与紧迫感的完美结合,以及超乎寻常的承诺,才是完成任务的真谛。长远的视角不多见;尽量不要为短期内别人的看法所困扰…
Sam:快速迭代可以弥补很多缺陷;通常情况下,如果你能迅速迭代,犯错也是可以接受的。计划应以十年为单位,执行则应以周为单位。

我:快速上线吸收反馈,快速修复迭代,继续收集反馈。前几年是大家的共识,这几年慢慢变了,Sam重新强调这件事情。

Sam:不要与商业版的物理定律作斗争。

我:在商业上我没啥理解缺失比较多,没办法举这种类似于物理定律的商业规则。

Sam:灵感是易逝的,生活是短暂的。不采取行动是一种特别狡猾的风险。

我:当有灵感的时候立刻就要开始行动,不需要做好,甚至不需要完成,先做起来。

Sam:规模往往会产生出人意料的新特性。

我:感觉是尝到了规模化的甜头,不管是组织架构上的,还是训练规模上的。

Sam:复利效应就像魔法。特别是,你确实想要建立一个随规模增长而获得复合优势的业务。

我:复利效应每个人都在提,但是能够践行和理解的人不太多。

Sam:不断地重新站起来,继续前进。

我:不只是失败之后重新站起来,也是上一个阶段结束后,要尽快开启下一个阶段。

Sam:与杰出的人一起工作是生活中最美好的部分之一。

我:跟一个好团队工作确实可以非常大的激发创造力和工作积极性。

来源:https://blog.samaltman.com/what-i-wish-someone-had-told-me
Open AI CEO Sam 昨天还发了一篇《我希望有人告诉我的事情》应该是他今年的一些思考,我这里翻译一下,每一句加上一些自己的看法,顺便当自己的总结:

Sam:乐观、专注、自信、强大的驱动力和个人关系是启动事务的关键。

我:第一句看起来有点正确的废话,这里感觉驱动力和个人关系是他想要强调的事情。驱动力这个我今年感触很深,以前我是不可能省下玩游戏的时间写东西的。

Sam:协作的团队、冷静与紧迫感的完美结合,以及超乎寻常的承诺,才是完成任务的真谛。长远的视角不多见;尽量不要为短期内别人的看法所困扰,随着时间推移,这会变得更加容易。

我:后半句可能更重要一些,如果坚信自己做的事情是正确的一些无关人的看法确实不重要,当做出成绩时,别人的看法自然会转变。

Sam:对一个团队来说,做一件真正重要的难事比做一件不那么重要的容易事更容易;大胆的想法能够激发人们的动力。

我:这也是他今年反复强调的,需要给团队正确的目标,目标必须是困难并且正确的,这样才能激发团队的能力。

Sam:激励措施就像超能力,需要谨慎设定。

我:这个我只能浅显的理解为,激励措施的时间和力度都是需要精准把握的,太多和太少都有可能出问题。

Sam:将资源集中在少数你深信不疑的重要项目上;这听起来容易,但实际上却很难。你可以删除的东西比你想的还要多。

我:前半句很多人都知道,后半句应该说的是抛弃不重要的事情要更加坚决和彻底。这点我今年想的和做的都不太够。

Sam:清晰而简洁地进行沟通。

我:感觉是一项需要练习的能力,我激动的时候废话不自觉的就很多。

Sam:每当遇到废话和官僚主义时,都要挑战它们,并鼓励他人也这样做。不要让组织架构阻碍人们有效地协同工作。

我:这个感觉得看环境,当整个组织的环境是相对健康的时候是有用的,当环境变得恶劣可能更需要的是换个环境。

Sam:成果至上;不要让良好的流程成为糟糕结果的借口。

我:实事求是,只看结果。

Sam:投入更多时间于招聘。对那些潜力巨大且进步迅速的人冒险。除了智力,还要寻找完成任务的实际证据。

我:依然是后半句是重点,面试的时候更要看到做事的证据。

Sam:超级明星员工比你认为的还要宝贵,但你必须根据他们对整个组织绩效的净影响来评估他们。

我:之前老罗说过类似的话,就是厉害的人往往也会有些其他问题,负责人要把这部分问题对组织的影响评估好。
ChatGemini - Based on Gemini Pro API, It's Free Chatbot

简单几步,让你有一个自己的谷歌 Gemini Chat Bot:

0.你需要先准备好一个 Vercel 账号:
1.打开 makersuite.google.com/app/apikey获取一个 apiKey,备用;
2.打开 https://github.com/antergone/palm-proxy键部署代码到 Vercel,你就有了一个自己的proxy,记住域名备用:
3.https://github.com/babaohuang/GeminiProChat 一键部署代码到 Vercel;
4.填写环境变量GEMINI API KEY和APIBASEURL,分别是第1步和第2步得到的值:
5.直接用 Vercel提供的子域名,或者绑定一个自己的域名,这是我的 ChatGemini.net

懒得搭建的就直接用我的吧,
https://www.chatgemini.net/

#gemini #gemini pro #gemini api #聊天机器人
好强!说不出话……

(图源@星河Galaxia)
一个简单的 #midjourneyV6 测试,这个文字生成效果也太好了,这可不是他们说的只有一点文字生成能力。

提示词响应非常准确,虽然不能连续通过对话修改,但是单条提示词还原很好了。比如第四张就是完全按照我要求的发色发型和姜饼人发卡画的女孩。

附图一提示词

A cup of coffee with the word "GUiZANG" written in cream. --ar 16:9 --v 6.0
AI探索指南
#Midjourney V6上线 一些反馈发现(单簧管总结): - 提示词长度现在是350+ - 您可以指定颜色和其他细节 - 你可以在画布上放置你想要的东西,如添加文本 - 您可以提示多个主题 - 你可以像ChatGPT一样和Midjourney聊天 - V6能够理解标点和语法的细微差别(即:熊猫吃、射、走) - 可以使用V6制作niji那样的漫画 - 可以通过描述图像来为其添加框架或边框 如何启用:在 /settings 下拉菜单中选择 V6,或在提示后输入 --v 6。 官方对V6 模型的新特性:…
5、改进的放大器

•分辨率提升:V6 提供了改进的放大器功能,可以将图像分辨率提高 2 倍。

•两种模式:提供了 ‘subtle’(微妙)和 ‘creative’(创意)两种模式,以适应不同的图像处理需求。

V6 的风格和提示:

1、提示方式的变化:V6 的提示方式与 V5 显著不同,用户需要重新学习如何进行提示。V6 提供了更细致的控制能力,用户可能需要更精确地描述他们想要的输出,以获得最佳结果。

2、对提示的敏感性:V6 对提示中的每个词汇都非常敏感。因此,应避免使用如“奖项获得者”、“4K”、“8K”这类可能被视为“垃圾”的词汇,因为它们可能不会提升结果质量,反而可能导致模型混淆。

用户应尽量明确和具体地描述他们想要的内容。例如,如果需要一个特定风格的图像,应直接说明这一点。

3、风格和美学:使用 --style raw 可获得更真实的图像。--stylize 的不同值会影响提示理解和美学效果。

使用 --style raw:为了获得更真实、更少主观色彩的图像,建议使用 --style raw 参数。这个设置倾向于生成更接近真实世界、更少艺术化处理的图像。

--stylize 参数的影响:低值:较低的 --stylize 值(默认为 100)可能会导致更好的提示理解,但可能牺牲一些美学效果。

高值:较高的 --stylize 值(最高可达 1000)可能会增强图像的美学和艺术效果,但可能会降低对提示的精确理解。

支持的功能和参数:

支持的功能包括 --ar, --chaos, --weird, --tile, --stylize, --style raw, Vary (subtle), Vary (strong), Remix, /blend, /describe(仅 V5 版本)。
#Midjourney V6上线

一些反馈发现(单簧管总结):

- 提示词长度现在是350+
- 您可以指定颜色和其他细节
- 你可以在画布上放置你想要的东西,如添加文本
- 您可以提示多个主题
- 你可以像ChatGPT一样和Midjourney聊天
- V6能够理解标点和语法的细微差别(即:熊猫吃、射、走)
- 可以使用V6制作niji那样的漫画
- 可以通过描述图像来为其添加框架或边框

如何启用:在 /settings 下拉菜单中选择 V6,或在提示后输入 --v 6。

官方对V6 模型的新特性:

1、更准确的提示跟随和更长的提示

•改进的响应能力:V6 模型对用户输入的响应更加准确,能够更好地理解和执行复杂的提示。

•处理更长的提示:V6 能够处理更长的文本提示,这意味着用户可以提供更详细的描述和指令,从而获得更精确的输出结果。

2、提升的连贯性和模型知识

•改善的连贯性:V6 在生成内容时的连贯性得到了显著提升,这使得输出结果更加流畅和自然。

•增强的模型知识:V6 拥有更丰富的知识库和更好的理解能力,能够更准确地处理复杂的查询和任务。

3、改进的图像提示和混合

•增强的图像生成:V6 在图像生成方面的能力得到了增强,能够根据文本提示创建更精细和逼真的图像。

•改善的图像混合:V6 提供了更好的图像混合功能,使得不同元素和风格的结合更加和谐自然。

4、文本绘制能力

•用户可以在他们的提示中指定要在图像上显示的文本,模型将会根据这些指示在生成的图像中包含相应的文本内容。

•绘制文本:V6 可以在图像中绘制文本。为了获得最佳效果,文本应该用引号标出。这样做可以帮助模型区分哪些是描述性的提示,哪些是实际要在图像中呈现的文本。

•风格调整:使用 --style raw 或较低的 --stylize 值可能有助于提高文本绘制的准确性和质量。这是因为不同的风格设置可能会影响文本在图像中的呈现方式。

例如,如果用户想要生成一张图像,上面写着用马克笔在便利贴上写的“Hello World!”,他们可以使用类似于以下的提示:“/imagine a photo of the text 'Hello World!' written with a marker on a sticky note --ar 16:9 --v 6”。
也许XR的普及会成为解决机器人manipulation缺乏数据问题的重要拐点?
人形机器人,先看特斯拉。
🎨 AI 大事件:Midjourney 6.0 正式上线了!

初步汇总一些海外玩家发现的新特性:

- 自然语言理解大幅提升,是 V6 的一大亮点。
- V6 更写实的处理能力, (图1是与V5.2 的对比提示:写实照片,超写实,侧视美女的脸,脸上的水珠,高度细致,肖像,数码摄影,佳能)
- V6 可以书写文字。 (图2是一次性出图,没有后期)
- 对手指处理有了大幅提升,例如在图3中,手、手指、酒杯以及保持酒杯形状一致方面有了明显进步。
- 场景丰富性似乎再上台阶, 图4的Hello Kitty

你也试试,进入 /settings,应该可以在下拉菜单中看到 6.0 Beta 版。
Back to Top