关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
AIGC 领域的最新工具、开源项目以及行业大事件
5、改进的放大器
•分辨率提升:V6 提供了改进的放大器功能,可以将图像分辨率提高 2 倍。
•两种模式:提供了 ‘subtle’(微妙)和 ‘creative’(创意)两种模式,以适应不同的图像处理需求。
V6 的风格和提示:
1、提示方式的变化:V6 的提示方式与 V5 显著不同,用户需要重新学习如何进行提示。V6 提供了更细致的控制能力,用户可能需要更精确地描述他们想要的输出,以获得最佳结果。
2、对提示的敏感性:V6 对提示中的每个词汇都非常敏感。因此,应避免使用如“奖项获得者”、“4K”、“8K”这类可能被视为“垃圾”的词汇,因为它们可能不会提升结果质量,反而可能导致模型混淆。
用户应尽量明确和具体地描述他们想要的内容。例如,如果需要一个特定风格的图像,应直接说明这一点。
3、风格和美学:使用 --style raw 可获得更真实的图像。--stylize 的不同值会影响提示理解和美学效果。
使用 --style raw:为了获得更真实、更少主观色彩的图像,建议使用 --style raw 参数。这个设置倾向于生成更接近真实世界、更少艺术化处理的图像。
--stylize 参数的影响:低值:较低的 --stylize 值(默认为 100)可能会导致更好的提示理解,但可能牺牲一些美学效果。
高值:较高的 --stylize 值(最高可达 1000)可能会增强图像的美学和艺术效果,但可能会降低对提示的精确理解。
支持的功能和参数:
支持的功能包括 --ar, --chaos, --weird, --tile, --stylize, --style raw, Vary (subtle), Vary (strong), Remix, /blend, /describe(仅 V5 版本)。
•分辨率提升:V6 提供了改进的放大器功能,可以将图像分辨率提高 2 倍。
•两种模式:提供了 ‘subtle’(微妙)和 ‘creative’(创意)两种模式,以适应不同的图像处理需求。
V6 的风格和提示:
1、提示方式的变化:V6 的提示方式与 V5 显著不同,用户需要重新学习如何进行提示。V6 提供了更细致的控制能力,用户可能需要更精确地描述他们想要的输出,以获得最佳结果。
2、对提示的敏感性:V6 对提示中的每个词汇都非常敏感。因此,应避免使用如“奖项获得者”、“4K”、“8K”这类可能被视为“垃圾”的词汇,因为它们可能不会提升结果质量,反而可能导致模型混淆。
用户应尽量明确和具体地描述他们想要的内容。例如,如果需要一个特定风格的图像,应直接说明这一点。
3、风格和美学:使用 --style raw 可获得更真实的图像。--stylize 的不同值会影响提示理解和美学效果。
使用 --style raw:为了获得更真实、更少主观色彩的图像,建议使用 --style raw 参数。这个设置倾向于生成更接近真实世界、更少艺术化处理的图像。
--stylize 参数的影响:低值:较低的 --stylize 值(默认为 100)可能会导致更好的提示理解,但可能牺牲一些美学效果。
高值:较高的 --stylize 值(最高可达 1000)可能会增强图像的美学和艺术效果,但可能会降低对提示的精确理解。
支持的功能和参数:
支持的功能包括 --ar, --chaos, --weird, --tile, --stylize, --style raw, Vary (subtle), Vary (strong), Remix, /blend, /describe(仅 V5 版本)。
一些反馈发现(单簧管总结):
- 提示词长度现在是350+
- 您可以指定颜色和其他细节
- 你可以在画布上放置你想要的东西,如添加文本
- 您可以提示多个主题
- 你可以像ChatGPT一样和Midjourney聊天
- V6能够理解标点和语法的细微差别(即:熊猫吃、射、走)
- 可以使用V6制作niji那样的漫画
- 可以通过描述图像来为其添加框架或边框
如何启用:在 /settings 下拉菜单中选择 V6,或在提示后输入 --v 6。
官方对V6 模型的新特性:
1、更准确的提示跟随和更长的提示
•改进的响应能力:V6 模型对用户输入的响应更加准确,能够更好地理解和执行复杂的提示。
•处理更长的提示:V6 能够处理更长的文本提示,这意味着用户可以提供更详细的描述和指令,从而获得更精确的输出结果。
2、提升的连贯性和模型知识
•改善的连贯性:V6 在生成内容时的连贯性得到了显著提升,这使得输出结果更加流畅和自然。
•增强的模型知识:V6 拥有更丰富的知识库和更好的理解能力,能够更准确地处理复杂的查询和任务。
3、改进的图像提示和混合
•增强的图像生成:V6 在图像生成方面的能力得到了增强,能够根据文本提示创建更精细和逼真的图像。
•改善的图像混合:V6 提供了更好的图像混合功能,使得不同元素和风格的结合更加和谐自然。
4、文本绘制能力
•用户可以在他们的提示中指定要在图像上显示的文本,模型将会根据这些指示在生成的图像中包含相应的文本内容。
•绘制文本:V6 可以在图像中绘制文本。为了获得最佳效果,文本应该用引号标出。这样做可以帮助模型区分哪些是描述性的提示,哪些是实际要在图像中呈现的文本。
•风格调整:使用 --style raw 或较低的 --stylize 值可能有助于提高文本绘制的准确性和质量。这是因为不同的风格设置可能会影响文本在图像中的呈现方式。
例如,如果用户想要生成一张图像,上面写着用马克笔在便利贴上写的“Hello World!”,他们可以使用类似于以下的提示:“/imagine a photo of the text 'Hello World!' written with a marker on a sticky note --ar 16:9 --v 6”。
简单几步,让你有一个自己的谷歌 Gemini Chat Bot:
0. 你需要先准备好一个 Vercel 账号;
1. 打开 https://makersuite.google.com/app/apikey 获取一个 apiKey;
2. 打开 https://github.com/antergone/palm-proxy 一键部署代码到 Vercel,你就有了一个自己的 proxy ,记住域名备用;
3. 打开 https://github.com/babaohuang/GeminiProChat 一键部署代码到 Vercel ;
4. 填写环境变量 GEMINI_API_KEY 和 API_BASE_URL ,分别是第1步和第2步得到的值;
5. 直接用 Vercel 提供的子域名,或者绑定一个自己的域名,开始使用 Gemini ;
6. 阅读文章了解更多 https://mp.weixin.qq.com/s/uSsCH3bFm_qtN_ZVR9f4Rw。
@ShowMeAI研究中心搜集到了这8种方法!!!
1、DeepL(网站) https://www.deepl.com/translator
点击页面「翻译文件」按钮,上传PDF、Word或PowerPoint文件即可
2、沉浸式翻译(浏览器插件) https://immersivetranslate.com
安装插件后,点击插件底部「更多」按钮,选择「制作双语BPUB电子书」、「翻译本地PDF文件」、「翻译THML / TXT文件」、「翻译本地字幕文件」
3、calibre(电子书管理应用) https://calibre-ebook.com/zh_CN
下载并安装 calibre ,并安装翻译插件「Ebook Translator」
4、谷歌翻译(网页) https://translate.google.com/
使用工具把 PDF 转成Word,再点击谷歌翻译「Document」按钮,上传 Word 文档
5、百度翻译(网页)https://fanyi.baidu.com/
点击导航栏「文件翻译」,上传 PDF、Word、Excel、PPT、TXT 等格式的文件,支持选择领域和导出格式(不过进阶功能基本都需要付费了)
6、彩云小译(App)
下载后点击「文档翻译」,可以直接导入PDF、PDF、Word、Excel、PPT、TXT、epub、srt 等格式的文档并开始翻译(不过有免费次数限制且进阶功能需要付费)
7、微信读书(App)
下载App后将PDF文档添加到书架,打开并点击页面上方「切换成电子书」,轻触屏幕唤出翻译按钮
8、浏览器自带的翻译功能
如果一些 PDF 太大,翻译工具不支持,除了将 PDF 压缩或者切分外,还可以转成 HTML 格式,然后使用浏览器自带的网页翻译功能
有需要的朋友mark住吧🕺🏻🕺🏻🕺🏻
当然,由于近十年来,绝大多数中文互联网的文本内容都沉淀在微信生态里,公众号文章里也不乏优质内容。
但在鱼龙混杂的当下,还是需要用AI淘一下才知道,是不是真的值得读。
昨晚,我也在几十篇浮窗文章里,发现了一篇很有启发的内容:《怎样才能做到“认知领先”?想明白这三点对AI从业者很重要》
但在鱼龙混杂的当下,还是需要用AI淘一下才知道,是不是真的值得读。
昨晚,我也在几十篇浮窗文章里,发现了一篇很有启发的内容:《怎样才能做到“认知领先”?想明白这三点对AI从业者很重要》