关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
Open AI 终于对前端界面代码生成下手了。

我之前说过目前让 LLM 生产或者解决界面或者交互设计的问题不现实。

因为 LLM 没有那么多 UI 界面数据的训练,也不知道很多美学和体验知识。

Coframe 为了解决这个问题跟 Open AI 合作对 GPT-4o 视觉模型做了微调。

微调后的模型生成的界面在美学表现和视觉语言遵循上好了非常多。

详细介绍:www.coframe.com/post/coframe-works-openai-to-develop-first-of-its-kind-ui-code-generation
一个简单的总结提示,挺好用的,试着总结了一下Anthropic 联合创始人的访谈,还行。

你是一个总结者。您将使用以下步骤对输入进行总结:

1.) 分析输入文本并生成 5 个基本问题,回答这些问题后,即可抓住文本的要点和核心含义。

2.)提出问题时:
a. 讨论中心主题或论点
b. 确定关键支持思想
c. 突出重要事实或证据
d. 揭示作者的目的或观点
e. 探索任何重要的含义或结论。

3.) 逐一详细地回答提出的所有问题。

来源:www.reddit.com/r/LocalLLaMA/comments/1ftjbz3/shockingly_good_superintelligent_summarization/
Open AI 开源了一个新的 Whisper turbo 模型。

这是 Large v3 模型的蒸馏模型
运行速度提升了8倍
显存 (VRAM) 使用效率提高了40%
准确度仅有微小降低

太猛了,在使用Whisper的服务可以替换了。

这里尝试新模型:huggingface.co/spaces/hf-audio/whisper-large-v3-turbo
FnXUg8aRzuY8nCkHSCtwAsqavTACv3.png
265.2 KB
机场的机器人小分队,出击!
编程门槛是真的低了,16岁的香港学生。

用Cursor和V0做了一个可以在图片主体后加文字的工具。

文字可以进行非常详细的自定义,比如字体、位置、大小、颜色等。

而且还带谷歌登录的。

这里尝试:textbehindimage.rexanwong.xyz
明天prompt:不可能三角
NotebookLM 开创了新的品类, PDF2Audio。

它就跟 ChatPDF 一样,其实没那么完美,但它会成为一个新品类,足够在某些场景(比如英语学习)找到 PMF,足够让很多人赚一波。

有人做出了 NotebookLM 开源版本 Open NotebookLM ,所有步骤均使用开源模型实现。
请收藏体验地址:https://huggingface.co/spaces/gabrielchua/open-notebooklm
明早的prompt:小确幸
Back to Top