关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
Cursor 设计师提出了一种新的交互界面。

刚开始的时候只展示 Agent 界面,在用户需要的时候切换成 IDE,确实像我们这种 Vibe Coding 的基本用不到 IDE 那么复杂的界面
米哈游联创蔡浩宇的 AI 游戏 The Whispers from the Star 现在已经在 Steam 提供试玩 Demo。

每一次对话都是实时的、情感化的、完全属于你自己的。

感兴趣可以去试试#ai创造营#
Grok4大力出奇迹的三大秘密:
1、无尽的算力
2、华人
3、加班
Dia 昨晚又进行了一次更新,推出了内嵌浏览功能

可以在与 AI 聊天时,直接在对话界面旁边打开网页内容,无需跳转到新标签页或离开当前对话。

你可以在一个界面内完成信息查找和决策,聊天线程始终可见。

他们也介绍了背后的设计思路:

越来越多的用户习惯以“聊天”作为任务的起点,而不是传统的网页。对话本身成为了信息探索和任务处理的锚点。

Dia 的新思路是让 AI 成为网页浏览的增强工具,而不是屏障。用户可以一边与 AI 互动,一边实时查阅网页,获得更丰富、透明的信息。

这种设计强调“人性化”——让用户自主选择是依赖 AI 总结,还是亲自查阅网页细节。

未来的浏览体验不是“AI 或网页”的二选一,而是两者的无缝协作。AI 和网页内容可以在同一界面、同一流程中互补,提升效率和体验。
Media is too big
VIEW IN TELEGRAM
Cursor 设计师提出了一种新的交互界面。#ai创造营#

刚开始的时候只展示 Agent 界面,在用户需要的时候切换成 IDE,确实像我们这种 Vibe Coding 的基本用不到 IDE 那么复杂的界面
我去,Veo 3 的 Fast 模型史诗级更新,支持图生视频了!

不只是 Flow 里面支持 Gemini App 里面的,Veo 3 Fast 模型也可以图生视频

还支持上传照片让里面的角色对话

如果你 Flow 的点数用完了,还支持单独充值,Pro也不用担心额度不够用只能开 Ultra 了
你观测到它爆发性增长的时候
是在哪一年呢?
智元机器人借壳上纬新材上A股,今天开盘涨停,啧啧啧
第一个网站上线2个月之后终于开单了,也算是实现了从无到有

5月份上线,因为第一个站就做了自己的品牌,没有涉及任何热词或者热点,所以上线后虽然有几百个注册但整体流量很低

还好产品定位比较泛,6月份开始尝试上各种带关键词的工具内页,但是上了几天发现手动上内页效率实在太低了,于是又花了点时间做了一套上内页的工具,只要输入关键词就可以一键完成内页内容、封面、工具的构建,从此大幅减轻了工作量,即使后面做其他的新站也不影响老站上内页了

虽然有了工具但上内页也不贪多,每天只上3-5个,然后关注GSC 如果看到有页面拿到曝光但是点击率低的就进一步优化TDH。慢慢的GSC上的数据开始上涨了,不仅曝光和点击增加了,点击率和排名也逐渐上升

如此这般坚持了小半个月,终于迎来了第一个付费用户!收到stripe通知的时候真的很激动,第一单来的比我想象中要快很多,有了付费用户的支持出海路上信心更足了

最后要感谢 @哥飞 ,上面提到的持续上内页、控制上页面速度、持续优化等都是社群里面反复强调的知识点,出海路漫漫,飞哥作为引路人真的帮了我们很多,感恩😘
我一直觉得飞书多维表格是他们最强的产品部分了。#ai创造营#

昨天飞书大会有事没去,看了一下新发布的能力,有点牛批啊,基本上可以代替所有的传统业务系统了。

多维表格的 AI 能力是我觉得超级牛皮的部分,AI 字段、AI 节点、AI 工作流三层直接让很多业务流程可以自动化,复杂的流程也可以一句话搭建完成,不需要理解。

我之前就用飞书的多维表格搞过一个 AI 视频生产和 AI 论文分析模板,效率高了很多。

现在表单容量提升到了 1000 万行,基本上一个中型非互联网公司所有的数据够呛有这么多,计算速度提升了 10 倍,甚至可以媲美专业数据库了。

而且内置超多的 BI 组件,数据透视、TopN、桑基图、地图等都有,原始的数据管理和分析可以一键完成,自由度也非常高。

飞书多维表格现在在用另一种可视化加 AI 辅助的方式让“人人都嫩个成为开发者”,不需要高昂的预算,任何了解业务的人都可以搭建出符合自己要求的数字系统,如果自己的公司或者业务有这种管理系统的需求可以试试。

另外在飞书大会上Way to AGI 的 AJ 也发布了一个超创计划,期望汇聚全球的顶尖 AI 人才库,同时帮助人才和企业建立链接相互转化。
投资日记#43
发现大模型改变了很多行业,包括量化基金,以前是啃代码,现在有LLM agent之后,会诞生很多交易机器人——如Bobby AI,如AlgobuilderX。

我研究中一再觉得数据是算法的底座,而要获得除了表面可爬的数据以外来做预测——可爬数据比如点击率,转化率进行观察规律,还要能够构建模拟的用户交互行为,有点类似能够手动创作乌托邦的意思,不知道目前大模型是否能够做到fine tuning 以外的功能。

目前我看到的很多用户数据的积累都是通过提供功能A换取用户分享数据,以此来开发功能B这个路径。
整了个两百块钱的便携显示屏,素质相当不错,回头挂起来当数据看板用
总结一些 Grok 4 发布的相关信息,就不做测试了,跟主流模型拉不开差距。

包括 Grok 4 和 Grok 4 Heavy 两个模型。#ai创造营##马斯克#
内置了工具链调用能力,支持检索、代码执行、计算器等工具。
256K 上下文窗口,支持文本、图像、结构化数据输入。
预训练阶段相较 Grok 3 提升约 10 倍。Grok 4 reasoning 在 RL 阶段再 提升 10 倍。

APP 现在三个会员等级:

基础会员现在只能免费用 Grok3 了
SuperGrok 300 美金一年,支持 128K 上下文的 Gork4,语音和视觉输入。
SuperGrok Heavy 3000 美金一年,可以抢先体验新功能,使用 Grok 4 Heavy 模型。

API同步推出: Grok 4模型,输入 3美元、输出 15 美元,输出价格接近 o3 的两倍,太贵了。

基准测试结果上:

Humanity’s Last Exam(2500 题,100+ 学科)Grok 4 Heavy + 工具刷到了44.4 %,o3 约为 21%。
AIME25(数学竞赛):Grok 4 Heavy = 100 %(满分)。
USAMO25(数学证明):Grok 4 Heavy = 61.9 %,领先次席 24 pp。
Chest Agent Bench(胸片 Agent 任务):Grok 4 = 72.8 %,行业最高。
Vending-Bench(商业运营模拟):Grok 4 人均净资产 $4694(第 2 名约 $2077)。

未来路线图:

7 月:Grok 4 Release(已完成)。
8 月:Coding Model(代码生成与代理)。
9 月:Multi-modal Agent(统一文本-图像-工具的任务执行)。
10 月:Video Generation Model(视频生成,对标 Sora / Veo)。
Back to Top