关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
AIGC 领域的最新工具、开源项目以及行业大事件
OpenAI最新内部模型,代号Astra,用2000美元的API成本,破解了十大难!!
不管是在AI领域,还是在数学和计算机领域,
都是超级炸裂的程度!!!
Fable 5说这些目非常难,任何一项足以获得菲儿茨奖!
所以,以后这些殿堂级的科学奖项,会颁给AI模型吗?
AI探索 | Hermes/OpenClaw|优质资源|优质信息
为什么很多人感觉 Claude 比 GPT更聪明?
有一个非常有价值的第三方实验。
Viktor 在完全相同的工具、workspace、prompt 下测试 GPT-5.6 Sol/Terra/Luna 与 Fable/Sonnet 等模型,最后把差异总结成:
GPT-5.6 tends to under-explore and under-communicate。
Claude tends to over-explore and over-communicate。
也就是说:
GPT 的典型错误是:“差不多够了,交付。”
Claude 的典型错误是:“我再查查,我再解释一点,我顺手再把这个也处理了。”
同一个测试里,Claude 发出的 Slack 回复中位长度大约是 GPT 的两倍,并且往往进行了更多次 Agent 调用;GPT 整体任务速度和成本明显更低。
这其实高度符合两家的对齐哲学。
那么为什么很多人感觉 Claude 比 GPT更聪明?
这是一个很重要的心理学现象。
假设两个模型实际上都知道正确答案。
GPT:
A 更好。主要原因是 X 和 Y。
如果你的目标是 Z,则改选 B。
Claude:
我认为这里真正的问可能不是 A 和 B 哪个更好,而是你实际上在优化 X 还是 Y。
如果结合你前面提出的约束,我会倾向于 A,不过这里有一个容易被忽略的问……
第二个答案很容易让人形成:
“Claude 理解我。”
甚至:
“Claude 比 GPT 聪明。”
实际上这里混合了三件不同的东西:
能力深度 + 探索预算 + 表达方式。
用户往往把三者全部感知成“智商”。
这也是为什么 benchmark 只有 1~2 分差异的模型,实际使用感受却可能非常大。
(以上为来自 GPT5.6 Sol 的辩解)
@aigc1024
有一个非常有价值的第三方实验。
Viktor 在完全相同的工具、workspace、prompt 下测试 GPT-5.6 Sol/Terra/Luna 与 Fable/Sonnet 等模型,最后把差异总结成:
GPT-5.6 tends to under-explore and under-communicate。
Claude tends to over-explore and over-communicate。
也就是说:
GPT 的典型错误是:“差不多够了,交付。”
Claude 的典型错误是:“我再查查,我再解释一点,我顺手再把这个也处理了。”
同一个测试里,Claude 发出的 Slack 回复中位长度大约是 GPT 的两倍,并且往往进行了更多次 Agent 调用;GPT 整体任务速度和成本明显更低。
这其实高度符合两家的对齐哲学。
那么为什么很多人感觉 Claude 比 GPT更聪明?
这是一个很重要的心理学现象。
假设两个模型实际上都知道正确答案。
GPT:
A 更好。主要原因是 X 和 Y。
如果你的目标是 Z,则改选 B。
Claude:
我认为这里真正的问可能不是 A 和 B 哪个更好,而是你实际上在优化 X 还是 Y。
如果结合你前面提出的约束,我会倾向于 A,不过这里有一个容易被忽略的问……
第二个答案很容易让人形成:
“Claude 理解我。”
甚至:
“Claude 比 GPT 聪明。”
实际上这里混合了三件不同的东西:
能力深度 + 探索预算 + 表达方式。
用户往往把三者全部感知成“智商”。
这也是为什么 benchmark 只有 1~2 分差异的模型,实际使用感受却可能非常大。
(以上为来自 GPT5.6 Sol 的辩解)
@aigc1024
https://github.com/MemTensor/memmy-agent
AI探索 | Hermes/OpenClaw|优质资源|优质信息
了解了一下美团具身的薪资,感觉我们要成为具身的黄埔军校了。
从三四年前就开始做具身,那时候还不叫具身,就是人形机器人。技术积累是很多的,但是融资是很少的。于是花不起大价钱挖行业经验老将,所以招的全是校招生。校招生培养出来之后肯定也看不起我们现在开的价,就会跳出去。
黄埔军校就是这么来的。
@aigc1024
从三四年前就开始做具身,那时候还不叫具身,就是人形机器人。技术积累是很多的,但是融资是很少的。于是花不起大价钱挖行业经验老将,所以招的全是校招生。校招生培养出来之后肯定也看不起我们现在开的价,就会跳出去。
黄埔军校就是这么来的。
@aigc1024
😃 爆庄实录|3天狂揽1086万U😃 新客首存6万U,豪提209万U😃 500一拉,PG实力兑现133万U
1.PG电子赏金女王一举斩获830万并成功提现
2.PA真人豪赢644万一路长虹一天实现暴富
3.PG电子爆890万并以成功提现实现财富自由
4.大哥在PA真人百家乐累计盈利突破1000万
大额出款额外奖励8888-128888,双重日存彩金128888+4688每日送,周流水彩金68888每周送,双重签到彩金16888+3888送不停
【 #182体育 全网独此一家】
公平、公正、公开、 信誉第一、服务第一
不限ip、 免实名、免绑卡、免绑手机号码
每日存款彩金每日送,每笔存款加赠1%
专属VIP客服:@vipkf_182ty8
体育赛事推荐:@VIP182TYTJ
双向用户点击: @vipkf_182ty2_bot
吃瓜搞笑:@chiguagaoxiaoxinwen
✅ 关注福利频道:@vip182ty888
在线互动,精彩不断,立即进入直播间!
球速体育 大会员再创新高:
1.泰国大老板百家乐存50万出512万
2.斯里兰卡神秘大哥连续5天总提4000万+
3.实力盘总PA真人喜提990万一路爆红
4.pp电子糖果1000小注一拉爆出70万大奖
大额出款额外奖励8888-128888,双重日存彩金128888+4688每日送,周流水彩金68888每周送,双重签到彩金16888+3888送不停
【 #球速体育 安全有保障】
老品牌值得信赖、安全第一、保障第一
不限ip、 免实名、免绑卡、免绑手机号码
每日存款彩金每日送,每笔存款加赠1%
专属VIP客服: @QSTY567
体育赛事推单:@QSTY988
双向用户点击:@qsty168168_bot
午夜剧场:@ziweifancha7
✅ 关注福利频道:@qsty8999
老品牌 信誉高 佣金稳
代理合营频道:@QSTY321
今天在线下花了5小时分别和两位朋友聊天,收获很多
再次让我确认线下的深度交流就是这个时代最稀缺的最有价值的东西
AI 模型看似什么都懂,却永远无法和我们进行真正的思想碰撞
AI 永远不可能吞噬一切
未来我们应该多组织这样的线下聊天
这毫无疑问是珍贵的快乐体验
@aigc1024
再次让我确认线下的深度交流就是这个时代最稀缺的最有价值的东西
AI 模型看似什么都懂,却永远无法和我们进行真正的思想碰撞
AI 永远不可能吞噬一切
未来我们应该多组织这样的线下聊天
这毫无疑问是珍贵的快乐体验
@aigc1024
http://xhslink.cn/o/6g6bb13LMSX
今天看到去年11月底认识好友发的小红书帖,内心涌流着一些东西。
不知不觉距离SheNicest第一次上海黑客松过去已经8个月了,那是第一次向大家宣告SheNicest的全球最大的野心,这过程中有人离开,有人继续留下也,有新的人加入,好恍惚一幕幕都像过往电影,现在回过头原来已经走这么远了,看着我们的江山一点点打下,某种程度我们真的是这个行业的开拓者,从女性黑客松刚开始被质疑充满不确定到走到如今更多女性走入科技领域,我想说SheNicest早已经不是一家做女性黑客松的品牌了,我们想要定义下一代女性科技产品。这次SheNicest全球最大黑客松我们一定会证明另一件事情打破了消费品牌和科技品牌的隐形壁垒。这次野人先生,山下有松,珀莱雅等知名消费品牌也愿意相信我们,核心参与参与进来,所以请大家报名我们这次黑客松活动!我不想说这次多么牛现场体验多么好,但是请相信一个年轻的团队对做成这件事的坚定和夜以继日勤奋的7个月努力,以及锋芒与自我的来回拉扯都是为了最后这事儿能成。
请相信我们,也相信自己,相信这个世界会因为我们变得好一点再好一点。
@aigc1024
https://mk.bet
关注
掌握东南亚一线动态,看清风向料定先机。每周抽取100名TG会员,发言积分兑