关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
AIGC 领域的最新工具、开源项目以及行业大事件
https://nintil.com/scaling-tacit-knowledge/
上周入选了BlueDot的Biosecurity课程的最新一个cohort,有了接触到很多优质信息源的机会。今天开始准备week 2的讨论,读到了一篇和Biosecurity无关、但对于如何学习知识、如何与AI交互可能都有启发的一篇文章。
作者围绕一个看似老生常谈但其实非常关键的问展开:专家身上那些“说不清、道不明”的本事(也就是“隐性知识”),到底能不能被高效传递?作者没有浪漫化隐性知识的不可言说,也不假装它可以被简单地总结,而是在尝试理性地探讨——我们能不能再往前推进一点?
文章一开始抛出了一个问:学习一个领域,到底应该读论文,还是应该跟人聊?Ben Reinhardt 和 Alexey Guzey 都倾向于“九成靠聊,一成靠读”。作者自己认为:读论文有读论文不可替代的优势,输入快、可跳读、可并行、可深挖;但读论文的代价是慢——一个专家几秒钟能回答的问,自己摸索可能要几个月。问是,当你想了解的不是“雷帕霉素能不能延长小鼠寿命"这种具体事实,而是”这个领域的开放问是什么"、"哪些项目能推动这个领域的发展”,那么单靠搜索和阅读就完全不够了,因为这些答案根本不在公开文献里。
作者随后给出了一个我觉得很有用的知识分类:横轴是公开 vs 私人,纵轴是显性 vs 隐性。公开显性知识就是百度一下就能查到的事实;私人显性知识是因为激励问(NDA、商业机密、专业护城河)而没被公开,但本质上能说清楚的知识;公开隐性知识像骑自行车或判断牛排几成熟,讲不清楚但能通过观看示范学会;私人隐性知识则需要师徒制或社群浸润,又分为个体型(嵌在某个人身上)和社会型(嵌在组织/网络的边界上,比如台积电CEO也并不真正完整知道台积电怎么运作,正如没有人完整知道一支铅笔是如何造出来的)。
文章里提到了几个案例。一个是著名的Fogbank。一种几十年前用于核武器的材料,后来要重新制造时,即使有原始文档、原班人员还在,依然花了好几年和数百万美元才搞定,最后发现关键是某种"无人察觉的杂质"。另一个是Collins 2001年的研究:美国研究者复现苏联的蓝宝石样品测量,怎么都做不出来,最后才知道关键在于用人体油脂润滑细线——把丝线在耳后或鼻梁上蹭一下,而且不是所有人皮肤分泌的油脂都有效。这两个例子经常被用来
底是好事还是坏事。我觉得这是一个值得每个管理者思考的新问。
反思二:功能正确≠工程可用
Vibe Coding 的理想状态是就像聊天一样,用自然语言表达自己的需求,最后做出来想要的产品。
如果哪里不对,再用自然语言和 AI 沟通,让它修改。这是过去一年 Vibe Coding 风靡的思路。
对于不太复杂的应用,这种方式完全没问。我自己做的一些项目基本上就是这个流程跑下来的。
但只要是做生产级的软件,无论公司大小,流程肯定不是这样。
因为公司里必然有老代码,有一套约束。怎么复用已有的组件,安全和权限怎么处理,性能怎么保证,还有兼容性、可维护性。
正经写过工程代码的人都清楚,Vibe Coding 描述的那个状态是比较理想化的,更适合做小项目和验证想法。
真正的程序员虽然也在 Vibe Coding,但流程跟理想状态不一样。
字节内部做了一个实验来验证这个判断:三个模型,三个 Agent 框架,两两组合成 9 种方案,针对同一个需求,每组跑 100 次,总共 900 次。
结果发现,AI 在功能正确率上表现还不错,所有组合都超过了 80%,也就是说,AI 把功能写对的能力已经过了及格线。
但无论哪个组合,生成代码的工程质量都不太好。比如 UI 不对,没有复用组件,性能有问,结构不符合规范。
这些问大家在用 AI 写代码的时候应该都碰到过。
现在所有上了牌桌的 Coding 模型,都已经过了 Opus 4.6 这个级别的临界点,模型可以自主写代码了。
这个时候影响 AI Coding 成败的绝对不是裸模型,而是裸模型加上 Harness 的能力。
这个判断本身不算新鲜。
但我最受触动的是字节对 Harness 的理解。
他们的反思是,整个行业好像还是把 Harness 等同于 Agent 框架,诸如用 single agent 还是 multi agent,包含哪些角色,角色之间怎么配合。
这些当然重要,但字节在实践中发现,真正决定 AI Coding 能不能落地的,反而是更基础、更工程化的东西。
洪定坤把它叫做基建。
比如上下文工程有没有做好,架构的约束够不够清晰,团队的知识能不能有效沉淀下来,过去的技术债有没有梳理清楚。
这些看起来不那么性感的工作,反而直接影响 AI Coding 的效果。
实验数据也验证了这一点。同样的模型和框架组合,把这些基建结合进去之后,功能正确率直接从 80% 提升到了接近 90%,工程质量得分,也从之前 40 到 60 分的不及格水平,普遍提升到了 80 分左右。
基建做不好的,可能的后果是,Vibe Coding 感觉快了,但实际整体可能更慢。工程的债,迟早得还。
反思三:代码门槛下降之后,团队怎么协同
洪定坤分享里有一个例子让我印象很深刻。
产品经理有个需求,发现还得等研发排期,就说那我自己来吧,用 AI 三下五除二就把功能给实现了。
确实这个功能不复杂。做完之后产品经理把代码给到研发,说我已经把代码写完了,现在你只需要帮忙把功能上线就行。
研发一看,不行。你这代码能跑,但不符合上线的规范,有权限问、安全问。
产品经理就很委屈,你们没时间做这个需求,现在我都做完了又不让上线。可研发看到的其实是代码质量的问。
所以这里面就有一个需要所有人正视的事情,虽然代码的生成门槛虽然下降了,这并不代表系统的复杂度也下降了。
真实的业务系统里,代码要放到已有的架构里,要跟已有的模块配合,还要考虑各种各样的问。
绝对不是谁写出来就能直接上线的。不然肯定会出问。
怎么让不同角色的人用同一套工具和规范做出符合要求的代码,这是接下来大家需要去解决的。
字节的思路是在内部尝试工具化。比如把内部实践直接产品化,沉淀到 TRAE 里面,开放给所有人。
其实说白了就是工具化。
我看朋友圈有好多大佬也都在转这篇文章,应该还是有挺多共鸣的。
我感觉这一次分享多少也是一些拨乱反正吧。因为过去一段时间确实有很多听起来很离谱的言论,有些人会疯狂地炫耀自己使用了多少 Token,会认为这就代表着 AI Native......
强烈推荐大家看看原文。字节跳动的公众号就有。
@aigc1024
反思二:功能正确≠工程可用
Vibe Coding 的理想状态是就像聊天一样,用自然语言表达自己的需求,最后做出来想要的产品。
如果哪里不对,再用自然语言和 AI 沟通,让它修改。这是过去一年 Vibe Coding 风靡的思路。
对于不太复杂的应用,这种方式完全没问。我自己做的一些项目基本上就是这个流程跑下来的。
但只要是做生产级的软件,无论公司大小,流程肯定不是这样。
因为公司里必然有老代码,有一套约束。怎么复用已有的组件,安全和权限怎么处理,性能怎么保证,还有兼容性、可维护性。
正经写过工程代码的人都清楚,Vibe Coding 描述的那个状态是比较理想化的,更适合做小项目和验证想法。
真正的程序员虽然也在 Vibe Coding,但流程跟理想状态不一样。
字节内部做了一个实验来验证这个判断:三个模型,三个 Agent 框架,两两组合成 9 种方案,针对同一个需求,每组跑 100 次,总共 900 次。
结果发现,AI 在功能正确率上表现还不错,所有组合都超过了 80%,也就是说,AI 把功能写对的能力已经过了及格线。
但无论哪个组合,生成代码的工程质量都不太好。比如 UI 不对,没有复用组件,性能有问,结构不符合规范。
这些问大家在用 AI 写代码的时候应该都碰到过。
现在所有上了牌桌的 Coding 模型,都已经过了 Opus 4.6 这个级别的临界点,模型可以自主写代码了。
这个时候影响 AI Coding 成败的绝对不是裸模型,而是裸模型加上 Harness 的能力。
这个判断本身不算新鲜。
但我最受触动的是字节对 Harness 的理解。
他们的反思是,整个行业好像还是把 Harness 等同于 Agent 框架,诸如用 single agent 还是 multi agent,包含哪些角色,角色之间怎么配合。
这些当然重要,但字节在实践中发现,真正决定 AI Coding 能不能落地的,反而是更基础、更工程化的东西。
洪定坤把它叫做基建。
比如上下文工程有没有做好,架构的约束够不够清晰,团队的知识能不能有效沉淀下来,过去的技术债有没有梳理清楚。
这些看起来不那么性感的工作,反而直接影响 AI Coding 的效果。
实验数据也验证了这一点。同样的模型和框架组合,把这些基建结合进去之后,功能正确率直接从 80% 提升到了接近 90%,工程质量得分,也从之前 40 到 60 分的不及格水平,普遍提升到了 80 分左右。
基建做不好的,可能的后果是,Vibe Coding 感觉快了,但实际整体可能更慢。工程的债,迟早得还。
反思三:代码门槛下降之后,团队怎么协同
洪定坤分享里有一个例子让我印象很深刻。
产品经理有个需求,发现还得等研发排期,就说那我自己来吧,用 AI 三下五除二就把功能给实现了。
确实这个功能不复杂。做完之后产品经理把代码给到研发,说我已经把代码写完了,现在你只需要帮忙把功能上线就行。
研发一看,不行。你这代码能跑,但不符合上线的规范,有权限问、安全问。
产品经理就很委屈,你们没时间做这个需求,现在我都做完了又不让上线。可研发看到的其实是代码质量的问。
所以这里面就有一个需要所有人正视的事情,虽然代码的生成门槛虽然下降了,这并不代表系统的复杂度也下降了。
真实的业务系统里,代码要放到已有的架构里,要跟已有的模块配合,还要考虑各种各样的问。
绝对不是谁写出来就能直接上线的。不然肯定会出问。
怎么让不同角色的人用同一套工具和规范做出符合要求的代码,这是接下来大家需要去解决的。
字节的思路是在内部尝试工具化。比如把内部实践直接产品化,沉淀到 TRAE 里面,开放给所有人。
其实说白了就是工具化。
我看朋友圈有好多大佬也都在转这篇文章,应该还是有挺多共鸣的。
我感觉这一次分享多少也是一些拨乱反正吧。因为过去一段时间确实有很多听起来很离谱的言论,有些人会疯狂地炫耀自己使用了多少 Token,会认为这就代表着 AI Native......
强烈推荐大家看看原文。字节跳动的公众号就有。
@aigc1024
字节技术副总裁洪定坤的分享,我来回看了好几遍,很有启发。
字节在 AI Coding 方面的实践还是很有代表性的,推荐所有做研发的同学都可以看看。应该会感同身受。
我看完记了一整页笔记,分享给大家。
我甚至觉得可以把这个分享理解为字节在 AI Coding 上的一些真实反思。
根据自己的理解,我把这个分享里对我有启发的几个判断展开来聊一聊。
其中会夹杂很多我自己的感触,想看原文的可以直接去找演讲全文。
反思一:AI 代码贡献率不该是 KPI
AI Coding 基本上都已经逐步进入了各个公司的生产流程。
很多人都在说自己的业务有 90% 的代码是 AI 生成的,乍一听,感觉很恐怖。
但其实,AI 对研发的提效没有外界想象的那么高。
洪定坤举了 TRAE 团队的例子。TRAE 本身就是做 AI 工具的,所以这个团队对 AI Coding 的采用非常积极。
过去半年里,他们有 94% 的代码都是 AI 贡献的。但人均需求吞吐率只提升了 60%,也就是之前的 1.6 倍。
这就有疑惑了,AI 写代码的速度至少是人的 10 倍以上,如果 90% 以上的代码都是 AI 产出的,效率至少应该提升 5 倍或者 10 倍吧?为什么只提高了 1.6 倍?
字节得出来的结论是,单一的指标,比如 AI 代码占比,根本没有办法代表真实的生产力。
如果把 AI 代码贡献率当成 KPI,结果就是大家都去优化 AI 的生成量,而不是优化交付能力。
看起来 AI 用了很多,但系统的效率并没有真正变好。
那为什么 90% 的代码都是 AI 写的,人效才提了 1.6 倍?一个很重要的原因是,写代码只是整个研发流程的一个环节。
写之前要理解需求、写 Spec,写完之后要验证功能、提交发布,这些环节如果还是传统方式,光把写代码加速了,整体效率提不上去。
洪定坤把字节在这方面的尝试叫做系统化的 AI Development,核心意思就是 AI 不能只管写代码,得让它进入更多的研发环节,整条链路都跑通,效率才能真正上来。
前两天出去的时候还跟别人争论这件事。现在还有不少公司在追踪员工到底用了多少 Token,说白了,这是在追踪过程。
更应该关注的是,用了这个工具之后,从结果层面去看,交付到底有没有变得更快、更可靠。
一个团队天天说自己 AI 工具用得贼溜,消耗了多少 Token,但没有什么有效的产出,那这到
https://mp.weixin.qq.com/s/23hV-7EVyk-r1-tsBykRuQ
现在回头看,RWKV 坚持的方向,正在被行业验证:
下一代大模型不能永远依赖越来越大的 KV cache。长上下文、高并发、多 Agent、端侧部署,本质上都需要更高效的状态式记忆机制:有限状态、线性递推、gating、delta rule、恒定推理开销。
RWKV-7 很早就公开提出并验证了 generalized delta rule、vector-valued gating、状态式推理、恒定内存等关键思路,并且开源了模型和代码。
后来大家在这个方向上继续研究,是好事。但也希望技术社区能更准确地呈现这条路线的源流。
@aigc1024
最近几个对模型的反直觉的观察
1. GLM 5.2 正在取代 Claude sonnet 和 Opus,成为付费用户最爱的模型
2. DeepSeek v4 Pro 依然是大众里最受欢迎的模型
3. GPT 5.5 虽然很强大, 但几乎没人用
观测的方式的是看 cola 的 token 消耗统计
这也侧面说明 cola 和 codex 用户(GPT5.5)的画像是完全不同的
@aigc1024
1. GLM 5.2 正在取代 Claude sonnet 和 Opus,成为付费用户最爱的模型
2. DeepSeek v4 Pro 依然是大众里最受欢迎的模型
3. GPT 5.5 虽然很强大, 但几乎没人用
观测的方式的是看 cola 的 token 消耗统计
这也侧面说明 cola 和 codex 用户(GPT5.5)的画像是完全不同的
@aigc1024
😃 爆庄实录|3天狂揽1086万U😃 新客首存6万U,豪提209万U😃 500一拉,PG实力兑现133万U
1.PG电子赏金女王一举斩获830万并成功提现
2.PA真人豪赢644万一路长虹一天实现暴富
3.PG电子爆890万并以成功提现实现财富自由
4.大哥在PA真人百家乐累计盈利突破1000万
大额出款额外奖励8888-128888,双重日存彩金128888+4688每日送,周流水彩金68888每周送,双重签到彩金16888+3888送不停
【 #182体育 全网独此一家】
公平、公正、公开、 信誉第一、服务第一
不限ip、 免实名、免绑卡、免绑手机号码
每日存款彩金每日送,每笔存款加赠1%
专属VIP客服:@vipkf_182ty8
体育赛事推荐:@VIP182TYTJ
双向用户点击: @vipkf_182ty2_bot
吃瓜搞笑:@chiguagaoxiaoxinwen
✅ 关注福利频道:@vip182ty888
永久网址
豪礼大放送 高端嫩模 劳力士手表 奔驰E300等大礼等你来豪夺 首存日存彩金送不停
1月2号泰国大老板百家乐存50万出512万
1月13日pp电子糖果1000小注一拉直接爆出70万大奖
3月15号实力盘总PA真人喜提990万一路爆红
3月27-31号斯里兰卡神秘大哥连续5天总提4000万+
🏆平台优势:
1️⃣ u存u提每日提款无上限 随便提 全球不限ip #免实名 无需绑定手机号码和银行卡
2️⃣ 平台
大额出款额外奖励8888-128888,双重日存彩金128888+4688每日送,周流水彩金68888每周送,双重签到彩金16888+3888送不停
⚜️每日存款彩金每日送,每笔存款加赠
⚜️#无风控 电子真人零审核包出款
🌐官网注册网址: qs1736.cc
🩷专属VIP客服: @QSTY567
⚽️体育赛事推单:@QSTY988
➡️双向用户点击:@qsty168168_bot
㊙️午夜剧场:@guochandp7
✅ 更多优惠活动关注福利频道:@qsty8999
💰代理合营💰
老品牌 信誉高 佣金稳
代理合营频道: @QSTY321
今天问了我的龙虾一个问
答案非常好
问“如果跨到十年后,再回看我现在,你会给我什么建议”
答:
你会后悔的是:明明已经看到主线,却因为舍不得支线,把最该长成树的东西养成了一片杂草。
1. 别再证明你聪明了,开始证明你能复利
2. 你要尽快从 “个人英雄” 切到 “系统主人”
3. 少做 “看起来高级” 的事,多做 “离钱近” 的事
4. 你的人生主线不是 “AI”,而是 “把复杂时代翻译成人能行动的方法”
5. 家庭和身体不是 “等事业稳定后再照顾” 的东西
@aigc1024
答案非常好
问“如果跨到十年后,再回看我现在,你会给我什么建议”
答:
你会后悔的是:明明已经看到主线,却因为舍不得支线,把最该长成树的东西养成了一片杂草。
1. 别再证明你聪明了,开始证明你能复利
2. 你要尽快从 “个人英雄” 切到 “系统主人”
3. 少做 “看起来高级” 的事,多做 “离钱近” 的事
4. 你的人生主线不是 “AI”,而是 “把复杂时代翻译成人能行动的方法”
5. 家庭和身体不是 “等事业稳定后再照顾” 的东西
@aigc1024
🔥欢迎各位老板加入i8国际娱乐城!
okpay上押500万u担保 放心赢
无需绑银行卡 无需绑手机号 不限ip
新人注册首充最高送
无限代理模式,业内最高佣金
👍资金安全保障,赢球更安心!
【人民币入口】 i89972.com
【 USDT入口 】 i8361.vip
【世界杯入口】 i83511.vip
i8国际娱乐平台 #i8 #世界杯 #真人 #PG电子 #棋牌 #捕鱼 #彩票 #百家乐
岗位:端到端模型算法研究员
要求:博士优先,具备完整的Robotaxi/自动驾驶端到端模型研发、仿真测试、实车落地及量产迭代全栈经验;有世界模型、扩散模型在自动驾驶驾驶策略、场景生成、风险预测方向的落地研究经验。
Base:上海、北京
薪酬:150W
@aigc1024
要求:博士优先,具备完整的Robotaxi/自动驾驶端到端模型研发、仿真测试、实车落地及量产迭代全栈经验;有世界模型、扩散模型在自动驾驶驾驶策略、场景生成、风险预测方向的落地研究经验。
Base:上海、北京
薪酬:150W
@aigc1024
某具身智能公司疯狂买通稿和水军营销自己刚拿到地方zf大订单。实际看一下其他标方,典型的围标操作。
并且这个订单,地方为什么要花这么多钱买基本无法解决任何实际工作问的机器人?
现在的链条就是,地方建设机器人数据采集中心-大量采购某公司的机器人-放进数采中心采机器人运行数据-数据卖给具身智能公司旗下的数据平台。
没有任何人亏钱,但是一分钱可以为地方和具身智能公司账上提供三笔收入。
同时,目前各家具身公司的基座算法都不支持泛化迁移。这也就意味着,你用A型号的机器人采集的数据,只能用来喂给A型号机器人做调试,他不支持给B机器人用,甚至不支持给做了些许改良的A1.5型号机器人用。
经济要发展,还是得靠左脚踩右脚上天
@aigc1024
并且这个订单,地方为什么要花这么多钱买基本无法解决任何实际工作问的机器人?
现在的链条就是,地方建设机器人数据采集中心-大量采购某公司的机器人-放进数采中心采机器人运行数据-数据卖给具身智能公司旗下的数据平台。
没有任何人亏钱,但是一分钱可以为地方和具身智能公司账上提供三笔收入。
同时,目前各家具身公司的基座算法都不支持泛化迁移。这也就意味着,你用A型号的机器人采集的数据,只能用来喂给A型号机器人做调试,他不支持给B机器人用,甚至不支持给做了些许改良的A1.5型号机器人用。
经济要发展,还是得靠左脚踩右脚上天
@aigc1024
AI NEXT「疯享会」上海站来了,下周二见。这场会看到几类很具体的 AI 产品:
🔹从 Z 世代潮玩切入的AI 肩上宠物「Blinkko」
🔹押注 Agent 开发新范式的「Trellis」
🔹将 AI 陪伴与实体玩具相结合的「wander puffs」
🔹用 AI 普惠大学生职业规划的「艾迹」
闭门局,只聊一件事:你在用 AI 解决什么真实问?带着产品、故事和最近想不明白的问来。报名方式详见置顶评论~
@aigc1024
🔹从 Z 世代潮玩切入的AI 肩上宠物「Blinkko」
🔹押注 Agent 开发新范式的「Trellis」
🔹将 AI 陪伴与实体玩具相结合的「wander puffs」
🔹用 AI 普惠大学生职业规划的「艾迹」
闭门局,只聊一件事:你在用 AI 解决什么真实问?带着产品、故事和最近想不明白的问来。报名方式详见置顶评论~
@aigc1024
🔥 汇聚全球顶级赛事盘口
⚡️ 沙巴 · 熊猫 · 皇冠
💥 引爆世界杯巅峰竞猜热潮!
懂的都懂 · 老用户继续来吧,只做实力
🏆3月某盘口老板当天提现63万USDT
🏆3月某盘口老板再次实力喜提350万USDT
🏆3月某会员充值50000U提现2700000U
💎 储备金亿U · 实力护航 · 长久稳定运营
点击有惊喜
关注
掌握东南亚一线动态,看清风向料定先机。每周抽取100名TG会员,发言积分兑
TG体育投注平台最优选
赛事信息、玩法展示
快捷提交、状态查询
全部在 Telegram 内完成
文字直投
“ xx 让球 100”
输入球队名xx,发送消息,点击即可完成确认。
一键投注
/today@wjty
发送指令,当日赛事点击即投。
😃 😃 😃 😃 😃 😃 😃 😃 😀 体育首周包赔体验!😀 开赛日免费领😀 😀 启动金⚽️ 赛事竞猜瓜分😀 😀 😀 😀 😀 😀 😀 😀 😁 全新代理模式佣金高达😀 😀 🫤
大事件 体育馆 吃瓜偷拍
商家群 小说区 无码传媒
——————————————————
——————————————————
#G7环球 #G7环球娱乐 #世界杯