All posts

17 threads

July 20264 threads
A Fireside Chat with Cat and Thariq from the Claude Code team>对于 Fable 5,甚至 Opus 4.8 这样的模型,在系统提示词中添加示例已不再是最佳实践。Claude Code 的系统提示词最近缩减了 80%。 >同样,“不要做 X,也不要做 Y”这类列表可能会降低最新模型输出结果的质量。 所以 harness 需要针对不同的模型设置不同要求的提示词,目前 Claude Code 是这么做的。这一点应该对所有前沿模型都适用hh 这就是非 OpenAI 和 A\ 公司做 harness 的劣势,只有等到基础能力模型的能力相对稳定后才能慢慢跟上这两家的能力。
国内大模型蒸馏风波的来龙去脉看了一下,感觉第二个的判断没啥问题,我也不懂+没内幕消息,觉得: 1. 肯定蒸馏了 2. 大模型的技术没多高深,国内也有能力,差距并没有很大
4 Replies
A Decade of CVPR" Real tasks " 又有多少轮得到 academia 做贡献: academia 看得到 bitter lesson, 却没有先进的认知去理解如何做 scaling, 判断什么方法是 scalable 的, 更遑论有足够的人才和算力去做真正的 scaling. 试图提出 "新范式", "统一架构" 的工作, 不少无非是对 bitter lesson 的拙劣解读, 在并不重要的问题下扑棱一下翅膀. 在今天 frontier labs 的 scale 下, academia 已经基本失去了在 real tasks 上 "评价一个方法是否有效" 的话语权.
范岱年口述自传《行走在革命、科学与哲学的边缘》这跟抗战期间林彪、 彭德怀等发动的共产党仅有的两次略有规模的对日作战——平型关战役和百团战役——反因暴露实力, 有悖于借国难壮大自身的基本方略, 而受到毛泽东批评如出一辙。
May 20268 threads
docker compose 中写连续端口映射会导致内存爆炸,神奇
1 Reply
为什么要写作写作是另一种形式的思考/强迫你思考的手段 AI可以替代写作,但是无法替代思考。
Building Pi With Pi请记住,人工智能并没有增加需要软件的人数,也没有增加能够审查软件的维护人员数量。它主要增加了代码量和竞争关注的项目数量。其中一些是健康的,但很多却分散了本应共享的努力。
今天上午的洗牙也太快了,从坐下到结束应该都没有10分钟,虽然去年的痛苦经历还历历在目,但是今年这次是不是有点过于敷衍了,最后都没有给抛光,还夸了口腔卫生不错(去年让我做龈下刮治orz)
Repairing the Ruins: Why AI Can’t Replace Education人工智能对教育意味着什么?
阿里云轻量服务器(峰值200M)由于接了 IXP 服务,被官方关停了。(猜测,毕竟也只跑了这个转发服务)。 您的轻量应用服务器实例XXX由于发布、传播违法不良信息,严重违反了 《阿里云服务条款》 及《互联网信息服务管理办法》第十五条规定,阿里云已将该实例关停锁定,详细说明如下: 违规URL示例: IP 违规原因: 发布传播违禁器具软件类违法违规内容
最近几周云顶导致睡的太晚,某天早上醒来喉咙疼痛才意识到免疫系统抗议,这两天早睡,感觉状态好多了。
又一个博客平台 Jant尝试一下 Owen 的新作品,一个看起来挺舒服的博客平台。静态博客的发布确实有摩擦力,即使我设置了 Makefile 一键从 Obsidian 中发布。