即刻App
年轻人的同好社区
下载
App内打开
青年李大猫_全栈版
57
关注
1k
被关注
1
夸夸
在 Manus 搞全栈(代码,产品设计,装修) 简历投递 fanbin@manus.ai
青年李大猫_全栈版
8天前
对不起奥特曼,我承认我之前笑的太大声🥹
敬请欣赏:
《戴森球结构中的黑洞探索》
— by gpt-6-astra in Manus
00:54
8
2
3
青年李大猫_全栈版
10天前
😍😍
胡迪Hoodie: 如何 eval agent 产出的调研报告是否易读? 分享我们 team 实践中用的一个简洁指标——「隐喻率」: 隐喻是常见的语言学现象,简单理解就是在句子中“悄悄”使用比喻。 来感受一个隐喻率很高的句子: “全栈 AI 帝国率领评估军团与标注大军,向全球 Tier 1 俱乐部发起冲锋,踏上下一阶段的马拉松。” 句子里的“率领”“发起冲锋”“踏上”都是明显的动作隐喻;“AI 帝国”“评估军团”“标注大军”“全球 Tier 1 俱乐部”“马拉松”共同构成了竞争与征战的意象。 但这句话其实完全可以写成: “全栈 AI 体系由评估团队和大规模标注团队组成,目标是冲击第一梯队,并参与下一阶段的长期竞争。” 隐喻让这句话变得更加抽象和复杂,你的大脑需要处理一下才能让句子返璞归真,这就降低了报告的易读性。 其实,隐喻的存在本身是希望通过把陌生、抽象的概念类比成更熟悉的概念,从而帮助理解。但 LLM 高密度、不适宜的隐喻使用,很可能把抽象的概念表达得……更抽象。 而且,从数学上讲,隐喻更本质的影响是:它作为一个把 x 词映射成 y 词的“语言函数”(y=f(x)),势必会带来信息的损失(y 的信息量一定小于等于 x)。 综上,我们构建了隐喻率指标(图1&2):每一百句话中出现多少次隐喻表达。通过隐喻率指标,我们可以从一个视角来反映模型的写作特征——更高的隐喻率往往意味着这篇报告更难读,且会带来信息的损失。 我们衡量了来自 9 个主流模型、各自 36 篇不同主题的中英文研究报告的隐喻率。发现 GPT 5.6 系列模型在隐喻使用上更克制;claude-fable-5 毫无疑问地拿下了最高隐喻率的桂冠(图3)…如果你曾阅读过 fable 的作品,就会发现 fable 真的非常喜欢用“臂”“腿”等人体隐喻来指代“组别”的概念 (图4)。而 opus-5 在隐喻使用上反而比 fable-5 更加克制。 当然,隐喻率只是衡量报告易读性众多 signal 中的一个:隐喻率低也并不绝对意味着文章更易读。但如果构建出许多像隐喻率这样简洁、可操作的 signal,我们就一定能更好地把握 LLM 的本来特性。
5
1
0
青年李大猫_全栈版
1月前
typeless,我真的没空陪你闹了!
10
8
0
青年李大猫_全栈版
1月前
亲身体验两个好产品如今患上阿兹海默症,一个是 gemini,一个是 typeless 😭
17
5
2
青年李大猫_全栈版
2月前
什么家底啊🤔
7
2
0
青年李大猫_全栈版
3月前
黄金时代的畅想如今变为现实,却是用另一种更为残酷的方式
11
0
0
青年李大猫_全栈版
3月前
好朋友讨论有种预感 loop engineering 马上要被翻译成“智能体闭环工程”了,简称“智能闭环“ 🤓
9
2
0
青年李大猫_全栈版
3月前
iOS26 里搞的 Files 和 Preview 这两个 App 的逻辑,纯纯是左右脑互搏的感觉……两个 app 几乎一模一样,但是 Files 里面不能预览,看个图片要跳到 Preview,但是又不会把你当前的目录带过去,导致看完一张要看下一张又得回到 Files 里。苹果可能真的离用户越来越远了,这用脚后跟想出来的方案吧🥲
9
6
0
青年李大猫_全栈版
4月前
typeless 这个软件过去 12 小时的耗电量是其他软件加起来的 5 倍…有点害怕,不知道它到底在后台干啥…😨
15
5
2
青年李大猫_全栈版
4月前
See you on the beach 🐙
10
2
0