即刻App年轻人的同好社区
下载
App内打开
歸藏
567关注28k被关注50夸夸
产品设计师、模型设计师、 不会代码的独立开发者。
关注人工智能、LLM 、 Stable Diffusion 和设计。
歸藏
17:55
Anthropic 讲解了随着模型的提升,应该如何更新自己的上下文规则,推荐看看。

随着 Fable 5 Opus 5 的发布,他们精简了 80% 的系统提示词,但在编程测评上没有任何损失。

其核心问题在于,Claude 的提示词只是它获取上下文的一小部分,更多的上下文来自于系统提示词、Skills、claude.md 以及 Memory。

这里的难点在于:上下文是跨多个请求通用的,不能像单个提示词那么具体。

他们之前对 Claude Code 的约束过度了,而且经常存在互相矛盾的指令(约束越多,冲突的概率就越大)。

Fable 5、GPT 5.6 这种新模型,完全能够靠上下文和自己的判断力处理很多事情,因此没必要过度约束。

他们总结了过去到现在关于上下文转变几条趋势:

1. 从“给规则”到“让 Claude 运用判断力”:比如旧版会写“默认不写注释”,新版可以改成“写出与周围代码一致的代码”,这样它自己就会去匹配周围代码的注释密度、命名和习惯。

2. 从“给具体示例”到“设计接口”:给具体示例容易让模型变得死板。现在可以给一些设计接口(比如脚本文件的设计),让参数更具表达力,以此来引导它,而不是塞给它具体的示例。

3. 从“全部前置的上下文”到“渐进式披露”:把代码审查、验证等相互独立的信息放在不同的 Skills 里面,按需调用。模型可以通过文件搜索去查找,而不需要一次性塞入。

4. 不在系统提示词和工具描述里重复提示:直接把用法写进工具描述里,不再到系统提示词里去强调。

5. 从“手动记录”到“自动记忆”:以前是在 claude.md里存记忆,现在直接由模型自动记忆,不再依赖手写输入。

6. 从“简单规则”到“丰富的引用”:以前规则非常单一,现在可以把图片、HTML 文件、测试文件、测试代码、函数甚至是评分标准,都作为模型的上下文塞进去。

---

关于如何将这些原则运用到你自己的上下文管理中,有以下几点建议:

系统提示词定位:在系统提示词里明确告诉 Claude 在什么产品里做什么。如果你在构建 Agent,需要投入精力重新编写系统提示词。

保持 [claude.md]或 [agent.md]的轻量:把仓库用途和说明性内容花在最核心的地方(比如已知的坑或缺陷上)。避免把 Claude 一看代码就能懂的事情非要写进 [claude.md]里。

多用 Skills 进行模块化:把需要按需查找的信息打包成 Skills。如果 Skills 过长,需要采用渐进式披露的方式拆分成多个文件。

优先引用代码形式:在使用 @ 引用文件时,优先引用代码。比如引用 HTML 模板的效果,通常比只给设计描述或截图效果更好。

使用自动化工具:他们还提到了 `claude doctor` 这个命令,可以自动帮你精简 Skills [claude.md]文件。

详情:claude.com/blog/the-new-rules-of-context-engineering-for-claude-5-generation-models
00
歸藏
01:08
来了!Opus 5 模型发布,价格跟 Opus 4.8 相同

在测评成绩上大幅优于 Opus 4.8,同时相当多的测评成绩都高于 Fable 5。

终于有个能用的模型了!

要再不出,我感觉 Claude Max 都没必要续订了,性价比过低,4.8 跟屎一样
46
歸藏
1天前
牛逼!黄仁勋开了自己的 Twitter 账号

并且发表了第一篇帖子,力挺开源模型和开源生态!

这是最近美国政府和企业领域关于是否要封禁中国的顶尖开源模型,在持续了好几天的讨论中,应该是第一个明确站队的行业头部 CEO。

主要观点是,美国不应该把 AI 领导力理解成保护几家头部巨头公司的领先地位,否则有可能输掉整个 AI 战争。真正的优势应该来自于开放的模型、算力基础设施、生态应用和广泛的落地。

主要的诉求包括:
1. 为初创公司和研究机构提供更多算力
2. 建设共享数据集、工具和评估体系
3. 不要因为潜在风险而过早地限制开源模型

对于英伟达来说,这种开源模型的存在肯定是对它有好处和有帮助的。他把角度找得很好,即:美国究竟是需要整个美国 AI 生态的繁荣,还是仅仅为了保护某几个公司的利益?

我翻译了一下他的公开信的内容
99
歸藏
2天前
Codex 更新了,现在你可以在 Codex 里直接使用 GPT Live 实时的语音模型。

相较于手机端来说,这个体验简直太爽了!

你完全可以脱离键盘等任何输入设备,纯语音跟 Codex 交互。

比如你戴个带个 AirPods,就可以在家里的任何地方和它对话,用语音询问它生成的结果。

它还可以帮你执行 Codex 上的任何命令,这意味着你所有的 vibe coding 都可以脱离键盘和按键,只靠说话来完成了。

它会一直处于待命状态。如果你像官方演示那样,放个投影或者把电脑连接到电视上,就可以边干活、边玩游戏或做其他事。

即使是上厕所,你都能随时掌握你的 Codex 进度。我刚才简单试了一下,真的很爽!
02:01
613
歸藏
2天前
果然发布了!

Black Forest Labs 发布和开源 Flux 3 视频生成模型,功能非常强大:

1. 基础生成:支持文生视频、图生视频(可以把图片作为参考,也可以作为起始帧)

2. 视频参考生成:支持基于参考片段的视频生成(即从视频参考生成新视频)

3. 视频与音频延长:支持输入视频和音频,并对两者进行延长

4. 关键帧控制:支持基于关键帧的视频生成

5. 多语言对话与多样化排版:支持多语言对话,并支持非常多的视觉风格和宽高比

6. 智能剪辑:支持将单个片段智能串联成更多、更长的多镜头序列

7. 文字与动画:支持生成文字和生成动画设计

8. 图像输出:不仅能生成视频,也支持图像输出

模型会开源,就是 Flux 3 Dev 模型,目前还不能访问,需要申请早期访问。未来几周会开放 API 的访问,之后会开放开源的 Flux 3 版本

详情:bfl.ai/blog/flux-3
00:46
18
歸藏
2天前
前几天的泄露是真的。

王虹和邓煜获得了 2026 年的菲尔兹奖。

这是第一次有中国籍的数学家获得菲尔兹奖,更是第一次有两位中国籍数学家同时获奖。

两位都是在北京上的大学,目前都不在中国:
邓煜目前是芝加哥大学教授
王虹目前是纽约大学科朗数学科学研究所教授

搞笑的是,前几天流传的一张梗图,每个菲尔兹奖数学家都有一些名人名言,邓煜的名人名言是:“哪有好看的百合同人小说?”

不知道当时在知乎跟邓煜对喷数学问题的那个喷子,现在什么想法?
119
歸藏
2天前
Kimi K3 太牛逼了!

HyperFrame 团队用 Kimi K3 复刻了一个非常有名的动效设计师团队的动效视频,还原度非常高。

而且他们的风格非常独特,其实挺难做的。

然后搞笑的是,这个动效设计师团队之前还说 Kimi K3 做不了他们这样的视频,所以你得找他们

详情:x.com/liu8in/status/2080075081959776664
00:16
314
歸藏
3天前
Opus5 模型可能今晚发布
41