即刻App年轻人的同好社区
下载
App内打开
歸藏
567关注28k被关注51夸夸
产品设计师、模型设计师、 不会代码的独立开发者。
关注人工智能、LLM 、 Stable Diffusion 和设计。
歸藏
11:50
昨晚 Claude 发布了 Fable 5.1 Mythos 5.1,两者的权重相同。

输入输出价格和 Fable 5 一样,缓存价格降了 75%。

官方的说法是,按 token 计费的话,典型负载大约会便宜 25%,重度 Agent 负载大概会便宜 45%。

但时间线上全在说 Fable 5.1 的订阅额度消耗得非常快,可能 20 分钟、半小时整个额度就用光了。

而且这模型还有一些更严重的问题:

不支持强制的 tool choice,更早的模型读不了它的 thinking block,导致不能中途换模型,改历史消息会让 thinking 失效。

输出带有不可见的文本水印(这个之前聊过,非常恶心,会导致生成的文案质量变差)

Artificial Analysis Anthropic 做预发布测评的反馈显示:即使缓存降价 75%,Fable 5.1 Max 跑完任务的实际开销依然比 Fable 5 Max 20%,因为它的输出 token 大约是 Fable 5 1.7 倍。

看起来还是挺拉胯的,反而更贵了,再加上隐形文本水印以及无法切换模型这些问题。

是不是意味着一旦它触发了安全护栏,你切到 Opus 5,缓存就直接失效掉了,随后调用成本跟着大幅上涨?
15
歸藏
11:20
李飞飞的 World Labs 发布了他们新的世界模型 Atlas,这个看起来比上一代厉害多了。

通过一张图片就可以创建一个非常完整的 3D 空间场景,你可以在里面随意运动,它也能理解时间的演变规律。

它能将一张或多张输入图像整合进一个共享的空间上下文中,让每张图像都锚定在三维空间中的具体位置,再以此继续生成后续内容,既能保证当前场景的一致性,又能想象出没有看到的内容。

它主要支持三大任务:

生成图像和视频:能从一张或多张参考图出发,以像素级精确的相机控制生成不同角度的图像或完整视频,最长可输出 1 分钟 1440p 的视频

3D 场景重建:用一张或几十张图片重建真实的 3D 场景,直接生成点云、3D 高斯泼溅(3D Gaussian Splatting)等三维结果(图片越多还原越真实),效果甚至超过了专门针对 3D 高斯泼溅优化的模型

时空仿真:能把几台普通手机拍摄的视频重新取景成“子弹时间”效果,还可以为机器人训练生成测试数据

过几周才能用
01:25
09
歸藏
1天前
优化了一下新的 Skill 效果更好了
20
歸藏
1天前
还得是 Twitter,很难想象会跟纳瓦尔本人产生交集
21
歸藏
2天前
Runway 发布的这个新模型 Solaris 挺有意思,他们说是首个界面世界模型,本质上叫新型操作系统,可以逐帧实时生成交互界面。

它生成的视频能根据你的点击和拖动实时发生变化。比如下面这个例子:

向上拖动树,树就会变大
向斜下方拖动壁画,壁画也会变大
把灯拖出来移动位置,它就会放到你拖动到的最终位置,并重新渲染光线和物体之间的交互
点击的话还会弹出一个 UI 选项,让你去变换样式

这一切都是基于视频模型去完成的。

我觉得这个想法和思路还是挺好的,但目前实时生成的问题依然比较大。

主要问题在于延迟、实时生成的成本、一致性,以及连贯性和速度问题
00:12
14
歸藏
5天前
做个 Skill,帮大家分享自己拍的古建筑和国风场景。

迭代一下这几天发。
40
歸藏
5天前
兄弟们得抓紧蹬了,明天有可能还会重置。
74
歸藏
5天前
这个 Midjourney 的代码真不错呀!

暖色比较多,而且比较亮,同时还有点厚涂的感觉,感觉很阳光

--sref 2698223612 --profile e6wl24r
02
歸藏
5天前
OpenAI 宣布在 11 12 号以后,就无法在 Cursor 里面使用 OpenAI 的模型了。

原因是因为 Cursor SpaceX 收购以后,OpenAI 觉得可能会有人在 Cursor 里面用 OpenAI 的模型进行蒸馏。

鉴于马斯克旗下公司之前违反合同的一些经验,OpenAI 决定取消 Cursor 的模型访问权限。

Sam 和老马真是可以的。
22
歸藏
5天前
Vercel推出了一个叫 vgpu 的 WebGPU 库。它的核心是为 AI 智能体设计的一套着色器,既能在浏览器里交互运行,也可以在 Node.js 环境里运行。

它把 WGSL 着色器当作 TypeScript 处理,支持像模块一样导入导出,在打包时具有非常好的扩展性。

而且它在安装和使用时,提供了提示词、CLI、SDK、MCP 等多种方式,去告诉 AI 智能体怎么使用。

我把前几天用智谱 GLM-5.3-Flash 做的那个案例用 vgpu 优化了一下,加了很多细节,比如投影、模糊,以及自定义参数的配置。

vgpu.sh
09