即刻App年轻人的同好社区
下载
App内打开
歸藏
567关注28k被关注51夸夸
产品设计师、模型设计师、 不会代码的独立开发者。
关注人工智能、LLM 、 Stable Diffusion 和设计。
歸藏
17:38
Deepseek 的多模态能力终于上了!是一个单独的模型,Deepseek V4 Flash Vision EXP。

他们说这个模型在多模态 Agent 上的能力已经逼近了 Opus 4.8。

纯文本能力跟 Deepseek V4 Flash 一样。在价格上,DeepSeek V4 Flash Vision EXP DeepSeek V4 Flash 保持一致。

同时 DeepSeek Harness 已经第一时间支持了这个模型。

还同时发布了文件 API,免费使用,上传过一次的图片,再用文件的 ID 重新引用的话,可以免去重新上传
44
歸藏
3天前
豆包手机控制和云电脑做得比Codex牛皮呀!

刚才看豆包上线了云电脑模式,而且它还能支持手机控制本地电脑。

我觉得它在手机控制电脑的连接设计上做得非常自然,体验极佳,甚至比 Codex 那些好太多了。

你只需要在本地电脑发起聊天,手机上就能直接同步看到,然后只需在手机上点一下授权(电脑端完全不需要任何操作),就可以直接获取控制权。

之后你就能通过手机操作电脑上的任务,响应速度极快,延迟极低。
这次还增加了一个云电脑模式。虽然云电脑本质上是给你分配了一个虚拟机,很多人觉得上面没有自己的数据和信息,干不了什么事。

但我觉得它内置的连接器(比如我们常说的 MCP)挺有意思的。它可以直接连接你的Notion、GitHub、飞书、企业微信等应用,直接从中获取你的上下文。

同时,云电脑也是可以安装 Skill 的。比如我试了一下:

先让它在云电脑端查找我飞书里所有的会议纪要,并整理出待办事项。
整理完待办后,我通过手机下达指令,让它在云电脑上安装了我自己开发的社交媒体卡片 Skill。

接着再让它基于这些待办事项去跑任务。

在这个过程中,安装 Skill 的命令是我在手机上下的,而阅读会议纪要的命令是在电脑上下的。无论是云电脑还是本地电脑,这种跨端控制的体验都非常丝滑。

在本地电脑上,我也试着让它查找对应目录的文件,并清理了一些大文件,这充分发挥了本地电脑的优势。当然,在有了这个系统以后,我们在手机上同样可以下达对应的清理任务,并直接看到结果。

还有一个玩法我觉得特别有意思,就是把手机控制电脑当作“文件传输助手”来用。

比如我在发手机截图的时候,直接指令它“只接收图片,不要做任何操作,不用管它”,它就真的只接收而不做多余响应,非常听话。

如果你想这么用,建议可以单独开一个聊天窗口,专门把它当作文件传输助手。

在开始时给这个聊天设置一个提示词,告诉它“凡是发送的文件和图片,接收即可,不需要做任何多余响应”,这样就非常好用了。
715
歸藏
4天前
终于搞定了!给 DeepSeek Harness 做了一个开箱即用的客户端 Pilot Harness。

这个客户端主要由两部分组成:
一个是客户端的壳;另一个是所有的优化,它们本质上都是 DeepSeek Harness 的插件。

也就是说,你既可以直接使用我这个客户端(默认加载所有插件),也可以只挑选对你有用的插件,安装到你自己的 DeepSeek Harness 里面。

这里面主要包括三个插件:

1. UI 和交互优化插件:优化了 DeepSeek Harness 本身一些有问题的展示方式、样式以及交互。

2. 文件树插件:你可以在聊天界面的右侧展开当前项目的文件树,快速将文件添加到聊天中,或者直接打开对应的文件。

3. 模型服务商和模型管理插件:优化了模型服务商的添加流程和模型管理的页面,将模型管理和服务商管理分开,更加直观,并且添加了很多图标和描述,界面更加清晰。

详情:github.com
49
歸藏
5天前
我去!这个太有意思了。

谁不想在等 AI 完成任务的时候玩上一把德州并且把自己的 Token 输光呢
3555
歸藏
5天前
卧槽,原来现在还是能以每个月 99 美元的价格,订阅 Grok Harvey 这个级别的会员,这个超值!

你相当于一下获得了:

1. 价值 300 美元的 Grok Harvey(包括 Grok Build 权限)

2. 价值 200 美元的 Cursor Ultra 会员,还有 Fable 5 的额度。

3. Grok Bot 的独立额度(这三个额度都是独立的)

4. Grok Image 和 Video(图像与视频模型)的额度

5. 会自动送你一份 Twitter Premium+ 订阅

折合下来只要 700 块钱一个月,简直夯爆了!

尤其是 Grok 后面还有更强的模型要发布。

可以看一下具体的使用路径:

1. 准备 Grok 账号:先登录一个 Grok 账号。

前提条件:如果你之前是用 Twitter(X)登录并订阅的,需要先取消 Twitter 订阅(取消后不会立即生效,所以我建议直接注册申请一个新的 Grok 账号。虽然新账号没办法共享你原有的 Twitter Premium,但这次订阅)。
如果是用旧账户或者 Twitter 授权登录,操作起来会有点麻烦,所以强烈建议用新账户注册。

2. 订阅促销活动:

先去第一个链接(grok.com),订阅获取两个月的 Super Grok 促销。

订阅成功后,再去下面第二个地址(grok.com),订阅连续三个月 99 美元的 Super Grok Harvey。

注意:后续记得及时取消订阅,否则到期后会恢复成 300 美元/月。

3. 绑定 Cursor 会员:

下载并登录 Grok Bot,登录时有个选项会要求选择 Cursor 授权登录。

这个时候,只要你有一个相同邮箱的 Cursor 账号(如果没有,就用这个邮箱注册一个),系统就会自动给你充值 Cursor 的 Ultra 会员。
523
歸藏
6天前
正在给 DeepSeek Harness 做一个界面和交互美化的插件。

还有一个服务商的插件,这样整个产品体验会好一点,后续也会打包成一个客户端。

这主要是把 Codepilot 里面沉淀的一些资产抽离出来,然后做到这个 DeepSeek Harness 的插件里,这样整个使用体验和视觉效果都会变好不少。

看了一些现有的美化插件,基本上都是改改背景图、加一两个组件效果什么的,感觉对于长期使用和用户体验没什么多大的帮助。
83
歸藏
6天前
CodePilot 这几天也有不少的更新:

1. 支持了新发布的 Grok 4.6、DeepSeek V4 Pro 以及 GLM 5.3 模型。

2. 支持将你 Grok 会员里的图像模型甚至视频模型的额度,也都在 CodePilot 里面使用。支持对 Twitter 进行检索。

这样的话,你只要有一个 Twitter 会员,就可以在 CodePilot 里面白嫖 Grok 的图像、视频模型以及 Twitter 检索服务。

详情:github.com
00
歸藏
8天前
15 张数据图帮你了解 DeepSeek Harness

昨天 DeepSeek Harness 发布,于是就想着让 Codex 分析一下,找到了一个很好的角度,就是从一些数据上向大家介绍这个产品。

确实也发现了一些很有意思的东西:

插件系统与 Koishi 高度相似: 他们主打的插件系统与 Koishi 的插件平台相似度高达 75%。大概率是整个平台都挪过来了,不知道是不是他们的核心开发者入职了。

大量使用 AI 开发: Codex 命名的主干 PR 达到了 21.2%,分支信息中提到 Codex 的比例有 28.2%。 猜测他们肯定用了 Claude Code 开发,只是删掉了一些 Claude 的痕迹。

参考了大量外部 Agent 项目: 提到最多的外部项目是 Pi,第二多的是 Codex,之后是 Claude Code。甚至直接引用了一些 Pi TypeScript 文件。

高效的代码产出: 整个产品在 GitHub 上有记录的是 65 天,总共的代码产出量是 84 万行,有一万多个 commit,非常高效。

交互入口的演变: 他们曾经押注 TUI,后来改成 Web UI TUI 的双入口,再之后整个删除了所有的 TUI,只留下了 Web UI。

开发与工程规范: 整个项目的测试代码比生产代码多很多,基本上达到了 1:1。 全仓库的 Markdown 文档也非常多,说明他们是基于文档去控制 Harness 开发的。他们有完整的工具和科学模型 schema 52 个,但最后只留下了一个,目的是为了减少上下文占用。

社区热度与生态:从昨天发布到现在 20 小时,GitHub 已经涨到了 8 万多的 star,非常快。插件体系标签(DSH plugin)已经有 1425 个项目,但有很多并不是真正的插件,看来有不少蹭热度的。 精选清单收录了 211 个仓库,主要补充的是工具、UI 和运行的一些基础设施,甚至一上来就出现了插件市场和插件管理的插件。

学术论文: 他们顺便发了一篇 88 页的论文,其中 57% 都在做一些形式化的理论推导和展示。论文主要讨论的是插件的热插拔和系统稳定性问题。
01:36
09
歸藏
8天前
GLM-5.3 发布了,看了一下,着重提升的主要是两部分:

1. 安全能力:看来 Hugging Face 在拿 GLM-5.2 防御了 OpenAI 的模型入侵以后,智谱也看到了这方面的价值,尤其是大家最近都在聊这块,他们针对性地做了一些优化。

2. 长程任务的执行:
比如终端里的任务、工具调用,以及大代码库的修复任务,都有非常大的提升。

这个模型依然是只进行了后训练,没有重新进行预训练。这都几个版本了,还能有这么大的提升,确实猛啊!
20