即刻App年轻人的同好社区
下载
App内打开
Max_means_best
1k关注3k被关注3夸夸
海本辍学创业
前创业公司CMO、美元基金SR、模型厂小天才HR、Founder Park运营、AI PM
小红书Max For AI(4万粉
置顶
Max_means_best
2年前
“我喜欢看到欣欣向荣的世界”
​国内已经有很多创业者社群了,但 builder的社群比较少
有时候,不考虑盈利,纯粹做一个喜欢的事情也是挺不错的

————Hackathon Weekly 北京01场纪念
138
Max_means_best
1天前
神了,杨立昆 居然转发了百度的项目??

刚刷推的时候居然发现杨立昆的号里面居然有Unlimited-OCR??

他转发了一条介绍 Unlimited-OCR 的帖子。

Unlimited-OCR这个项目我之前介绍过。
没想到发布一个月后,还能再次冲上 HuggingFace 全球模型趋势榜第三。
目前 GitHub Star 已经突破 16.5 k,HuggingFace 下载量达到 224 万。

Unlimited OCR 真正有意思的地方,是它试图解决 OCR 长文档解析最麻烦的问题。
传统 OCR 通常把 PDF 拆成一页页处理,再把结果拼起来。
遇到跨页表格、公式和复杂阅读顺序,很容易丢失上下文。

Unlimited OCR 的做法是把 DeepSeek-OCR 的全部解码器注意力,替换成一套叫 R-SWA 的机制。
模型始终可以查看全部原始图像,但对于自己已经生成的内容,只保留最近128个Token作为工作记忆。这样一来,KV Cache 不再随着输出不断膨胀,解析到后面也不会越来越慢。

按照论文数据,它可以在32K上下文内一次连续解析数十页文档,输入超过40页后,编辑距离依然低于0.11。

在6000个输出Token时,理论吞吐量比DeepSeek-OCR高35%。

并且一个中国团队开源的3B模型,发布一个月后仍在持续获得海外社区适配并重新冲回全球热榜,还能被杨立昆主动转发。

百度你们这次确实做出了一个全球开发者愿意自己传播的东西啊
21
Max_means_best
2天前
今天晚上各个群都在传一份《国内大模型蒸馏风波的来龙去脉》。

我大概看了一下,很可惜,这更像是一份由外行根据各种流言拼凑出来的 AI slop。

里面的内容有真有假,但几个核心判断基本都经不起推敲。

比如里面声称,智谱在今年 4 月份就已经破解并开始蒸馏 Fable。

这个时间线真的很离谱。

因为 4 月份的时候,Fable (那个时候还是Mythos)甚至还没有正式发布,能够使用的基本都是 Anthropic 的内部测试用户,通过Project Glasswing进行访问。

那智谱是怎么拿到的访问权限呢?

难道是 Anthropic的邀请或者是五角大楼反代吗🤣

还有一个比较典型的问题,是作者对于传闻中DeepSeek 将部分请求路由到 Fable 表示不理解,认为这样算不过来经济账。

实际上,但凡是个从业者或者稍微了解模型公司的研发流程,就知道这件事情不能简单按照 API 成本计算。

如果一个 frontier model 可以帮助你生成高质量训练数据、评测数据,或者提升模型迭代速度,那么获取这些能力本身就是一种研发投入。

用单次调用价格去判断整个策略是否划算,本身就是把模型公司的研发逻辑想简单了。

但最离谱的部分,是 PDF 里面声称 Kimi在 K3 发布前,把整个 RL 团队全部解雇了❓❓

这个说法目前没有任何可靠依据。

实际上情况恰恰相反,根据我的确认Kimi RL 相关团队目前仍然存在,并没有所谓“整个 RL 组被裁撤”的情况。

甚至 PDF 里面还进一步延伸出一套完整叙事:
K3 = 蒸馏 + 刷榜 + 裁撤 RL。

我一开始还在认真的区分哪些是事实,哪些是推测,哪些只是作者脑补出来的故事。

直到我看到 PDF 后半部分开始大量加入意识形态化表达,把技术讨论上升到所谓“国模黑暗时代”“技术偷取”等叙事,我反而释然了。

因为这已经不是在分析 AI 行业,而是在借 AI 叙事讲另一个故事。

PS:我感觉这个PDF是黑KIMI来的,因为KIMI的篇幅最大,但里面的大部分内容都是假的,其他家就有真有假了。
12
Max_means_best
3天前
怎么走上去捡不起来啊😫

hidecloud: 真得像假的😂

00
Max_means_best
4天前
这球能吹掉我建议直接快进到给阿根廷颁奖算了
00
Max_means_best
4天前
独家:阿里Qwen3.8-Max预览版跑分泄露

根据我从阿里内部获得的基准测试结果,Qwen3.8-Max 预览版在编码方面仅落后 Fable 5 12.6 分,而在实际的 Cowork 智能体任务中,其性能已超越 Opus 4.8 Max。

该基准测试涵盖了 400 个实际的智能体任务。

Fable 5 相比,73.2% 的编码任务结果相同。

Cowork 任务中,Qwen3.8-Max 领先:

- Opus 4.8 Max:5

- Kimi K3:8

- GLM-5.2:17.1

- 上一代Qwen3.7-Max:44.4

而这仅仅是预览版。

我的消息来源称,一些已就绪的改进尚未部署,最终版本会更强大。

Qwen3.8 现在的目标是 Fable 5,Opus 已经被超越了。
43
Max_means_best
5天前
AGIbar打工的第一天

未来几天我都在这里,感谢大聪明老师收留一个WAIC被取消门票的人😭
30
Max_means_best
5天前
Flova 这个产品真牛逼啊,不愧是某大厂出来的,我第一次见到有AI产品批量买黑稿的😅

更牛逼的是人不仅批量买黑稿,人昨天还发公众号直接定义了Skill和Skill社区是他们发明的🤣

这太搞笑了兄弟,建议你们找市面上所有做了skill功能和skill社区的产品,让他们赔钱哈

求求你们别把机圈和车圈那套玩法带到AI这边来行不行……
16
Max_means_best
6天前
607