下周末在北京网吧,我们和 Qwen 联合举办第一届 Bench 黑客松,现场提供充足的 API,Claude、GPT、K3、Qwen 3.8 和泡面管够,欢迎来蹬。
还有伟大的 Kimi、Evolvent AI 和真格基金的赞助支持,现场会有专业打标的家人教大伙如何打标喔不对做 bench。
让大模型的定义权回到真实用户身上,而不是几个研究员决定一切!
ps.这两天最大的发现是,由于模型厂蒸馏太狠,导致市面上基本没有稳定的 Claude API,特别是 Fable 5,所以现场应该没法提供 Fable 5,Opus 5 不出意外可以。