北京酒吧推"Token免费畅饮":连WiFi就能白嫖DeepSeek V4 Flash
图片以后去酒吧,别人给你递酒,程序员给你递API Key。
北京一家叫AGI Bar的酒吧宣布推出"Token免费畅饮"服务——顾客到店消费、连上店内WiFi,就能免费使用DeepSeek V4 Flash的API。不限token,不限量,喝多少酒不重要,重要的是你的代码能跑多远。
图片操作方式也很极客:店家提供Base URL和API Key,你在Cursor、Claude Code、Codex、Cherry Studio等工具里直接填上就能用。背后的算力不是走的云端,而是酒吧自己采购的英伟达DGX Spark AI工作站,所有推理都在本地完成。
图片一个卖酒的地方,自己搞了台服务器,让你边喝酒边写代码。
这画面,想想就魔幻。
为什么是DeepSeek V4 Flash?
这家酒吧选DeepSeek V4 Flash做免费算力,不是随便选的。
DGX Spark是英伟达面向开发者的桌面级AI工作站,算力和显存都有限,跑不了千亿参数的巨兽。但DeepSeek V4 Flash的激活参数只有130亿,总参数2840亿(MoE架构),恰好能在单台设备上高效运行。
更关键的是,V4 Flash的Agent能力极强——Terminal Bench 82.7、NL2Repo 54.2、Toolathlon 70.3,在编码、工具调用、多步推理这些"写代码真用得上的场景"中表现突出。对于酒吧里坐着的程序员来说,这比什么文本生成、创意写作的跑分有用得多。
换句话说,AGI Bar选的不是"最便宜的模型",而是"程序员最需要的模型+单台设备能跑起来的模型"的交集。DeepSeek V4 Flash恰好卡在这个位置上。
AGI Bar不是普通酒吧
AGI Bar本身就是一个AI行业的"据点"。
这家酒吧主打程序员和AI创业者交流,由长期参与AI创业领域的人士创立,目前在北京和上海各有一家。Midjourney创始人David Holz去年访问中国期间,专门跑到AGI Bar和开发者交流。
所以"Token免费畅饮"不是营销噱头,更像是这个圈子的"入场券"——你来这里不是为了喝杯酒,而是为了遇见对的人,顺便让AI帮你把代码写完。
这种模式其实不新。硅谷的咖啡馆早就把"免费高速WiFi+电源插座"当成标配,吸引程序员泡一整天消费。AGI Bar做的事情,只是把"WiFi"换成了"API"。
算力正在变成"WiFi"
这件事真正有意思的地方,不在于一家酒吧搞了个营销。
而在于它暴露了一个趋势:当大模型推理成本降到足够低的时候,"算力"正在从稀缺的生产资料,变成和WiFi一样的消费场所基础设施。
想想几年前的场景:要跑大模型推理,你得租GPU云服务器,按小时计费,动辄几块到几十块一小时。普通开发者根本用不起,更别说一个酒吧了。
而现在,一台几万块的DGX Spark就能在本地跑DeepSeek V4 Flash,成本是酒吧一个月的电费,顾客免费无限用。
这个变化的底层逻辑是:模型效率的提升+硬件的降价+开源生态的成熟,三者叠加,把推理成本砸到了一个"任何商业空间都能承担"的水平。
往前推演一步:如果咖啡酒吧能提供免费AI算力,共享办公空间呢?联合办公的工位呢?甚至图书馆、酒店大堂呢?
当"连WiFi送Token"变成和"连WiFi看视频"一样的标配,AI就从"你打开手机找的工具"变成了"你走到哪都在的空气"。
结语
AGI Bar的"Token免费畅饮"目前还是一家店的探索尝试,规模有限,也不确定能否持续。但它指向的方向很清晰——
AI基础设施正在经历"咖啡馆化"。
就像2010年代,咖啡馆用免费WiFi抢走了星巴克的商务客人;2020年代的AI酒吧,正在用免费API抢走云服务器的开发者时间。
区别在于,WiFi的边际成本趋近于零,但AI推理的边际成本虽然大幅下降,仍然不为零。AGI Bar能用一台DGX Spark撑住,前提是DeepSeek V4 Flash足够便宜高效。如果换Claude Opus 5或者GPT-5.5,一台工作站可能几小时就被喝破产了。
所以这件事的另一个侧面是:中国大模型的性价比,已经低到了一个可以"在酒吧里免费畅饮"的程度。
前几天央视报道OpenRouter全球调用量前五全是中国模型,大家讨论的是产业格局。现在北京一家酒吧用一台桌面工作站就让顾客免费用上了旗舰级Agent模型,大家看到的是产业格局的微观落地。
宏观和微观在这一刻合上了:不是因为中国模型便宜所以有人拿来搞噱头,而是因为中国模型真的足够便宜、足够好用,才有人敢把它当成酒吧的标配服务。
下次去北京出差,可以去AGI Bar坐坐。不喝酒也行,连个WiFi写几行代码,反正Token不要钱。
