光电融合芯片落地,Token成本有望减半

源自62位全网作者

07-20 19:13

精选参考来源

1
#AI行业要重新洗牌了#作为行业标杆、国货AI代表,拥有2.8万亿参数、百万级上下文窗口的开源模型Kimi K3,彻底击碎“国内AI长期落后海外”的固有偏见。在Arena测评榜单中,K3拿下1679分登顶,力压GPT、Claude系列顶尖闭源模型,榜单官方评价其动摇海外AI巨头垄断格局,马斯克亦给出高度认可。它不止实现技术参数反超,更以近乎顶级的性能、减半的使用成本,用开源打破闭源壁垒。如今国内AI迭代速度日新月异,中外技术鸿沟持续收窄。旧有的海外AI霸权秩序正在瓦解,属于国产开源创新的全新智能时代,已然拉开序幕。
2
DeepSeek又出手了,这一次直接打穿了价格底线。近日,DeepSeek正式发布V4预览版并开源:百万字超长上下文,Agent能力大幅提升,世界知识和推理性能双项领先。同一时间,V4-Pro API价格永久调整为原价的四分之一:每百万Tokens输入,缓存命中仅0.025元。创全球大模型价格新低。这不是第一次降价。DeepSeek的打法一直很清晰:用性价比把OpenAI和Anthropic拖入价格战,自己靠出货量赢。数据显示,换用中国大模型后,推理成本降幅达30%至95%,性能差距却只有1%至4%。定价低六到九成。美国企业正在用钱包投票。Coinbase把中国大模型设为工程师默认工具,Lindy因API费用超过全员工资直接切换,DeepSeek已连续七周登顶海外市场。与此同时,首轮融资规模扩大至700亿元,国家大基金领投,估值450亿美元。DeepSeek的目标不只是中国市场。它要做的是全球基础设施。中国AI出海,你看好吗?
全部
来源
内容由AI生成

精选参考来源

1. #AI行业要重新洗牌了#作为行业标杆、国货AI代表,拥有2.8万亿参数、百万级上下文窗口的开源模型Kimi K3,彻底击碎“国内AI长期落后海外”的固有偏见。在Arena测评榜单中,K3拿下1679分登顶,力压GPT、Claude系列顶尖闭源模型,榜单官方评价其动摇海外AI巨头垄断格局,马斯克亦给出高度认可。它不止实现技术参数反超,更以近乎顶级的性能、减半的使用成本,用开源打破闭源壁垒。如今国内AI迭代速度日新月异,中外技术鸿沟持续收窄。旧有的海外AI霸权秩序正在瓦解,属于国产开源创新的全新智能时代,已然拉开序幕。

2. DeepSeek又出手了,这一次直接打穿了价格底线。近日,DeepSeek正式发布V4预览版并开源:百万字超长上下文,Agent能力大幅提升,世界知识和推理性能双项领先。同一时间,V4-Pro API价格永久调整为原价的四分之一:每百万Tokens输入,缓存命中仅0.025元。创全球大模型价格新低。这不是第一次降价。DeepSeek的打法一直很清晰:用性价比把OpenAI和Anthropic拖入价格战,自己靠出货量赢。数据显示,换用中国大模型后,推理成本降幅达30%至95%,性能差距却只有1%至4%。定价低六到九成。美国企业正在用钱包投票。Coinbase把中国大模型设为工程师默认工具,Lindy因API费用超过全员工资直接切换,DeepSeek已连续七周登顶海外市场。与此同时,首轮融资规模扩大至700亿元,国家大基金领投,估值450亿美元。DeepSeek的目标不只是中国市场。它要做的是全球基础设施。中国AI出海,你看好吗?

3. #副局长自购10亿token月费20多# ① 10 亿 token 为什么只要 20 多?token 是大模型的最小运算单位,可理解为 AI 的 “计算流量”。不同模型定价差异极大,高端旗舰模型百万 token 收费数十元,而轻量化通用模型成本极低。该副局长订阅的是平价年卡套餐,折算后百万 token 成本不足 0.2 元,10 亿 token 分摊 20 余元完全符合市场行情。② 会不会泄露涉密信息?小程序设置四级分级权限,不同层级仅能查看对应范围的数据;隐患点位为公开信息,底图采用官方天地图,从权限机制到底层数据都做了合规处理,不存在泄密问题。

4. 清华系“Token工厂”半年融资超10亿,AI Token生产是一门什么生意?今天聊一家可能被低估的公司。7月13日,趋境科技宣布完成A轮融资,半年累计融资超10亿元。这家清华系公司做的是AI Token生产服务,定位是“AI Token工厂”。它的核心产品ATaaS平台,解决的是模型在实际生产环境中的推理效率、资源利用、缓存复用、弹性扩缩容、成本控制这些脏活累活。目前已建成日均万亿级Token产能项目,部分业务已经盈利。这很重要。我在苏州园区接触过很多AI应用创业者,大家张口闭口都是模型能力,但真到落地,才发现推理成本、并发稳定性、延迟控制才是生死线。趋境科技切的就是这块,而且由郑纬民院士、武永卫教授领衔技术班底。它不是做应用的,而是给所有做应用的人提供“水电煤”。这和当年云计算刚兴起时的逻辑一样:应用百花齐放,但底层基础设施才是最稳的生意。当然,阿里云、华为、百度、字节这些大厂也在做,创业公司必须在特定场景里做出差异化。我的判断:AI infra接下来两年会是大浪淘沙,谁能帮客户把Token成本压下去、稳定性提上来,谁就能活下来。如果你现在创业,你会做AI应用,还是做AI基础设施?

5. 从GRPO到OAR:大模型数学推理训练的Token级信用分配实战

6. #副局长自购10亿token月费20多# ▫️ 成本真相:订阅国内大模型年套餐 200 余元,开发阶段累计消耗 10 亿 token,分摊成本仅 20 余元;▫️ 开发初衷:往年防汛需连夜组织人员打数万分钟电话确认群众转移,耗时耗力;小程序可实时同步雨情、隐患点与转移状态,大幅提升效率;▫️ 个人背景:土木工程专业出身,保持编程爱好 20 余年,借助 AI 辅助完成开发,可根据基层需求快速迭代功能;▫️ 数据安全:设置管理员 - 区级 - 镇级 - 村级四级权限,仅可查看权责内信息;隐患点为公开信息,底图采用天地图,无涉密风险。

7. #微博声浪计划##听见微博# 中国AI模型价格优势突出,Token单价低至美国1/4到1/8,高频场景下不用中国模型反而需向CFO解释。价格优势源于架构优化、人才成本、电力成本和市场策略。市场反应积极,中国模型在Agent和代码生成领域占比超85%,美国企业采用率显著增长。 谯华的微博音频

8. Kimi K3再掀“DeepSeek时刻”?美股芯片盘前普跌,高盛警告"算力扩张时代"或已走到尽头

9. #10亿token多少钱# = 分摊下来只有20多块钱近日北京一干部自制防灾小程序消耗 10 亿 token 引发热议,不少人好奇 10 亿词元实际成本差距极大,价格区间从二三十元到数万元不等。北京市规划和自然资源委员会密云分局副局长谢陨石表示,国内平价轻量化模型套餐优惠力度拉满,包月包年模式下,10 亿 token 分摊成本仅 20 余元;按量计费的高性价比国产推理模型,10 亿 token 约两千元。(长安街知事)

10. #中国自研AI芯片取得架构突破##中国AI芯片不依赖先进制程# 通俗一点讲:如果只做软件定义、传统平面存储:算力可编程,但数据搬运慢,大吞吐量场景性能上不去;如果只做 3D 近存、硬件功能固化:数据吞吐很强,但场景单一,换业务就要重新流片,成本高、迭代慢。上海东方算芯科技有限公司的DF1000 采用 14nm 成熟工艺,BF16 算力 520TFLOPS,配套全栈自研编译器、算子库与智算集群整机方案,主打国产自主云端大算力场景。该公司掌舵人魏少军行业地位:清华大学长聘教授、国际欧亚科学院院士;曾任中国半导体行业协会副理事长,国内集成电路产业权威专家;长期主持国家重大算力、集成电路专项,兼具学术、产业、政策三重资源。智车驿站

11. 百度千帆Token Plan实测:DeepSeek-V4、GLM-5.2、Kimi-K2.6,同一个任务谁更强?

12. 27.58万亿Token!中国大模型周调用量达美国四倍,应用生态进入爆发期说个可能被忽视的重要数据。据每日经济新闻基于OpenRouter的测算,上周全球大模型总调用量54.6万亿Token,其中中国大模型调用量达到27.58万亿Token,占全球一半以上,环比再增17.61%。更夸张的是对比:美国同期调用量约6.33万亿Token。中国调用量已经是美国的四倍以上,而且连续七周增长,连续十一周超过美国。我在新媒体这行感触很深。前两年大家还在讨论"大模型有没有用",现在身边的团队每天睁开眼就是调API、跑工作流。写文案、做客服、拆数据、生成图片、辅助编程——调用量涨得最猛的地方,就是AI真正落地的地方。在苏州那会儿,我看过不少AI创业团队。他们不关心谁的模型参数最大,只关心调用成本能不能再降一降、响应速度能不能再快一点、输出质量能不能更稳定。这说明中国AI已经从"技术崇拜"进入"成本敏感"的实用阶段。我判断:调用量只是开始,接下来真正的竞争是"谁能把高调用量转化为用户留存和商业变现"。你最近高频使用哪个AI工具?评论区聊聊。

13. 推理成本降50%,英伟达裂了

14. 1792TOPS算力!国产AI芯片暴降token成本,CEO揭秘4大技术诀窍

15. 256*256矩阵规模!WAIC首发目前国际算力密度及精度最大光计算芯

16. CPO 行业深度报告复盘|AI 算力驱动光电共封装产业进入高速增长周期(31页报告)

17. 用光子算数学:中国造出全球最大光计算芯片,耗电直降99%

18. 英伟达力推CPO!光互联三大技术谁将胜出?

19. 256*256矩阵规模!WAIC首发目前国际算力密度及精度最大光计算芯片

20. CPO产业链:光与芯片的终极合体

21. 硅光芯片:成本暴降60%,海外巨头垄断十年的壁垒,被广东打破

22. 【人工智能】突破算力存储瓶颈!光本位全球首发 256×256 光子存内计算芯片,开启光电融合千 TOPS 时代

23. 光本位作为重点企业亮相WAIC生态展,全球首发256×256光子存内计算芯片

24. 每Token成本定成败:Vera Rubin如何改写AI基础设施法则

25. 光本位科技 | 全球首发256*256光子存内计算芯片

26. AI|深度:Token工厂产业链崛起——从芯片到推理的全栈重构

27. 中天科技光电协同智算中心落地:光-电-算全链路自研重构算力基建成本曲线

28. 理事单位动态 | 南通首座"光电协同智算中心"动工,算力基础设施的差异化路径

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章