谷歌Omni 1.1 Flash发布,4K视频直出,360p草稿仅需0.03美元每秒

源自161位全网作者

10:53

内容由AI生成

精选参考来源

1. 黄仁勋突然出手,AI开闭源大战正在上演! #大有学问 #红衣聊AI #黄仁勋 #开源 #大模型

2. #智谱发布GLM5.3Flash#GLM-5.3-Flash是目前首个采用稀疏注意力与线性注意力混合架构的开源前沿模型。成功地平衡了顶尖性能与极低成本,为AI技术的广泛应用提供了新的可能。线性注意力捕获局部信息,稀疏注意力则高效处理全局上下文,它不仅能处理文本,还原生支持对图片、视频、文件等多种模态的视觉理解。可用于图像/视频分析、多模态内容创作、智能客户服务等需要结合视觉和语言信息的任务GLM-5.3-Flash视觉能力被无缝集成到编程流程中,能主动观察和理解界面、渲染结果等视觉反馈,结合其高效的架构,能够在处理超长文本时保持精准理解并控制成本。

3. 牛来大模型来自中国!国产芯片大突破

4. 这一次,智谱用GLM-5.3-Flash实现了真正的智能平权。

5. MiniMax H3 新越狱模型!开源无审查,无需 API,本地随心生成视频,附完整部署与使用教程!| 零度解说

6. “牛来”大模型身份曝光

7. #Easy同学正在独立开发#智谱 Z.ai 今天正式发布 **GLM-5.3-Flash**,这是此前以 Ox Alpha 代号预览的模型,官方确认它完全运行在中国 AI 芯片上。GLM-5.3-Flash 是 **320B-A18B** 的 MoE 架构模型,以 MIT 许可证开源,原生多模态,支持 100 万 token 上下文窗口。权重已上线 Hugging Face,API 同步开放,官方还推出了对应的 Coding Plan 和 ZCode 产品。官方在评论区公布了 API 定价,按每 100 万 token 计算:**输入 $0.15,输出 $0.50,缓存命中的输入 $0.03**。对比 DeepSeek 当前的 V4-Flash 定价,GLM-5.3-Flash 的未缓存输入与输出定价均低于 DeepSeek V4-Flash 的低谷价,但缓存命中输入($0.03)高于 DeepSeek 的 $0.007-$0.014。性能方面,在 Z.ai 自家的 Code Bench 评测中,GLM-5.3-Flash 在各级 effort 设置下均优于 GLM-5.2,官方称与 Claude Opus 4.8 表现相当。发布配图对比了 GPT-5.6 Terra、Gemini 3.7 Flash、DeepSeek-V4-Vision-Exp 等多个模型的基准成绩,GLM-5.3-Flash 在 GDPVal-AA 指标上领先。博客:网页链接(由 流苏ªⁱ 撰写)#GLM-5.3-Flash##智谱AI##DeepSeek##开源模型#

8. DeepSeek 官宣视觉模型:官方多模态来了!

9. 神秘「牛来」模型刷屏,还抢了DeepSeek头条,实测到底牛不牛

10. #牛来大模型6天用掉数十万亿词元##牛来大模型来自北京# 8月26日晚,智谱上线并开源GLM-5.3-Flash (320B-A18B),这是GLM-5系列的首个原生多模态模型,已面向全球开源。同日,此前在OpenRouter(全球头部大模型聚合平台)、OpenCode(开源AI编程助手平台)上匿名爆火的模型Ox-Alpha,也被证实来自这家总部位于北京的大模型公司。前沿智能不需要省着用,成了智谱此次发布模型的一大亮点,GLM-5.3-Flash定价约相当于海外知名模型Opus 4.8的40分之一。智谱团队表示,这主要源于GLM-5.3-Flash同时实现的多项架构升级,通过采用稀疏注意力与线性注意力混合架构,技术团队实现了保持精准长上下文能力的同时,大幅降低长上下文服务成本。智谱透露,为收集广大用户的广泛、专业反馈,在正式发布GLM-5.3-Flash前,团队以匿名模型Ox-Alpha在OpenCode和OpenRouter上进行了大规模测试。Ox意为“牛”,恰逢电影《牛来》走红,Ox Alpha也被中文开发者们称作“牛来大模型”。上线后,Ox-Alpha迅速成为当周最受欢迎的模型,创下双平台调用量新高。公开信息显示,从8月20日匿名上线,到8月26日期间的六天,Ox Alpha已经让全球开发者用掉了数十万亿Token(词元)。值得注意的是,这些请求流量全部由国产芯片提供算力支持。智谱表示,这是其首次在大规模流量中尝试用国产芯片集群提供服务,这些芯片均通过自研高带宽互联网络连接。(来源:福布斯中文网)北京日报的微博视频

11. Ox Alpha 匿名模型爆火!免费无限用,百万上下文、支持多模态,安装实测教程来了!|零度解说

12. #智谱发布GLM5.3Flash#智谱GLM‑5.3‑Flash正式对外发布,就是之前在外网悄悄测试一周、引发全网猜测的匿名模型Ox Alpha,也就是大家口中的“牛来”,官宣当晚直接开放模型权重。 采用320B‑A18B的MoE架构,MIT协议开源。总参数规模和GLM‑4.5差不多,但实际激活参数、模型层数几乎砍半。作为GLM‑5系列第一款原生多模态模型,文本、图片、视频输入都可以支持,还给到100万token超大上下文。 混合稀疏与线性注意力架构,重点压低长文本处理的服务成本。先匿名跑真实环境压测,再正式开源,这种发布方式,也给行业提供了不一样的产品验证思路。

13. DeepSeek-V4-Flash-Vision-Exp 现已在 DeepSeek API 平台上线!🚀🔹 此实验性多模态模型在文本能力上与 DeepSeek-V4-Flash 相当——包括代理、推理和世界知识。🔹 在多模态代理基准测试上,V4-Flash-Vision-Exp 相对于 V4-Flash 实现了重大飞跃,使多模态代理性能接近 Opus-4.8。使用 model='deepseek-v4-flash-vision-exp' 试用它。DeepSeek Harness 0.1.1 已于今日发布,内置对新模型的支持。

14. DeepSeek官方宣布,多模态视觉理解模型DeepSeek-V4-Flash-Vision-Exp正式上线DeepSeek API平台。这一天,距离DeepSeek-V4预览版发布过去了119天,距离V4-Flash正式版上线过去了21天。DeepSeek终于在API侧补上了视觉能力这块长期空白 #DeepSeekV4视觉模型上线# DeepSeek补上视觉拼图:多模态Agent赛道进入关键分水岭

15. Grok 4.6 正式发布!马斯克最强 AI 杀进第一梯队,免费使用及部署实测!| 零度解说

16. 「Github一周热点128期」图片生成3D模型、现代化Linux、Mac优化的本地模型推理、模型智能路由和端侧小模型

17. 曝旺旺集团裁员要求员工写反思报告/DeepSeek多模态模型发布/李彦宏:文心大模型要重回基模第一梯队

18. 【DeepSeek上线多模态模型 价格和V4-Flash正式版一致】8月12日,DeepSeek公告称,多模态视觉理解模型DeepSeek-V4-Flash-Vision-Exp上线,开启多模态API服务。DeepSeek上线多模态模型 价格和V4-Flash正式版一致DeepSeek在公告中称,DeepSeek-V4-Flash-Vision-Exp是一个实验性质的模型。模型在需要视觉理解的智能体基准测试上,相比DeepSeek-V4-Flash实现了大幅跃升,多模态Agent(智能体)能力已接近Anthropic旗下的Opus 4.8模型。同时,DeepSeek-V4-Flash-Vision-Exp在Agent、推理、世界知识等纯文本能力方面与7月31日发布的DeepSeek-V4-Flash正式版持平。

19. 8GB也能本地AI生视频?!NV新发布的老显卡,性能出乎意料!畅玩MiniMax H3视频生成:媲美Seedance?

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章