DeepSeek R1 vs ChatGPT?38位开发者实测,谁更值得用?
01-22 18:23
精选参考来源
精选参考来源
1. 【科普】ChatGPT、DeepSeek-R1、DeepSeek-V3 辨析
今日头条 2025-11-07 00:00:00
2. ChatGPT和DeepSeek,孰优孰劣
微信公众号 2025-11-08 00:00:00
3. 用了一周DeepSeek再回头看ChatGPT,我悟了
小红书 2025-10-17 00:00:00
4. DeepSeek vs ChatGPT?38位用户实测,谁更实用?
什么值得买 2026-01-18 00:00:00
5. DeepSeek与ChatGPT
今日头条 2025-09-15 00:00:00
6. 【生成AI】ChatGPT与DeepSeek性能实测对比
微信公众号 2025-11-04 00:00:00
7. DeepSeek V4
微信公众号 2026-01-11 00:00:00
8. AI大模型前沿知识 ChatGPT ,deepseek 课程分享
知乎 2025-12-27 00:00:00
9. ChatGPT 与 DeepSeek
知乎 2025-08-16 00:00:00
10. 大模型之间的正面较量
知乎 2025-11-17 00:00:00
11. 为什么越来越多人选择用 ChatGPT,而不是 DeepSeek?
微信公众号 2025-09-30 00:00:00
12. AI大比拼
今日头条 2025-08-27 00:00:00
13. 一场AI辅助学术写作之战
微信公众号 2025-10-15 00:00:00
14. ChatGPT、DeepSeek、腾讯元宝、豆包对比分析,看完你就明白了
今日头条 2025-09-06 00:00:00
15. 【建议收藏】2025年7款主流AI大模型深度横评,DeepSeek、Kimi、GPT...谁才是真正的效率神器?
知乎 2025-12-08 00:00:00
16. ChatGPT持续增长,DeepSeek潜力犹存
知乎 2025-08-11 00:00:00
17. AI四巨头对决
微信公众号 2025-12-05 00:00:00
18. 2025消费级AI对决
今日头条 2025-09-29 00:00:00
19. 2025年AI效率神器榜
微信公众号 2025-10-31 00:00:00
20. DeepSeek编程能力引发行业震动
今日头条 2026-01-10 00:00:00
21. 200刀的ChatGPT沦为昂贵矿泉水
知乎 2025-12-25 00:00:00
22. DeepSeek-V3.2解读
微信公众号 2025-10-30 00:00:00
23. DeepSeek-R2将用到这项技术?梁文锋署名论文获ACL2025最佳论文奖
知乎 2025-07-31 00:00:00
24. 每日一个AI趣闻,DeepSeek-V3.2-Exp
微信公众号 2025-09-30 00:00:00
25. 长文本处理的颠覆者?DeepSeek-OCR
微信公众号 2025-11-12 00:00:00
26. DeepSeek V3.1 模型更新深度报告
微信公众号 2025-08-27 00:00:00
27. DeepSeek V3.1突袭发布!128K长文本处理碾压GPT4o
今日头条 2025-08-20 00:00:00
28. DeepSeek突击开源V3.1-Base,长文本处理能力再升级,开源AI智商飙升!
知乎 2025-08-20 00:00:00
29. 问天AI
知乎 2025-12-13 00:00:00
30. 探索本地部署DeepSeek
微信公众号 2025-09-03 00:00:00
31. ✨为什么大佬都爱本地部署?亲测真香。把DeepSeek部署到电脑本地相比于在线版本有很多优势! 在数据安全、使用费用、网络卡顿等方面都比在线版本的性能更优秀~ 1. 敏感数据锁进保险柜! 合同/财务/研发代码…通通不用上传公网!自家服务器上跑AI,再也不怕“底裤被看光”(老板狂喜) 2. 速度起飞不卡顿! 断网?延迟?不存在的!内网传输秒响应,打开文档唰唰分析,打工效率怒翻倍⏰ ️ 3. 自定义私教级AI! 给它“喂”行业黑话、内部资料…调教成专属小助手!汇报写标书?它比你还懂公司套路 4. 长期用居然更省钱?! 高频使用党注意了!省下按条收费的API调用费,GPU跑得越久反而越划算~(会计部竖起大拇指) 5. 离网也能偷偷卷! 飞机高铁没信号?实验室断网?本地AI照常营业!同事急哭的时候你淡定输出…(深藏功与名) 适合需要处理机密文档的打工人和一些数据敏感行业的公司办公使用 #deepseek #deepseek本地部署 #deepseek部署
抖音 2025-08-09 00:00:00
32. #硬刚ChatGPT的千问国内可下载#阿里发布对标ChatGPT的AI助手App「千问」,朱啸虎说千问能硬刚ChatGPT!这底气是来源于阿里自家Qwen模型,它在多项全球榜单霸榜,其中旗舰模型Qwen3-235B-A22B登顶「全球开源模型冠军」,Qwen3-coder在WebDev Arena取得并列第一....连Airbnb和英伟达的老黄都出来盖章,说这快成了硅谷的根基,正是这样强大的实力支撑千问具备复杂决策能力,用户只需通过简洁的界面就能体验顶级大模型能力。我自己也上手体验了一下,问它装机配置需专业建议,千问的回答不仅逻辑严密、分点清晰,在专业度上媲美ChatGPT,而且更深耕中文生态,更符合国人的交互体验,朱啸虎的眼光果然毒辣,阿里这次是铁了心要下场卷全球了!
新浪微博 2025-11-17 00:00:00
33. #中国AI三剑客刷屏硅谷#Kimi K2、Qwen3、DeepSeek-R1组成的“三剑客”席卷硅谷,展现中国AI的硬核实力!三者在全球权威榜单(如LMArena、OpenRouter、GAIA)包揽前位:Kimi K2:登顶全球开源榜,万亿参数,代码与Agent表现双优。Qwen3:升级后推理能力紧逼OpenAI。DeepSeek-R1:稳居全球前三。中国开源模型首次主导全球社区:Kimi K2:兼容Claude接口,可替代Claude Code生态。DeepSeek:开源模型+算法+代码,硅谷开发者疯狂复现并点赞。在OpenRouter全球用户量排名:Kimi:超越Grok。Qwen:紧逼OpenAI。DeepSeek:稳居第三。硅谷投资人Elad Gil、英伟达CEO黄仁勋访华时多次点名“三剑客”。三大模型核心亮点概要:Kimi K2(月之暗面)✅ 首个万亿参数开源模型✅ 支持多轮工具调用(MCP)✅ 登顶HuggingFace榜单,兼容Claude生态通义Qwen3(阿里巴巴)✅ 编程专用模型能力升级✅ 多模态融合技术优化✅ 性能逼近GPT-4,落地成本更低DeepSeek-R1(深度求索)✅ 推理成本降至1/10✅ 长文本处理能力领先✅ 全球用户增长最快(20天超1000万)咱们的AI正以惊人速度崛起,引领全球创新浪潮!🚀 关注我,带你追踪更多科技前沿!#ai生活指南##ai创造营#
新浪微博 2025-07-25 00:00:00
34. 如何评价 DeepSeek 于 2025 年 8 月 19 日更新的 V3.1 版本?省流:悲!也许没有 R2 了!V3.1 把 R1 给融了!重点 1:别被官方微信公告带沟里,128K 不是重点,模型融合推理才是重点。重点 2:DeepSeek V3-0324 和 DeepSeek V3 用的同一个 base model,但这次的 V3.1 放出了新的 base model,大概率是重新训的新模型。DeepSeek 的逻辑可能是,只要 base model 没换,就用日期做版本;重新训了 base model,就改版本号。来看看知乎答主们的多角度前沿解读👇
新浪微博 2025-08-20 00:00:00
35. 东大和漂亮国,AI实力的全面对比#AI #Deepseek #chatgpt #Gemini #AI技术
抖音 2025-12-29 00:00:00
36. OpenAI发布最强开源大模型,开源AI进入T0时代 OpenAI发布最强开源大模型gpt-oss,奥特曼放话,这是世界上最好最实用的开放模型。 亮点1、跑分离谱 大杯120B版本,性能打平OpenAI第二强的模型o4-mini,,在核心基准测试上全面碾压Qwen 3/Kimi K2和DeepSeek R1, 还有个中杯20B版本,性能接近o3-mini。 亮点2、实用性爆表 120B采用MOE架构,活跃参数仅5B,一张H100就能跑。 20B更夸张,原生支持4Bit量化,16G显存的电脑甚至是手机都能运行。 亮点3、透明可解释 默认展示没有经过美化和处理的原始思维链,可以完整观察到模型的“思考”过程。 亮点4、天生智能体 原生支持函数调用、网页浏览、Python代码执行,还能调节推理强度,0帧起手做智能代理 本周五还有GPT5发布 #AI新星计划 #人工智能 #OpenAI #大模型 #gptoss
抖音 2025-08-06 00:00:00
37. #DeepSeek登自然封面意味什么#DeepSeek R1论文荣登《自然》封面,此前仅有AlphaGo、AlphaFold获此殊荣,而这一次,中国AI的名字站上了世界科研的最高光处。R1论文不仅公开了仅约29.4万美元的训练成本,还补充了数据与安全细节;评审专家更指出,它是首个真正通过同行评审的大型语言模型。其影响力已获广泛认可:谷歌学术引用达3596次、Hugging Face下载量超1090万、GitHub星标数突破91K。这也许意味着中国AI企业正从「论文顶会」走向「科学殿堂」,也预示行业竞争将从比拼算力、参数规模,转向能否产出经得起全球同行检验的硬核成果
新浪微博 2025-09-18 00:00:00
38. 梁文锋参与的DeepSeek-R1论文登上 Nature封面,这具有什么意义?
知乎 2025-09-18 00:00:00
39. 盘点一周AI大事(10月12日)|GPT进化AI操作系统 OpenAI发布ChatGPT应用平台 OpenAI推出智能体编排工具AgentKit Sora 2正式开放API,可以生成15秒无水印的高清视频 OpenAI与AMD牵手成功 Google发布最强行动智能体模型Gemini 2.5 Computer Use Google即将发布Veo 3.1,正面硬刚Sora 2 科学家研发出首个自适应AI教师 Hinton称AI已经有了意识,只是它自己不知道 #AI新星计划 #人工智能 #AIGC #OpenAI #机器人
抖音 2025-10-12 00:00:00
40. 国产AI超过ChatGPT了吗?是的,在某些指标上超越了ChatGPT。#国产AI超过ChatGPT了吗#2025年的AI景观已经发生了很大变化,中国国产AI如DeepSeek、Qwen(阿里通义千问)和豆包等确实在加速追赶,甚至在某些指标上超越了ChatGPT。但要说全面超过,还为时尚早——ChatGPT(基于GPT系列)在全球通用性和知识深度上仍有领先,而国产AI的优势更多体现在本土化应用、成本效率和生态集成上。1. 国产AI在哪些场景比ChatGPT更好用国产AI在本地生活服务集成和中文语境处理上往往更胜一筹。比如,阿里千问新版App直接接入地图、外卖、订票等服务,让AI从单纯聊天转向“办事”,这比ChatGPT的插件系统更无缝,尤其在处理中国用户的高频需求时。DeepSeek在编程和多模态任务上也表现出色,许多开发者反馈它在代码生成的速度和准确性上不输甚至优于ChatGPT。   另外,在成本敏感的场景如企业部署,国产模型如Qwen的开源版本被硅谷公司如Airbnb采用,因为它性能接近但费用更低。  相比之下,ChatGPT在非英语语言的细微文化 nuance 上有时会卡壳,而国产AI对中文的理解更接地气,比如处理方言或本土梗。明显感受的场景:日常查询如“帮我订个外卖并规划路线”,国产AI能一站式搞定,而ChatGPT往往需要手动切换App或插件,效率低一些。 2. 本地生活服务能否成为国产AI突破点?国产AI会重新洗牌吗?绝对能!本地生活服务是国产AI的杀手锏,因为它能深度嵌入像阿里、字节这样的生态系统。想象一下,一个AI入口就能处理购物、出行和办公,这不只是技术升级,更是商业模式的革新。DeepSeek和豆包已经在全球消费级AI榜单上冲到前十,部分原因是它们在应用落地上的深度——比如整合本地搜索和支付,比ChatGPT的国际通用性更贴合中国市场。   这可能会洗牌AI市场:国产AI不靠参数规模取胜,而是靠“解决实际问题”的实用性。短期内,在中国和亚洲市场,它可能抢占ChatGPT的用户份额;长期看,如果开源趋势继续(如Qwen的全球下载超美国),它能推动全球AI从“参数大战”转向“生态大战”。 3. AI的生活能力和知识能力我更看重生活能力,因为知识能力可以通过训练数据快速迭代,但生活能力涉及真实世界的集成和即时响应——这才是AI从工具变成伙伴的关键。知识能力强如ChatGPT,能解答复杂问题,但如果不能帮我订票或处理日常琐事,就显得抽象了点。国产AI在这点上进步明显,比如DeepSeek在App下载榜上短暂超越ChatGPT,就是因为它更“接地气”。 如果让我选主力AI,我会挑生态集成型的,比如升级后的阿里千问或DeepSeek——它们不只聪明,还实用。相比纯知识型的如Claude或Gemini,我更偏好能无缝接入生活的类型。当然,这因人而异,如果你重知识,ChatGPT或Grok这样的还能是首选。 总体来说,国产AI的节奏确实在加快,但“超过”是个动态过程。目前,它在本土场景有明显优势,未来谁知道呢?欢迎大家分享你们的体验,我觉得这个话题值得我们多聊聊。#ai生活指南##ai创造营#
新浪微博 2025-11-17 00:00:00
41. #DeepSeek新模型发布#DeepSeek新模型发布:V3.2-Exp提效降价,开源同步上线。最新发布的DeepSeek-V3.2-Exp模型,是迈向新一代架构的实验性版本,核心升级为引入DeepSeek Sparse Attention稀疏注意力机制,专门优化长文本训练与推理效率。该模型已实现多平台同步更新,包括官方App、网页端、小程序,且API调用成本降低50%以上,新价格(单位:元/百方tokens)具体如下⬇️输入:缓存命中0.2元,缓存未命中2元输出:缓存命中0.5元,缓存未命中4元(价格自2025年9月29日18:00起生效)此外,DeepSeek-V3.2-Exp已在Huggingface与魔搭平台开源,且在各领域公开评测集上,其表现与上一代V3.1-Terminus基本持平
新浪微博 2025-09-29 00:00:00
42. 当你还觉得AI只是“辅助工具”时, 它早已在改写很多行业的游戏规则了。#大咖观察 #红衣聊AI #AI工具 #智能体
抖音 2025-11-27 00:00:00
43. #DeepSeek还会推出R2吗#?从当前的信息来看,DeepSeek后续单独推出R2的可能性较低,甚至可能接近于零。这主要是基于DeepSeek-V3.1的最新发布,该模型已经引入了混合推理架构(Hybrid Inference),将原本R系列的“思考模式”(Think Mode,强调深度推理)和V系列的“非思考模式”(Non-Think Mode,强调快速响应)融合到一个模型中。这种设计让用户可以通过提示词(prompt)在同一个模型内切换模式,实现更高效的推理,而无需维护两个独立的系列。业内猜测,这标志着DeepSeek的策略转向模型架构统一,类似于OpenAI将不同能力整合到单一模型(如GPT系列)的路线。回顾历史,DeepSeek-R1于2025年1月20日发布,作为推理专精模型,性能媲美OpenAI的o1,并在5月发布了R1-0528的升级版。 但R2的发布计划从最初的4月底推迟到5月初,又因质量问题、芯片短缺和外部竞争(如Grok 3、Claude 3.7、Qwen 2.5-Max)而多次延后。 如今进入2025年8月,V3.1的推出直接“吃掉”了R1的部分能力(如数学、代码和推理蒸馏),让R2的独立存在显得可能有点多余。如果DeepSeek继续迭代V系列(如潜在的V3.5或V4),R2很可能不会以独立形式出现,而是通过V系列的更新间接实现。 当然,如果市场反馈显示混合模式不足以覆盖所有场景,或者DeepSeek面临更激烈的竞争(如国产芯片训练需求),仍有小概率重启R2,但整体趋势是融合而非分离。DeepSeek已经开始将V系列和R系列融合,V3.1的发布就是明确证据。该模型的核心亮点是混合推理架构,一个模型同时支持“思考模式”(深度推理,类似于R系列)和“非思考模式”(快速响应,类似于V系列),通过提示词无缝切换。 直接“吃掉”了R1的部分能力,如数学推理、逻辑分析和代码生成,通过蒸馏技术整合到V3基底中。 V3.1在保持低成本(MoE架构下仅激活37B参数)的同时,提升了Agent和智能体功能,思考速度更快。 #ai生活指南##ai创造营#
新浪微博 2025-08-21 00:00:00
44. 梁文锋参与的DeepSeek-R1论文登上 Nature封面,这具有什么意义?
知乎 2025-09-18 00:00:00
45. DeepSeek论文登《Nature》, 让中国AI在全球 “插旗”!#大咖观察 #红衣聊AI #DeepSeek
抖音 2025-09-20 00:00:00
46. Manus被Meta收购,这是中国AI路线的一次胜利。 #大咖观察 #红衣聊AI #manus #Meta #agent
抖音 2025-12-31 00:00:00
47. 真正的核心竞争力,来自于驾驭工具。 #大咖观察 #红衣聊AI #编程 #人工智能技术
抖音 2025-12-08 00:00:00
48. 邪修玩法突破限制!爽用全球爆火的AI编程工具Claude Code!GLM和DeepSeek模型对比实测!
哔哩哔哩 2025-09-02 00:00:00
49. AI工具实盘炒股爆赚第一,我用它来分析特斯拉,结果更炸裂 “AI炒股大战”太上头了!Qwen梭哈第一名,DeepSeek打工人第二,GPT-5纠结到只剩两千块。但真正把我震住的,是我实测Qwen的“深入研究”——17步投研流程、引用权威文献、还能自动生成图表、播客、网页。普通人第一次可以拥有专业分析师级别的判断力。AI时代,真正能提效的工具正在悄悄改变我们 #AI工具 #AI研究 #投研工具 #qwenchat #Qwen
抖音 2025-11-21 00:00:00
50. 前有DeepSeek、后有千问灵光,杭州怎么成了老外眼里的中国硅谷?#灵光 #灵光App
抖音 2025-11-20 00:00:00
51. 工具永远是工具,驱动创新的永远是人类的想象。 #大咖观察 #红衣聊AI #人工智能 #科技改变生活 #AI工具
抖音 2025-11-22 00:00:00
52. 阿里系连发两个重磅AI产品,暗藏了一个巨大的机会#灵光 #蚂蚁灵光 #阿里巴巴 #全模态通用AI助手 #AI工具
抖音 2025-11-20 00:00:00
53. 华为昇腾宣布0Day支持DeepSeek-V3.2-Exp DeepSeek-V3.2-Exp重磅发布!华为宣布零Day支持!国产大模型牵手国产算力的背后是国产AI基建越来越成熟的适配能力!#华为 #昇腾 #DeepSeek
抖音 2025-09-30 00:00:00
54. 开发Agent只懂拖拉拽?你真的能跟上生产级开发的节奏了吗?
哔哩哔哩 2025-09-26 00:00:00
55. AI革命不是让你去学写代码,而是让你学会指挥AI干活。 #大咖观察 #红衣聊AI #科技改变生活 #人工智能
抖音 2025-12-10 00:00:00
56. #DeepSeekR2或将8月下旬发布#据网传消息称DeepSeek R2发布窗口指向8月15日至30日,但官方尚未官宣具体日期。从原定5月、延至7月的DeepSeek R2,如今在ChatGPT-5的压力下再次成为焦点,并且马斯克已经宣布 Grok 5 将于年底推出。
新浪微博 2025-08-12 00:00:00
57. 大模型只是能力,必须要跟场景结合。 #大咖观察 #红衣聊AI #大模型
抖音 2025-10-28 00:00:00
58. 硅基流动上线 DeepSeek-V3.1,上下文升至 160K硅基流动今日宣布,已上线深度求索团队最新开源的 DeepSeek-V3.1。据介绍,DeepSeek-V3.1 总参数共 671B,激活参数 37B,采用混合推理架构(注:同时支持思考模式与非思考模式),相比 DeepSeek-R1-0528,具有更高思考效率,能在更短时间内给出答案同时,DeepSeek-V3.1 在工具使用与智能体任务中的表现有较大提升。DeepSeek-V3.1 新版本在 SWE、Browsecomp、xbench 和 SimpleQA 基础测试上实现大幅性能提升,在多个领域比肩 Claude 4 Sonnet 等模型。#曝许凯将迎来有史以来最大的热度#
新浪微博 2025-08-25 00:00:00
59. 这帮90后中国工程师太牛了!460万美元干翻了1.4万亿 中国AI有自己的登顶策略!只用了1%的资源逆袭美国,又一个DeepSeek时刻的背后到底是什么?#AI #kimi #OpenAI
抖音 2025-11-13 00:00:00
60. 盘点一周AI大事(1月11日)|最强人形机器人 OpenAI公布2026研发路线图 DeepSeek被爆2月发布DeepSeek V4 Google推出Veo3驱动的数字人Vids 字节开源换脸视频模型DreamID-V 阿里开源数字人框架HRM2Avatar Lightricks开源顶级视频模型LTX-2 ElevenLabs推出最强语音转录模型Scribe v2 斯坦福开源睡眠分析模型SleepFM 港大发布开源版NotebookLM DeepTutor Razer推出全息AI老婆Project AVA 波士顿动力推出下一代Atlas #抖音知识年终大赏 #前沿科技趋势发布月 #AI新星计划 #AI #机器人
抖音 2026-01-11 00:00:00
61. Claude全面禁中国企业?别怕,国产模型够顶! #大咖观察 #Claude #马斯克 #红衣聊AI
抖音 2025-09-07 00:00:00
62. 市值近600亿,大模型公司上市了! #AI #智谱ai
抖音 2026-01-10 00:00:00
63. 以后和你同台竞争的,除了其他人类,还有AI。 #大咖观察 #红衣聊AI #DeepSeek #人工智能 #金融
抖音 2025-11-04 00:00:00
64. 你愿意花钱投资AI工具吗? #大咖观察 #红衣聊AI #AI工具 #投资 #职场
抖音 2025-11-24 00:00:00
65. 一篇59年前的论文当然不可能决定或改变一个时代, 但在合适的时间,被合适的人用在了合适的问题上,它就能改变一条路径。#大咖观察#红衣聊AI #deepseek #梁文峰 #人工智能
抖音 2026-01-08 00:00:00
66. 盘点一周AI大事(9月14日)|Claude最强AI办公 OpenAI和微软官宣新关系协议,微软同意OpenAI的营利实体转型 微软牵手Anthropic,Office全家桶接入Claude Claude上线最强办公辅助,能直接创建或编辑Excel、Word、PPT和PDF文件 ChatGPT正式上线MCP支持,支持添加MCP服务器,能读写第三方应用 Gemini上线可视化编辑,直接选中要改的元素,动动嘴就能改 NotebookLM全面升级学习神器 EbSynth上线P视频能力 Elevenlabs上线P音频能力 字节推出最强图像编辑模型Seedream 4.0 #AI新星计划 #人工智能 #AIGC #OpenAI #机器人
抖音 2025-09-14 00:00:00
67. 你现在最头疼的AI创业问题是啥? #大咖观察 #创业项目 #红衣聊AI #人工智能
抖音 2025-12-09 00:00:00
68. AI帮你压缩掉的是废话,还是你一直没想明白的问题? #大咖观察 #红衣聊AI #人工智能 #AI工具
抖音 2026-01-07 00:00:00
69. “灵光”爆火,AI应用井喷!杭州何成“中国硅谷”?#灵光 #杭州
抖音 2025-11-19 00:00:00
70. Sam Altman疯了!用这三招,他想让全世界为ChatGPT打工!#Altman #人工智能 #科技改变生活 #AI新星计划 #openai
抖音 2025-10-07 00:00:00
71. AI大脑串联效率拉满,这套AI全家桶真把我用爽了! #联想双十一#热AI升级11到位#天禧AI一体多端#科技改变生活#玩个很新的东西
抖音 2025-11-06 00:00:00
72. 【产品评测】旗舰血统下放,微星泰坦16 AI 2025 详细评测
哔哩哔哩 2025-09-27 00:00:00
73. AI下半场来了:从"魔术师"到"建筑师",华为这场大会信息量爆炸#2025华为GDEAskO3 #科技改变生活 #AI新星计划 #玩儿个很新的东西
抖音 2025-12-24 00:00:00
74. 人多,真的“力量大”吗? #大咖观察 #红衣聊AI #企业管理 #科技创新
抖音 2025-11-28 00:00:00
75. 在 9 月 18 日的华为全联接大会 2025 上,华为技术有限公司与浙江大学联合发布了国内首个基于昇腾千卡算力平台的 DeepSeek-R1-Safe 基础大模型。测试结果表明,DeepSeek-R1-Safe 针对有毒有害言论、政治敏感内容、违法行为教唆等 14 个维度的普通有害问题整体防御成功率近 100%,针对情境假设、角色扮演、加密编码等多个越狱模式整体防御成功率超过 40%。其综合安全防御能力达 83%,在同样测试设置下超过 Qwen-235B 和 DeepSeek-R1-671B 等多个同期模型 8% 至 15%。此外,在 MMLU、GSM8K、CEVAL 等通用能力基准测试中,DeepSeek-R1-Safe 相比于 DeepSeek-R1 的性能损耗在 1% 以内。这些结果表明 DeepSeek-R1-Safe 不仅显著提升了安全防护能力,也保障了模型的可用性,达成了安全能力与通用性能之间的有效平衡。华为昇腾计算业务总裁张迪煊表示,华为在此次大会上也正式推出了昇腾新一代 AI 硬件与全系列软件开源开放战略,覆盖编译器、运行时驱动等核心组件,致力于通过深度开放协作,联合高校与产业伙伴共同推动基础软件创新与 AI 安全能力建设#谈恋爱最重要的是谈#
新浪微博 2025-09-23 00:00:00
76. 我的3个神器软件
哔哩哔哩 2025-09-16 00:00:00
77. 英伟达很快会反超谷歌TPU,AI模型的竞争格局会在2026年1季度变天#英伟达 #马斯克 #算力 #Gemini3#TPU #GPU #AI模型#算力集群
抖音 2025-12-22 00:00:00
78. 中国的AI模型在海外又火了,全球用户迎来更多选择#亚马逊云科技 #AmazonBedrock #生成式AI #出海 #全球化
抖音 2025-09-22 00:00:00
79. 2026年AI全景预测:迈向百亿智能体时代的20个发展趋势。 #大咖观察 #人工智能 #红衣聊AI #智能体 #AI时代
抖音 2026-01-09 00:00:00
80. 盘点一周AI大事(10月19日)|Gemini 3.0逆天 OpenAI官宣自研AI芯片,与博通合作打造10吉瓦算力中心 OpenAI更新Sora 2,支持故事板画分镜,时长加到25秒 Google上线Veo 3.1硬刚Sora,支持3张参考图锁定主体,支持首尾帧平滑过渡,支持扩展长度到1分钟,支持添加和移除任意物体 Gemini 3.0 已开启灰度测试,前端开发能力炸裂,甚至能复刻网页版操作系统 Anthropic上线Haiku 4.5,编码能力追平Sonnet4 Claude上线Skills,把指令、脚本和资料压缩成技能包 AI学界首次提出可量化的AGI定义 #AI新星计划 #人工智能 #AIGC #OpenAI #机器人
抖音 2025-10-19 00:00:00
81. 把AI从“精英玩具”变成“全民工具” 让全世界都能用上便宜的AI。#大咖观察 #红衣聊AI #开源
抖音 2025-11-09 00:00:00
82. AI Coding不再丑,TRAE一键还原高保真 产品经理、设计师狂喜! TRAE竟然能把Figma设计稿直接变成一个活生生的网站。 从像素级还原到交互动效,从数据库、管理后台到支付变现,全程托管,指哪打哪 让AI成为你的10倍员工,这玩意儿,旦用难回! #AI #人工智能 #AI编程 #TRAE #Figma
抖音 2025-09-25 00:00:00
83. AI的未来,也许不在于模型规模的无限扩大。 #大咖观察 #红衣聊AI #transformer神经网络架构 #人工智能
抖音 2025-12-13 00:00:00
84. 未来能和谷歌掰手腕的公司,你觉得是谁? #大咖观察 #红衣聊AI #谷歌 #硅谷
抖音 2025-12-01 00:00:00
85. 盘点一周AI大事(8月10日)|AI暑期档诸神混战 OpenAI发布GPT5,GPT5 Pro横扫人类盲测排行榜,GPT5标准版智能水平相当于o3 OpenAI放出最强开源大模型gpt-oss Anthropic上线最强编码大模型Claude 4.1 Google官宣最强世界模型Genie 3 Grok视频生成向所有人开放 千问开源最强文本渲染图像模型Qwen Image elevenlabs上线最强音乐模型Eleven Music 首届大模型国际象棋大赛,o3 零封Grok4强势夺冠,Gemini获得季军 科学家研发出AI重新打光 #AI新星计划 #人工智能 #AIGC #OpenAI #机器人
抖音 2025-08-10 00:00:00
86. AI 编程又进化了!TRAE SOLO中国版上线且免费 #AI编程 #TRAE #TRAE SOLO #玩一个很新的东西
抖音 2025-11-26 00:00:00
87. AI时代最危险的职场陷阱不是不会用AI 而是把AI当成了思考替身。#大咖观察 #红衣聊AI #AI工具
抖音 2025-10-05 00:00:00
88. #DeepSeek频繁崩溃影响有多大# 频繁崩溃的核心是多因素叠加导致。一方面,V3、R1模型出圈后用户量激增,26天日活破4000万,高峰时段请求集中,且复杂推理请求耗算力,还曾遭DDoS攻击;另一方面,671B大模型显存需求高,算力储备不足,负载均衡和任务调度有短板,云原生扩缩容存在延迟。同时,为控制成本未备足冗余资源,叠加阶段性运维调整,进一步加剧了服务器繁忙问题
新浪微博 2025-12-16 00:00:00
89. 盘点一周AI大事(9月28日)|ChatGPT上线私人秘书 OpenAI与英伟达签手成功,英伟达投资OpenAI 1000亿打造算力中心 微软与Anthropic感情升温,Copilot也接入了Claude ChatGPT上线私人秘书Agent ChatGPT Palse OpenAI 发布职业力基准测试GDPval 阿里推出千问全家桶,Qwen 3 Max数学竞赛拿满分,多模态Qwen 3 omni全面对标Gemini,最强视觉Qwen VL打败闭源 DeepSeek更新V3.1最终版 Meta开源代码世界模型 Google开发出生成式操作系统原型 #AI新星计划 #人工智能 #AIGC #OpenAI #机器人
抖音 2025-09-28 00:00:00
90. 酷狗编程 | DeepSeek-R1 模型硬件需求与适用场景
微信公众号 2025-11-13 00:00:00
91. 函数调用:让 AI 从 “聊天” 到 “做事” 的关键能力
今日头条 2025-08-27 00:00:00
92. OpenAI重磅开源!开源新SOTA,最低16G显存运行o4级大模型!GPT-OSS模型介绍、评测与本地部署指南
哔哩哔哩 2025-08-07 00:00:00
93. DeepSeek-V3.1震撼发布,全球开源编程登顶!R1/V3首度合体
今日头条 2025-08-22 00:00:00
94. deepseekR1重磅更新!对比claude 4/Gemini 2.5 Pro 长文本阅读、写作、编程领域测试
知乎 2025-08-07 00:00:00
95. 5分钟玩转Claude Code!国内无门槛方案,DeepSeek/豆包一键切换
今日头条 2026-01-04 00:00:00
96. 2025大模型服务能力“成绩单”公布,算能SophNet吞吐量三冠,火山方舟刷新延迟纪录
微信公众号 2025-09-14 00:00:00
97. openAI终于开源了,gpt模型轻松本地部署
小红书 2025-08-07 00:00:00
-
散步慢跑都是白练!医生:肌肉流失才是衰老根源,晚了来不及117 24 -
完全新手小白一步步给京东云亚瑟刷uboot免拆机刷亚瑟68 110 -
“竹知了”舆情汹汹 鸿蒙智行发言人正式回应!60 507
已收藏
去我的收藏夹