谷歌Gemini遭大规模提示词蒸馏攻击,单次超10万次请求窃取模型能力

源自51位全网作者

02-15 20:09

内容由AI生成

精选参考来源

1. AI的安全从来不是加个补丁的事。 而是要把安全基因嵌进模型的每一步。#大咖观察 #红衣聊AI #网络安全

2. 盘点一周AI大事(11月2日)|OpenAI放出AGI时间表 OpenAI公布AGI路线图,202626年上岗AI研究员,能独立研究大型科研项目,2028年发布重大科研成果达成AGI,10年内冲刺超级智能 OpenAI正式重组为营利实体,估值1万亿 MiniMax推出最强开源大模型M2 字节发布最强通用游戏智能体Game-TARS Anthropic推出Excel分析师 Gemini上线一键做PPT Odyssey发布能实时交互的视频模型Odyssey-2 Adobe推出一键P视频Frame Forward 科学家研发出热力学采样芯片架构TSU,能效提升1万倍 奥特曼押注非侵入脑机接口,用超声波直接读取意念 马斯克的脑机接口Neuralink即将开启人脑增强实验 #AI新星计划 #人工智能 #AIGC #OpenAI #机器人

3. 盘点一周AI大事(12月7日)|GPT5.2下周发布 Gemini 3 Deep Think正式上线 OpenAI下周12月9日发布大蒜模型GPT5.2,下月发布大葱模型GPT5.5全面吊打Gemini 3 DeepSeek开源最强推理模型DeepSeek V3.2 Mistral开源Mistral 3家族 OpenAGI发布最强电脑操作模型Lux Runway发布最强视频模型Gen 4.5 阿里开源数字人直播模型Live Avatar 字节发布顶级图像模型Seedream 4.5 研究员推出3D空间音频模型ViSAudio 微软开源实时语音模型VibeVoice Harmonic推出亚里士多德智能体,6个小时解决了悬赏30年的数学问题 #抖音知识年终大赏 #AI新星计划 #人工智能 #OpenAI #机器人

4. 只需一块 4070,一个小时,Gemini 2.5 就能被黑产植入广告!

5. Gemini零点击漏洞可致攻击者窃取Gmail、日历及文档数据

6. 如何评价Google DeepMind刚发布的Gemini 2.5系列大模型?

7. AI安全就像一场军备竞赛,攻击者和防御者都在不断进化。 #大咖观察 #红衣聊AI #网络安全

8. AI的发展该先追求理解能力还是先筑牢安全防线? #大咖观察 #红衣聊AI #谷歌 #ai #网络安全

9. 以为 AI 圈最近风平浪静?谷歌 Gemini 3 已经杀疯了

10. 阿里千问与“AI Layer”崛起:一场重塑互联网的“操作系统”生态战 【硅谷101】

11. 谷歌最狠一步棋,是否会带来AI竞争拐点? #大咖观察 #红衣聊AI #谷歌

12. Gemini模型:对系统提示词理解能力差,调用工具塞的数据太多会坏掉胡言乱语输出乱码。Claude模型:对系统提示词理解能力强,但只要有工具就会优先调用工具试试不管你系统提示词怎么写的,如果调用工具的同时不要求结构化输出,还会把自己的推理直接漏出来。OpenAI模型:没有以上问题。

13. CJ Zafir分享了他最新的AI工作流,将不同AI模型按专长“分工”协作,极大提升效率:界面设计用Google Gemini 3.0 Pro,负责线框图、界面流程等前端工作; 代码开发用Anthropic Claude Sonnet 4.5,专注代码生成与调试; 项目规划则交给GPT 5.1,负责高层次的推理和计划制定。 他强调:只用这三者,剔除其他工具,工作流更清晰、更高效。Gemini 3.0是从TPU全新训练,需特殊提示语技巧才能发挥极致,一旦掌握,表现惊艳。Claude虽稳健,但自Sonnet 4发布后已遇瓶颈。 社区反馈也很丰富:有人推荐用MagicPathAI结合Gemini做UI,有人用Spine AI统一管理300+模型,还有人用Flowith自动挑选最合适模型。部分开发者深度依赖Gemini做前端和研究,Claude负责后端架构。 这套“AI分工”方案背后,有个重要启示:用多模型协作替代单一万能模型,更符合实际需求和效率。人类开发者不再是全能手,而是成为擅长“提示工程”的指挥官,让各AI发挥最大价值。 总结: 单一模型难以包打天下,真正的效率来自于“专才”AI的组合。技术成熟后,AI的角色将从工具变成智能“团队成员”,协助人类释放更大生产力。未来,懂得搭配和驾驭多模型的开发者,将在AI浪潮中占得先机。原文:x.com/cjzafir/status/1991190074386510094

14. 黑客正大规模攻击AI基础设施,已观测超9.1万次攻击会话

15. Gemini 3两小时淘汰ChatGPT,硅谷大佬倒戈:我回不去了

16. 【天风海外李泽宇】谷歌Gemini 3.0模型卡提前放出快评——多模态、知识库能力大幅超越GPT与ClaudeGoogle尚未发布新一代大模型 Gemini 3 Pro,但官网已经上线模型卡,并同步披露与 Gemini 2.5 Pro、Claude Sonnet 4.5 与 GPT‑5.1 的对比测试结果。整体看,Gemini 3 Pro 在多模态能力上大幅领先目前其它旗舰模型,并在数学、科学推理及长上下文等核心能力上有较为明显的跨代提升。在涉及图像理解能力的逻辑推理上(Humanity’s Last Exam、ARC‑AGI‑2、AIME 2025、MathArena 等)上,Gemini 3 Pro 大幅超越自家 2.5 Pro,GPT‑5.1、Claude 4.5 。AIME 2025 等高难数学榜单中,Gemini 3 Pro 在“有代码执行”场景下达到满分,显示其在 工具调用+数学推理 组合能力上已经具备行业顶级水准。多模态与视频理解:延续 Google 传统优势,视频场景领先两档档在 MMMU‑Pro、ScreenSpot‑Pro、Video‑MMMU 等多模态基准中,Gemini 3 Pro 相比 Gemini 2.5 Pro 有明显跳升,并普遍高于 GPT‑5.1 与 Claude 4.5。在截图理解上,Gemini 3 Pro达到72.7%,大幅超越其它旗舰模型的36.2%。特别是 Video‑MMMU 维度上,Gemini 3 Pro 在视频信息抽取与知识问答上表现突出,Agent & 代码:综合实力强,部分专项仍与 GPT‑5.1/Claude 形成互有胜负在 LiveCodeBench Pro、SWE‑Bench Verified、t2‑bench、Vending‑Bench 2 等“代码+智能体”基准上,Gemini 3 Pro 的 Elo/成功率普遍高于旧版本,并在多数维度与 GPT‑5.1 非常接近。但在部分单项(如 SWE‑Bench Verified 测试,Claude 4.5 仍保持小幅领先),表明行业在真实软件工程类任务上尚处于“多强并立”格局,尚未出现一骑绝尘的模型。长文本与检索:128k 上下文可用性增强,复杂检索任务能力改善。幻觉极低。在 MRCR V2、FACTS Benchmark Suite 等长上下文与检索基准上,Gemini 3 Pro 相对 2.5 Pro 提升明显,在 128k 长度下仍能保持较高准确率。并且在SimpleQA Verified上,其得分超过72%,大幅领先非Anthropic Sonnect4.5的29%与GPT5.1 的35%。长任务执行能力:整体也胜于GPT 5.1 与Sonnet 4.5我们怎么看未来生态与商业化?我们认为尽管在代码能力上Gemini 3Pro尚未完全超于竞争对手,但在多模态能力、文本Rag能力上3Pro已经大幅超越,叠加 Google 自有搜搜索+Workspace+Android 生态,有望在搜索AI mode商业化、文档问答、企业AI等场景实现市场开拓能力的大幅提升,并且涌现大量多模态新场景。继续看好谷歌与谷歌链的受益者。

17. Gemini 3 正式发布!超越 Claude 4.5 和 GPT-5.1,连奥特曼都坐不住点赞了

18. 刚刚,Gemini 3 再次大更新!全球免费享 Pro 级智商,奥特曼又要失眠了

19. 最强多模态大模型Gemini 3 Pro强在哪里?

20. 刚刚,让谷歌翻身的Gemini 3,上线Flash版

21. Gemini 3 Pro Vibe Coding,一晚上聊了 10w Token。我是写了一个脚本,把整个项目源码连同 README,一起塞给 LLM,所以对话起步就是 5w Token。程序界面看起来跟前两天没啥变化,实际上底层实现来来回回重构过很多轮。再算算价格,Gemini 3 Pro 小于 20w Token 时,输入2刀、输出 12 刀每百万。并不是说我一晚上聊了 10w Token,这是一个递增的关系:第一轮:5w 上下文。第二轮:5w 上下文 + 问题1 + 回答1。第三轮:5w 上下文 + 问题1 + 回答1 + 问题2 + 回答2。……实际上,我晚上一共对话了 19 轮,光这 5w 上下文,5x19=95w Token。再加上阶梯累加的问题。凭感觉算一下,一晚上得 50~100 元成本的样子(凭感觉算的)。不过,在 Ai Studio 里,没花钱

22. 最新数据显示,2025 年底,用户在桌面端和移动网页端单次使用 Gemini 的平均停留时长已经达到 7.2 分钟,首次超过 ChatGPT 的 6 分钟。下载量也在追,Gemini 从年中月均 1500 万下载,一路飙到 6600 万;ChatGPT 依然领先,但差距被迅速缩小。谷歌把 Gemini 深度塞进 Android、Gmail、Workspace 的生态打法,已经开始显效果了。并且这波上扬刚好踩在 Gemini 3 发布的窗口期。谷歌靠的是全栈:模型、TPU、数据中心、基础设施一起推,不靠某一项天才突破。而#Gemini# 这次势头这么猛,也不是靠运气,是谷歌终于把发动机换好了,开始踩油门了。

23. AIME满分之后,该如何验证LLM在数学竞赛上的能力?

24. 当 Gemini 成为 Google 全生态的底层智能引擎后,整个技术体系将呈现出一种全新的结构:它不再是一个单点模型,而是贯穿设备、系统、应用、数据、内容、场景、商业的“全域智能内核”。这将带来一系列过去从未出现过的面貌。 第一,Gemini 将搜索从“找答案”升级为“实时智能现场”。搜索不再展示十个蓝色链接,而是由 Gemini 在搜索、地图、YouTube、Drive、Gmail、Docs 等多模态之间瞬间联动,直接生成一个可执行的方案。用户不再点击,系统直接合成动作路径。搜索第一次成为“能干活的智能体”,而不再是信息入口。 第二,Gemini 在安卓中形成“系统级智能体层”。它会成为 Android 的内置推理引擎,能够跨应用理解任务意图、跨权限调用资源、跨数据源快速组合,实现“自动完成用户需求”的自运转系统。Android 将第一次摆脱碎片化约束,由 Gemini 的指挥与调度形成统一的行为逻辑。 第三,Gemini 与 YouTube 融合,让视频变成“结构化的世界素材库”。Gemini 能从所有视频中抽取知识、路径、动作、过程、构图、物理逻辑,并转化为可推理、可复用的可执行内容。YouTube 变成世界模型的训练场,视频不再是被观看的,而是被“理解、分解、调用”的。 第四,Gemini 推动 Workspace 从工具变成“自治办公机体”。Gmail 自动分析邮件链路、Docs 自动生成文稿、Sheets 自动整合数据、Calendar 自动规划日程、Slides 自动设计内容。Workspace 会在 Gemini 的驱动下从“办公工具集合”变成“业务的自动执行层”。 第五,Gemini 与地图结合,使地图成为“现实世界的推理层”。路线、场景、人流、城市结构、消费轨迹都会被 Gemini 实时建模。地图将具备场景解读能力:预测需求、规划方案、识别风险、自动建议行动路径。从导航工具变成现实世界的逻辑操作系统。 第六,Gemini 让 Google Play 从应用商店变成“智能体技能市场”。开发者不再制作完整应用,而是制作能力插件、模型组件、轻量工具,由 Gemini 自由组合分配。入口从应用跃迁到智能体,应用逻辑被重构为“被 Gemini 调用的动作集合”。 第七,Gemini 与 Chrome 深度融合,使浏览器成为“云端推理终端”。用户的每次点击、阅读、搜索、使用服务,都会被 Gemini 解读成任务,自动跨网页整合资料、自动生成结果、自动执行操作。浏览器不再是访问器,而是任务中心。 第八,Gemini 将重写 Google 的安全体系。由于它覆盖账号、支付、文件、设备、视频、应用、权限,Gemini 能实时检测异常行为、识别诈骗路径、分析权限链路、自动隔离风险。安全系统不再是被动响应,而是主动预测的智能防护体。 第九,Gemini 使广告体系从“投放”变成“智能解决方案”。它能理解用户意图、场景、预算、状态,然后直接生成“可执行的商业动作”。广告从“展示信息”变成“提供能立即使用的服务”。Google 广告模型将再次重写行业标准。 第十,Gemini 贯穿全生态后,将形成 Google 有史以来最强的闭环:用户行为 → 数据资产 → Gemini 推理 → 自动行动。无论用户从哪里触发需求,Gemini 都能调用地图、视频、邮件、文档、文件、联系人、支付、信息源、应用资源,生成任务路径并执行。 这意味着:Google 将从移动互联网时代的“信息分发公司”,跃迁为由 Gemini 驱动的“行动生成平台”,一个实时自动运行的生活与工作系统。#新媒沈阳聊ai#

25. 对比明明白白3大顶级模型-GPT-5.2/Gemini 3/Claude Opus 4.5!老金告诉你怎么一个窗口全用!

26. 如何评价Google在9月26日更新的Gemini 2.5 Flash/Flash-Lite模型?

27. 谷歌新版Gemini马甲被扒! LMArena实测:唯一能看懂表的AI, GPT-5乱答

28. 高危漏洞影响CI/CD管道,提示注入即可攻破谷歌Gemini CLI

29. 研究显示 Gemini 易被隐蔽指令操控,谷歌无意修复

30. 揭秘"间接提示注入"如何将Google Gemini变成监控工具

31. 攻击者利用Gemini AI模型实施网络攻击

32. 研究人员绕过谷歌Gemini防御,利用日历邀请窃取隐私数据

33. 【安全圈】Gemini AI曝出GeminiJack零点击漏洞,企业机密数据面临泄露风险

34. Gemini漏洞让攻击者零点击窃取企业机密

35. 谷歌Gemini遭遇大规模蒸馏攻击,单次行动提示超10万次

36. Gemini零点击漏洞可致攻击者窃取Gmail、日历及文档数据

37. 武器化日历邀请:提示词注入如何绕过 Google Gemini 的防护控制

38. 谷歌的Gemini 3 Flash是蒸馏出来的

39. 通过大模型蒸馏进行提示词注入

40. 研究人员利用日历邀请攻击Google Gemini,泄露用户日程数据

41. 谷歌Gemini漏洞敲响警钟!AI提示词攻击或成企业致命隐患

42. LLM 实战:Teacher-Student 知识蒸馏

43. Gemini核心漏洞概述:“双子座三合一”(Gemini Trifecta)

44. 大模型蒸馏:技术原理与侵权风险

45. 【智情日闻·智能安全】当智能助手被“诱导”:从Gemini漏洞看系统防线的脆弱点

46. 基于“灰盒”蒸馏的大语言模型攻击研究

47. 🚀炸裂! Google放出核弹,本地也能跑Gemini3! Google 开放“核弹级”模型权重:Gemma 3 Technical Report!这不仅是参数的升级,更是本地部署、长文本处理的一次革命!🚀 🌟 一眼看清:Gemma 3 与 Gemini 3 的血缘关系 : Gemini 3 是 Google 闭源的“旗舰母舰”,代表 AI 算力的天花板,只能花钱调 API。 Gemma 3 是 Gemini 3 技术研究成果的开放权重(Open Weights)版。 Google 像“教导主任”一样,把 Gemini 3 的核心秘籍通过知识蒸馏,完美压缩进了 Gemma 的小身材里。 📌 核心点: 显存焦虑终结者! 独家 5:1 混合注意力机制(局部:全局 = 5:1),让 128K 超长文本不再是“显存杀手”,KV-cache 占用直降 80%。 4B 参数,27B 智商! 凭借顶级的蒸馏操作,4B 版本的性能竟能追平前代 Gemma 2 #google #gemini #gemini3 #大模型 #chatgpt #人工智能 #AI #Google #Gemma3 #Gemini3 #本地部署AI #开放权重 #多模态大模型 #显存优化 #程序员 #人工智能 #技术干货 #科普

48. 从零开始学大模型知识蒸馏:黑盒白盒技术详解,一篇全掌握!

49. 人工智能应用中的数据安全专刊 | 采用改进的知识蒸馏方法进行黑盒攻击

50. 用RL做知识蒸馏效果更好! 强迫学生和教师生成的内容无法区分 (论文分享 | Insights)

51. AAAI2026 | 针对大模型推荐系统的成员推理攻击:基于知识蒸馏的新范式

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章