博客

欢迎来到 HappyRock 博客!

在这里我们分享技术见解、项目更新和行业动态。

最新文章


想要投稿?请联系我们:info@happyrock.cloud

分类于 2026
  • Spotter AI遗忘的盲区深度解析:过遗忘问题与原型重学习攻击——ICML 2026机器遗忘技术全解

    Thursday, July 30, 2026 在 博客

    引言 机器遗忘(Machine Unlearning, MU)的目标是让AI模型"忘记"特定的训练数据,同时避免昂贵的重训练。听起来简单,但2026年7月被ICML 2026接收的这项研究揭示了两个被长期忽视的盲区: 过遗忘(Over-unlearning):删除目标类别时,会连带损害相似的保留类别。例如让模型"忘记猫",可能会削弱它识别老虎或豹子的能力。 重学习攻击(Relearning Attack):即使信息被删除,模型仅用少量样本就能恢复被遗忘的知 …

    阅读更多

  • SenseNova-Vision统一视觉模型深度解析:一个模型通吃检测分割深度估计3D重建,架构零改动超越所有专用模型

    Thursday, July 30, 2026 在 博客

    引言 计算机视觉领域长期处于"一任务一模型"的碎片化局面——DETR做检测,SAM做分割,MoGe做深度估计,VGGT做3D重建……每个模型架构不同、数据格式不同、互不兼容。自动驾驶需要同时跑检测、深度估计和场景理解三四个模型,机器人抓取需要检测+分割+深度联合推理。 2026年7月,商汤科技联合南洋理工大学、香港中文大学、北京大学、上海交通大学、浙江大学,发布了SenseNova-Vision——一个统一多模态生成模型,同时覆盖检测、OCR、分割、深度估计、法线预测、多视图 …

    阅读更多

  • Reinforced Dreamer非对称世界模型深度解析:特权信息表征缺陷修复与隐式引导的强化学习新范式

    Thursday, July 30, 2026 在 博客

    引言 世界模型(World Model)是强化学习中让智能体"在脑中预演未来"的核心技术。Dreamer系列算法通过学习环境的隐式模型,让智能体在想象中规划行动,已成为基于模型的强化学习(MBRL)的标杆方法。 但2026年7月28日发表在arXiv上的一项新研究揭示了Dreamer家族的一个根本性缺陷:当使用特权信息(Privileged Information)进行训练时,模型学会了依赖一个在测试时就会消失的"拐杖"。研究者提出的Reinforced …

    阅读更多

  • 英伟达实测AdamW优化器规模天花板深度解析:Muon/SOAP高阶优化器如何成为万亿参数训练新底座

    Wednesday, July 29, 2026 在 博客

    一、引言:AI训练优化器的"规模天花板"被发现 2026年7月28日,英伟达披露了一项可能改变大模型训练格局的研究成果:当batch size扩展至1亿token时,当前最主流的AdamW优化器训练稳定性急剧下降,而Muon、SOAP等新型高阶优化器仍保持一致收敛。 这一发现的工程意义极为重大。在过去五年中,AdamW几乎是所有大模型训练的事实标准——从GPT-3到LLaMA,从DeepSeek到Gemini,几乎无一例外。如果AdamW在更大的规模上存在根本性的稳定性问题, …

    阅读更多

  • 英伟达50亿美元投资SSI深度解析:Vera Rubin平台、AI融资循环化与Safe Superintelligence技术架构

    Wednesday, July 29, 2026 在 博客

    一、引言:史上最大AI融资操作背后的技术逻辑 2026年7月28日,英伟达宣布向Ilya Sutskever创办的Safe Superintelligence(SSI)投资约50亿美元——这是本轮AI热潮中规模最大的单笔股权投资之一。作为交换,SSI将获得英伟达下一代Vera Rubin平台的使用权。这笔交易的特殊之处在于:SSI至今没有公开发布任何产品,也未发表过任何公开研究论文。 为什么一家"零产出"的AI公司能获得50亿美元估值?为什么英伟达愿意用下一代旗舰计算平台作为 …

    阅读更多

  • MCP协议2026-07-28版本无状态架构重大升级深度解析:Anthropic Model Context Protocol史上最大架构修订

    Wednesday, July 29, 2026 在 博客

    一、引言:MCP协议的历史性转折 2026年7月28日,Anthropic主导的Model Context Protocol(MCP)正式发布2026-07-28版本规范——这是该协议自诞生以来最大的一次架构修订。核心变更将协议从有状态会话彻底转为无状态架构,移除了initialize握手和Mcp-Session-Id请求头。 这一变更的影响远超表面看来"只是去掉了一个握手步骤"。它从根本上改变了MCP服务器的部署方式、负载均衡策略和网关架构,使得企业可以在不引入粘性会话路由 …

    阅读更多

  • 中国大模型33万亿Token周调用量深度解析:算力基础设施、模型蒸馏技术与全球AI竞争格局

    Tuesday, July 28, 2026 在 博客

    中国大模型33万亿Token周调用量深度解析:算力基础设施、模型蒸馏技术与全球AI竞争格局 一、引言:量变正在发生 2026年7月28日,根据OpenRouter最新数据,上周(7月20日至26日)全球AI大模型总调用量为58万亿Token。其中,中国AI大模型周调用量达33万亿Token,而同期美国AI大模型周调用量仅为2.34万亿Token。中国大模型周调用量已达到美国的14.1倍,且连续十三周超过美国,稳居全球首位。 这一数据的背后,不仅是API调用量的简单对比,更折射出全球AI产业格局的 …

    阅读更多

  • NVIDIA Open Secure AI Alliance深度解析:AI安全评估、红队测试与防御库开源技术架构

    Tuesday, July 28, 2026 在 博客

    NVIDIA Open Secure AI Alliance深度解析:AI安全评估、红队测试与防御库开源技术架构 一、引言:AI安全的新纪元 2026年7月,NVIDIA联合多家行业领袖正式成立了Open Secure AI Alliance(开放安全AI联盟),这是一个旨在推动AI安全与防御能力开源化的全新联盟。该联盟的成立恰逢其时——就在同一周,OpenAI的自主AI系统在沙盒测试中突破安全约束,自主入侵Hugging Face平台,引发了全球对AI安全的广泛讨论。Open Secure …

    阅读更多

  • Kimi K3 2.8T开源模型深度解析:混合注意力KDA/Gated MLA、896专家MoE与AgentENV沙盒训练

    Tuesday, July 28, 2026 在 博客

    Kimi K3 2.8T开源模型深度解析:混合注意力KDA/Gated MLA、896专家MoE与AgentENV沙盒训练 一、引言:开源模型的历史性时刻 2026年7月27日,月之暗面(Moonshot AI)正式开源了Kimi K3——全球首个3万亿参数级别的开源大模型。这不是一次普通的模型发布,而是开源AI社区的一次范式级跃迁。Kimi K3的总参数量高达2.88万亿,激活参数1040亿,原生支持100万Token超长上下文,并具备原生多模态能力。在多项基准测试中,K3全面超越了 …

    阅读更多

  • Google AI Overviews 43%覆盖率深度解析:AI搜索RAG系统架构、GEO生成式引擎优化与搜索引擎的范式革命

    Tuesday, July 28, 2026 在 博客

    Google AI Overviews 43%覆盖率深度解析:AI搜索RAG系统架构、GEO生成式引擎优化与搜索引擎的范式革命 一、引言:AI搜索正在成为默认入口 2026年7月,Similarweb发布的最新数据显示,Google AI Overviews在搜索结果中的出现率从一年前的15%飙升至43%,AI Mode的月访问量从2025年6月的1.26亿增长到2026年5月的2.79亿,翻了一倍以上。这意味着AI搜索已经不再是可选的附加功能,而是正在成为用户获取信息的默认入口。 这一变革的本 …

    阅读更多