AI 周报
2026 年第 33 周
- 本期重点
- 24
- 预计阅读
- 15 分钟
2026年第33周(W33)的AI动态显现出发展路径的分化:技术应用走向下沉,个体或小团队得以在消费级硬件上实现模型微调(Soup CLI),AI代理也正式进入浏览器(Argos),彰显技术民主化与工具嵌入的并行趋势。与此同时,行业巨头加速调整与竞争:Google重组DeepMind并押注新架构,苹果或调价并调整中国区AI策略,而AI法律纠纷激增、提示注入攻防取得突破等事件,则凸显技术扩散带来的治理挑战与安全进展。
PERIOD HIGHLIGHTS
本期看点
MODEL RADAR
模型进展
Qwen3.8-27B:新一代视觉语言模型发布
Hugging Face 模型热度榜出现 Qwen3.8-27B,这是一个原生视觉语言模型,支持图像与视频理解,具备灵活思维控制,可执行复杂多步骤任务。该模型基于 Qwen3.5 架构,在编程、专业工作、研究和长程智能体任务方面有显著提升,并提供约 1M 上下文、内置工具等托管版本功能。模型热度分 9433,点赞 9803,下载 91917。
Qwen 发布开源模型 Qwen3.8-2.4T-A95B
Hugging Face 趋势榜出现新模型 Qwen3.8-2.4T-A95B,由 Qwen 团队发布,属开源文本生成模型,兼容 vLLM、SGLang 等推理框架。该模型是 Qwen3.8 系列的开源版本,宣称首次将 Qwen-Max 级能力开源,在编码、专业工作、研究和长程智能体任务上较 Qwen3.5 有全面提升,并支持官方云端服务。
Muse-Glimmer-30B:面向消费硬件的代理模型
Hugging Face 热榜出现 Muse-Glimmer-30B,这是一个由 Meta Superintelligence Lab 发布的 300 亿参数因果语言模型,带有专用感知编码器,从 Muse Spark 蒸馏而来,并针对消费级硬件上的自主代理任务进行了优化。该模型支持端到端代理任务完成、可靠工具使用、多步推理、故障恢复和多模态输入。
NVIDIA推出轻量化混合架构模型Nemotron-3.5-Lightning
NVIDIA发布Nemotron-3.5-Lightning-30B-A3B-NVFP4模型,总参数30B,活跃3B,采用MoE-Mamba-2混合架构,支持最长1M上下文,可单卡部署于DGX Spark或H100,支持多种硬件,已获得272赞和170K下载。
Gemini 3.7 Flash 向 Pro 与 Ultra 用户全面开放
Gemini 3.7 Flash 模型现已向 Gemini 聊天中的 Pro 和 Ultra 用户开放。该更新提升了多步骤任务的推理与准确性,例如智能整合数十个文件和邮件为一份主文档。同时,Gemini Spark 已运行于 3.7 Flash,通过改进对 Google Workspace 应用的工具调用,使个人 AI 智能体更精准。