AI 周报
2026 年第 30 周
- 本期重点
- 22
- 预计阅读
- 14 分钟
本周,AI领域在模型开放、企业部署务实化与地缘治理分化中加速演变。产品端,975B级开放权重多模态模型与隐私优先分析工具降低了定制与合规门槛;行业层面,企业自称的“Agent”多数仍为简单聊天机器人,部署评估信任与实际风险脱节,而Anthropic在竞争压力下调整订阅策略,谷歌则以专用芯片押注推理成本优势。地缘上,中国成立平行于西方的AI合作组织。安全方面,首次出现全自主AI代理入侵基础设施的报道。论文揭示了代码审查效率与质量的脱节、图推理对抗辩论、GraphRAG分离提取整合等关键方法,以及AI物料清单内容缺失与医疗专用模型的实用进展。
PERIOD HIGHLIGHTS
本期看点
MODEL RADAR
模型进展
Solar-Open2-250B模型:250B参数激活15B的百万token上下文开源大模型
韩国公司Upstage发布开源大模型Solar-Open2-250B,参数规模2500亿但每个token仅激活150亿参数。模型采用混合注意力机制的MoE架构,融合线性注意力和softmax注意力,支持百万token上下文窗口。训练时从上一代模型Solar Open 1继承部分权重,降低了从头训练成本。模型专为代理工作流设计,包括工具调用、多步推理等任务。
Nanbeige4.2-3B
Nanbeige4.2-3B是一个仅3B参数的精简代理模型,采用循环Transformer架构复用层以增加容量而不增加参数。在SFT中通过真实与合成环境扩展训练多样性,RL阶段结合结果与过程奖励。在工具使用、办公代理和代码代理基准上优于Qwen3.5-9B和Gemma4-12B等更大模型,推理能力在同规模开源模型中领先,并可集成到个人工作流代理框架如OpenClaw中。
Laguna-S-2.1:面向智能体编程的118B MoE模型
Hugging Face 上发布了一个名为 Laguna-S-2.1 的混合专家模型,总参数118B,每令牌激活8B参数。该模型专为智能体编程和长时间任务设计,支持1M上下文窗口、原生推理思考,并具有推测解码和多种量化变体。许可证为 OpenMDW-1.1,允许免费商用。
Kimi K2.7 Code 编码代理模型
Kimi K2.7 Code 是基于 K2.6 的编码代理模型,总参数 1T,激活参数 32B,采用混合专家架构,支持 256K 上下文。在真实长程编码任务上取得显著改进,思考 token 用量减少约 30%。在 Kimi Code Bench v2、Program Bench 等基准上超过 K2.6,部分指标低于 GPT-5.5 和 Claude Opus 4.8。
PRODUCT
产品与商业
产品发布凸显开放化与隐私优先趋势。975B参数的Inkling以开放权重支持微调,降低大规模多模态模型定制门槛;免费AI工具以无需登录降低非技术用户使用阻力;Reignat以隐私友好的实时AI分析,为合规场景提供替代传统追踪的新方案。