31
模型Scale AI 开源 Muse 系列模型
筛选线索开源模型与生态AI 主题模型雷达1 个独立信源
Scale AI 此前主要提供商业数据与模型服务,此次开源其智能体模型权重,降低了采用门槛,使开发者可在本地硬件部署,可能推动智能体技术的普及和竞争。
AIHOT · X / 公众号精选/
6332
模型Agents‑A1:以 35B 参数智能体实现万亿参数级性能
筛选线索开源模型与生态Agent 智能体AI 主题AI 公司1 个独立信源
此前大模型性能提升主要依赖参数扩张,而 Agents‑A1 证明:通过横向扩展智能体能力(长程任务、多领域工具调用),较小的 MoE 模型也能达到同等效果,可能重塑模型研发成本与部署策略。
Hugging Face Model Radar/
6233
模型OpenAI推出两款新转录模型API
筛选线索AI 公司模型家族1 个独立信源
此前OpenAI的转录模型(如Whisper)未明确区分实时与批量场景,新模型专攻两种方向,且声称在口音、噪音等复杂条件下有显著准确率提升,这将直接影响语音应用的字准率与用户体验。
AIHOT · X / 公众号精选/
6234
V4-Flash在Agent能力上超越V4-Pro-Preview,且原生支持Responses API和Codex适配,降低了开发者集成门槛,可能促使更多Agent类应用采用该模型。
AIHOT · X / 公众号精选/
6135
相比以往需分块处理的 OCR 模型,Unlimited-OCR 宣称支持一次性长视界解析,可能降低复杂文档(如长合同、书籍)的多步预处理成本,提升整体处理效率。
Hugging Face Model Radar/
6136
模型Kimi K2.7 Code 编码代理模型
筛选线索多模态Agent 智能体AI 公司模型家族1 个独立信源
该模型相比前代 K2.6 在编码代理能力上有实质性提升,同时显著降低了推理时的思考 token 消耗,这意味着在复杂软件工程任务中可更高效地使用模型,降低算力成本。
Hugging Face Model Radar/
6037
Qwen-Image-3.0 发布并上线云平台,标志着阿里在文生图领域达到中国领先、国际主流水准,且提供 API 定价,意味着开发者可直接使用该能力,推动应用落地。
AIHOT · X / 公众号精选/
6038
此前多模态模型多针对单模态或简单组合,此次 FLUX 3 Video 在 OpenRouter 平台向所有人开放,提供一个基础上同时覆盖视频、音频、图像和动作预测的统一模型家族,降低了多模态应用开发的接入门槛。
AIHOT · X / 公众号精选/
6039
以往推理与图像生成通常由不同模型或流程完成,SenseNova U1 将两者统一,可能简化多模态任务的处理方式,降低集成复杂性,并提高内容生成的连贯性。
AIHOT · X / 公众号精选/
6040
此前蚂蚁百灵可能未开放该模型权重,此次开源并同时提供两种量化版本,意味着开发者可以自部署,降低对封闭API的依赖,扩展了模型的可及性和应用灵活性。
AIHOT · X / 公众号精选/
6041
商汤发布轻量级开源模型,以8B参数实现接近闭源商业模型的多模态生成与编辑质量,可能降低高质量多模态模型的使用门槛,并加剧开源与闭源模型的竞争。
AIHOT · X / 公众号精选/
5942
此前开源视频模型多在分辨率、时长或音频能力上有所取舍,H3同时支持2K分辨率、15秒时长和32kHz原生立体声,且统一处理多模态输入,标志着开源模型在多模态生成能力上的新水平。
AIHOT · X / 公众号精选/
5943
Inkling-Small 以四分之一的总参数规模实现与原版相当的性能,且仅需 12B 激活参数,意味着在保持性能的同时大幅降低了资源消耗。这标志着高效模型在保持能力上取得进展,可能推动大模型在更广泛场景的部署。
AIHOT · X / 公众号精选/
5844
此前推理速度提升常伴随质量下降,K3 通过自定义 DFlash 投机器同时实现加速和质量无损,标志着推理效率的重要进步。
AIHOT · X / 公众号精选/
5745
2.8万亿参数规模是国产大模型的显著突破,原生视觉理解与100万token上下文窗口大幅扩展应用场景;规模化效率提升2.5倍意味着相同算力下可处理更多任务,开源权重与Infra技术降低复现和二次开发门槛。
AIHOT · X / 公众号精选/
57