极客早知道:DeepSeek V4.1 Flash 发布、OpenAI 暂停 Pro 20X ...
分类:AI动态 标签:人工智能、大模型、DeepSeek、OpenAI 一、 DeepSeek V4.1 Flash 模型正式发布:全面超越 V4 Pro、原生多模态视觉理解,最高降价 60% 深度求索今日正式发布 DeepSeek V4.1 Flash 模型。这是其全新模型结构系列中的最小尺寸模型,具备原生多模态视觉理解能力。新模型结构的设计初衷是:能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。 核心架构:DeepSeek V4.1 Flash 为 552B 参数的 MoE 模型,采用全新的 Causal-Encoder-Decoder 结构,输入和输出不对称,输入激活只有 8B,输出激活 16B。 性能突破:在基准测试中,其智能水平成功超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型。 存储优化:大幅减少了 KV Cache 缓存的大小。与上一代模型相比,对 HBM 的需求减少到 1/4,对 SSD 的需求减少到 1/8。 调用方式:DeepSeek V4.1 Flash 已同步上线 DeepSeek API,将模型名称更改为 deepseek-flash 即可调用。 二、 OpenAI 宣布暂停 200 美元 Pro 20X 新增订阅,应对 GPT-6 Astra 空前需求 为确保现有用户获得良好体验并流畅访问 GPT-6 Astra,OpenAI 首席产品官 Tibo 宣布,将暂停接受 200 美元档 Pro 20X 订阅服务的新增订阅。 ...