DeepSeek 联合北大开源推测解码加速框架 DSpark
DeepSeek 与北京大学联合推出大模型推理加速框架,已进入 系列生产系统。在总吞吐不变的情况下,DeepSeek-V4-Flash 单用户生成速度提升 60%–85%,DeepSeek-V4-Pro 提升 57%–78%。DSpark 采用半自回归架构与置信度调度验证机制,兼顾草稿生成速度与连贯性,能根据系统负载动态调整验证长度。
全面剖析行业经典案例,最新资讯。
DeepSeek 与北京大学联合推出大模型推理加速框架,已进入 系列生产系统。在总吞吐不变的情况下,DeepSeek-V4-Flash 单用户生成速度提升 60%–85%,DeepSeek-V4-Pro 提升 57%–78%。DSpark 采用半自回归架构与置信度调度验证机制,兼顾草稿生成速度与连贯性,能根据系统负载动态调整验证长度。
OpenAI 推出 系列限量预览版,包含旗舰 Sol、平衡 Terra 和性价比 Luna 三款模型。Sol 在编程、网络安全和生物学领域表现突出,新增 max 深度推理和 ultra 多 Agent 协同模式;Terra 以 GPT-5.5 一半价格提供同等性能;Luna 主打轻量高速。模型因应美国政府要求改为限量预览,原计划为开放访问。
Anthropic宣布支持Artifacts功能,可将代码修改、故障排查等会话内容实时生成为可共享的交互式网页,支持团队同步查看进展。该功能基于完整会话上下文自动生成,页面随工作持续刷新,默认私有且仅限组织内分享。目前Artifacts以Beta形式向Team和Enterprise用户开放。
腾讯QQ邮箱推出,专为 AI Agent 打造的独立邮箱服务。Agent 可通过微信扫码授权获得专属邮箱地址,与个人邮箱完全隔离,支持收发邮件、管理附件、搜索过滤等完整功能。目前服务已上架腾讯 ,三步安装即可使用。
港股智谱总市值首次突破1万亿港元,年内涨超2000%,总市值达1.27万亿港元。此前智谱开源的模型在全球百万用户盲测的Code Arena前端开发评估中位列可用模型第一。
微信「小微」AI助手启动小范围内测,用户可在主界面左上角通过绿色眼睛图标进入。小微支持文字或语音对话操作微信原生功能,包括调整设置、发送消息、调起小程序、生成图片等,主模型为微信自研WeLM,部分回答调用DeepSeek。同时,小微具备一句话生成小程序能力。
开源原生多模态旗舰模型,总参数 428B、激活参数 23B,采用自研 MSA 稀疏注意力架构降低长上下文计算成本,是首个从 Step 0 开始多模态混合训练的开源模型。发布后在 Artificial Analysis 综合智能指数、GDPval-AA、Code Arena WebDev 等多个榜单取得开源模型第一,获 Vercel CEO 及 YC 创始人等业界好评。
百度飞桨正式推出,首次推出Tiny/Small/Medium三档模型。模型检测与识别精度较v5提升4.9%和5.1%,CPU推理速度最高达前代5.2倍。模型支持50种语言,新增电路板、数码管等工业场景,鲁棒性史上最高。模型现已上线官网并开源至GitHub和HuggingFace。
上线 服务,通过多模型并行作答与裁判模型融合,实现高性价比智能输出。DRACO 基准显示,Gemini 3 Flash、Kimi K2.6 与 DeepSeek V4 Pro 的预算组合以半价取得 64.7% 得分,逼近 的 65.3%。该机制具备单模型故障自动替补的鲁棒性,支持 API 直接调用与自定义模型组合。