2026年06月29日 AI 资讯速递

OpenAI 推出 GPT-5.6 系列限量预览版,包含旗舰 Sol、平衡 Terra 和性价比 Luna 三款模型。Sol 在编程、网络安全和生物学领域表现突出,新增 max 深度推理和 ultra 多 Agent 协同模式;Terra 以 GPT-5.5 一半价格提供同等性能;Luna 主打轻量高速。模型因应美国政府要求改为限量预览,原计划为开放访问。来源:机器之心...

今日概览

  • OpenAI 推出最新一代大语言模型系列 GPT-5.6
  • DeepSeek 联合北大开源推测解码加速框架 DSpark
  • 阿里通义千问推出独立AI语音输入法「千问输入法」
  • Ornith 1.0-35B MoE模型细节:3B活跃参数接近27B智能水平
  • harbor:运行沙箱评估的开源工具推荐

大模型与产品发布

OpenAI 推出最新一代大语言模型系列 GPT-5.6

OpenAI 推出 GPT-5.6 系列限量预览版,包含旗舰 Sol、平衡 Terra 和性价比 Luna 三款模型。Sol 在编程、网络安全和生物学领域表现突出,新增 max 深度推理和 ultra 多 Agent 协同模式;Terra 以 GPT-5.5 一半价格提供同等性能;Luna 主打轻量高速。模型因应美国政府要求改为限量预览,原计划为开放访问。来源:机器之心

来源:AI工具集

DeepSeek 联合北大开源推测解码加速框架 DSpark

DeepSeek 与北京大学联合推出大模型推理加速框架 DSpark,已进入 DeepSeek-V4 系列生产系统。在总吞吐不变的情况下,DeepSeek-V4-Flash 单用户生成速度提升 60%–85%,DeepSeek-V4-Pro 提升 57%–78%。DSpark 采用半自回归架构与置信度调度验证机制,兼顾草稿生成速度与连贯性,能根据系统负载动态调整验证长度。来源:APPSO

来源:AI工具集

阿里通义千问推出独立AI语音输入法「千问输入法」

阿里巴巴通义千问团队推出独立AI语音输入法「千问输入法」,主打”说得随意,写得漂亮”。产品底层接入千问大模型CosyVoice能力,能语音转文字,更能理解语义、自动去除语气词、纠正口误,将散装口语整理为结构化书面文本。千问输入法支持最快300字/分钟输入、9种方言识别与中英混说。来源:AI工具集

来源:AI工具集

Ornith 1.0-35B MoE模型细节:3B活跃参数接近27B智能水平

Reddit帖子介绍Ornith 1.0-35B MoE模型,宣称以3B活跃参数达到接近27B智能水平,推理速度极快。这是对已发布Ornith系列的架构补充说明。[1] 来源: [1] https://www.reddit.com/r/LocalLLaMA/comments/1ui3pwm/ornith_1035b/

来源:大黑AI·模型动态

harbor:运行沙箱评估的开源工具推荐

LangChain创始人Harrison Chase推荐harbor用于运行需要沙箱的评估,LangSmith现已支持自托管沙箱。对开发agent评估流程有实用价值。项目地址:https://t.co/RSpx68u5oB[2] 来源: [2] https://x.com/hwchase17/status/2071373847237206138

来源:大黑AI·产品工具

本地运行800M模型将图像转化为可控游戏角色

演示在消费级GPU上本地运行800M参数模型,将任意图像转化为可控制角色,支持实时交互。展示了轻量级图像生成控制技术新可能。[3] 来源: [3] https://www.reddit.com/r/LocalLLaMA/comments/1uicq8x/locally_running_mode_turns_an_image_into_a_cute/

来源:大黑AI·产品工具

基于本地模型的游戏NPC引擎开源

开发者分享使用SillyTavern架构和Gemma 4等模型构建的游戏无关NPC引擎,支持本地运行,面向RPG应用。项目地址:Reddit r/LocalLLaMA帖子。[6] 来源: [6] https://www.reddit.com/r/LocalLLaMA/comments/1uibt9o/npc_engine_using_local_models/

来源:大黑AI·产品工具

使用MiMo V2.5 GGUF模型成功编写C++执行工具

用户分享使用MiMo V2.5本地模型编写C++工具的实践经验,证实小型量化模型在实用编码场景下的有效性,提供超量使用建议。[7] 来源: [7] https://www.reddit.com/r/LocalLLaMA/comments/1ui6pqy/success_story_with_mimov25ggufudq5_k_xl/

来源:大黑AI·技巧教程

GB10设备与消费级GPU性价比讨论:统一内存带宽是关键瓶颈

社区讨论GB10设备是否值得购买,核心约束是统一内存带宽限制。对本地模型部署的硬件选型有重要参考价值。[4] 来源: [4] https://www.reddit.com/r/LocalLLaMA/comments/1ui8gsy/are_gb10_devices_worth_it_over_consumer_gpus/

来源:大黑AI·硬件动态

基础设施与硬件

双4090M eGPU Tensor split推理性能实测数据

实测双4090M eGPU在TB3低带宽下的Tensor split推理性能:PP达1300t/s,TG约26t/s,提供了eGPU实际带宽影响的量化数据。[5] 来源: [5] https://www.reddit.com/r/LocalLLaMA/comments/1ui8sdr/tensor_split_performance_on_lowbandwidth_tb3/

来源:大黑AI·硬件动态