We compressed Hy4-preview from 1.5TB to ~200GiB GGUF and it still works well ! Meet MIX-STQ1_0.The...
腾讯团队通过MIX-STQ1_0方法将Hy4-preview模型压缩至200GiB,保持高性能且误差变化小。
入选理由:使用MIX-STQ1_0量化方法可将1.5TB模型压缩至200GiB
模型
别名:HY4
竞争对手代码生成模型
已跟踪 4 条高相关材料
最近变化
2026-09-02 · Qwen3.8-Max-0902在WebDev赛道获得1,691分,位列Code Arena总榜第一
为什么值得关注
HY4 Preview 被反复提及时,通常意味着它正在影响产品路线、开发者工作流或 AI 产业判断。这个页面把分散材料合并成一个可持续更新的观察入口。
We compressed Hy4-preview from 1.5TB to ~200GiB GGUF and it still works well ! Meet MIX-STQ1_0.The...
Hunyuan(@TXhunyuan) · 8.5 分
腾讯团队通过MIX-STQ1_0方法将Hy4-preview模型压缩至200GiB,保持高性能且误差变化小。
Hy4 Preview now available on AI Gateway
Vercel News · 8.5 分
腾讯770B参数Hy4 Preview模型已在Vercel AI Gateway开放预览,支持长程编码等场景,AI Gateway提供统一API和成本管理功能。
🏆 #1 overall on Code Arena, and top of the Pareto frontier at $5/MToken. Thanks! @arena Give Qwen3...
Qwen(@Alibaba_Qwen) · 6.5 分
通义千问Qwen3.8-Max-0902在Code Arena中排名第一,且在Pareto前沿以$5/MToken的经济效率领先。
已收录 4 条与 HY4 Preview 相关的内容,按评分排序。
腾讯团队通过MIX-STQ1_0方法将Hy4-preview模型压缩至200GiB,保持高性能且误差变化小。
入选理由:使用MIX-STQ1_0量化方法可将1.5TB模型压缩至200GiB
腾讯770B参数Hy4 Preview模型已在Vercel AI Gateway开放预览,支持长程编码等场景,AI Gateway提供统一API和成本管理功能。
入选理由:Hy4 Preview拥有770B总参数和49B每token激活参数,支持1M tokens上下文窗口
通义千问Qwen3.8-Max-0902在Code Arena中排名第一,且在Pareto前沿以$5/MToken的经济效率领先。
入选理由:Qwen3.8-Max-0902在WebDev赛道获得1,691分,位列Code Arena总榜第一
腾讯Hy4-preview模型在vLLM框架上成功运行,验证于NVIDIA GPU,具备高参数量和高效路由机制。
入选理由:Hy4-preview模型总参数770B,活跃参数49B,采用256个路由专家架构