跳到正文
r/LocalLLaMA

llama.cpp 合并 PR,开始支持腾讯混元 Hy4 预览版架构

Model: add Tencent Hy 4 (hy_v4) preview architecture support by Little0o0 · Pull Request #28127 · ggml-org/llama.cpp

社区开发者 Little0o0 给 llama.cpp 提了个 PR,让这个本地推理框架能跑腾讯刚放出的 Hy4 预览版模型。模型权重已经挂在 HuggingFace 上,但帖子和 PR 里都没提参数量、具体架构细节,也没说本地跑起来最少要多少显存。目前还没人留言反馈实际运行情况,想试的话建议先等等社区的上手报告。

读原文 ↗导出 Markdown