Ternlight:一个 7 MB 的嵌入模型,在浏览器 CPU 上跑,不调接口
Ternlight – 7 MB embedding model that runs in browser (WASM)
Ternlight 把文本嵌入模型压缩到 7 MB,通过 WASM 直接在浏览器 CPU 上运行,单次 embed 调用约 5 毫秒。它打包成一个 npm 包,没有模型下载步骤,也不依赖服务端。另外还有一个 5 MB 的 mini 版本,演示里用它给 React 文档做了语义搜索。正文没披露模型架构细节、训练数据,也没给出 React 文档之外的检索质...
推荐理由:一个 7 MB 的嵌入模型通过 WASM 在浏览器 CPU 上跑,零服务端依赖,对前端和边缘场景的实用价值很直接。我会先打个折,因为正文没披露模型架构、训练数据,也没给出 React 文档之外的检索质量对比——这些缺口让“好用”还缺一块拼图,所以重要性停在 72。