跳到主要内容

3 篇博文 含有标签「多模态」

查看所有标签

Chinese-CLIP 使用、训练与量化全梳理

· 阅读需 13 分钟
一介布衣
全栈开发者

中文多模态里,Chinese-CLIP 一直是一个很实用但也很容易被“半懂不懂地使用”的模型。很多人知道它能做图文检索、零样本分类,也知道它有 ViT-B/16ViT-L/14ViT-H/14 这些规模,但一旦往工程里落,问题马上就会变具体:

  • 我到底应该用 cn_clip 官方 API,还是直接走 Hugging Face 的 ChineseCLIPModel
  • 训练是不是只能全量训?有没有更省资源的办法?
  • 它官方支持到什么程度?哪些压缩/量化路线是 Chinese-CLIP 原生支持,哪些只是通用工具链“理论可套”?

我把公开资料重新过了一遍,尽量只看原作者和主流官方工具链的第一手文档。下面这篇,等价于一个截至 2026 年 7 月 21 日 的“Chinese-CLIP 可落地方法地图”。

Gemma 4 值不值得上手:从部署视角看它的手感和边界

· 阅读需 7 分钟
一介布衣
全栈开发者

先说清楚,这篇不是“我已经把 Gemma 4 全档位私有化跑了几周”的深测报告。更准确地说,它是一篇部署者视角的第一判断:只看官方文档、官方模型卡、上下文长度、模态支持、部署门槛和公开 benchmark 位置,Gemma 4 用起来会像什么样的模型。

Gemma 4 模型说明:E2B、E4B、26B A4B、31B Dense 怎么选

· 阅读需 6 分钟
一介布衣
全栈开发者

如果只看标题,很多人会以为 Gemma 4 是一个单一模型,再往下分几个参数档位。真正去看官方文档和模型卡以后,我更愿意把它理解成一条产品线,而不是一个点。因为这次 Google 给出来的,不只是“大一点和小一点”的差别,而是从 edge 到 workstation / server 的一整套部署带宽设计。