从视觉 Transformer 到大语言模型微调,两个可交互的在线演示,打开即用,无需安装。
刘童雨 · Z智能253 · 2025462507
把 Transformer 架构搬到图像上:将图片切成 16×16 的图块序列,送入多头自注意力编码器完成分类。 上传任意图片即可实时看到 Top-5 预测与注意力热图。
用 LoRA 让 Qwen2.5-0.5B 学会「说武侠话」。仅训练 0.88% 的参数,左右双栏同题对照: 左侧是微调前的现代白话,右侧是微调后的半文半白,差异一眼可见。