两个演示均已部署上线 · 点击即可进入

大模型课程作业 · 项目展示

从视觉 Transformer 到大语言模型微调,两个可交互的在线演示,打开即用,无需安装。

刘童雨 · Z智能253 · 2025462507

PROJECT 01

Vision Transformer 图像分类

ViT · CIFAR-10 · Gradio

把 Transformer 架构搬到图像上:将图片切成 16×16 的图块序列,送入多头自注意力编码器完成分类。 上传任意图片即可实时看到 Top-5 预测与注意力热图。

PyTorch ViT-B/16 CIFAR-10 Gradio
进入演示
PROJECT 02

大模型风格微调(LoRA)

Qwen2.5-0.5B · LoRA · PEFT

用 LoRA 让 Qwen2.5-0.5B 学会「说武侠话」。仅训练 0.88% 的参数,左右双栏同题对照: 左侧是微调前的现代白话,右侧是微调后的半文半白,差异一眼可见。

LoRA r=8 PEFT Qwen2.5-0.5B 双栏对照
进入演示