🗣️victor / gemma-avatar
实时语音对话demo,使用Gemma 4 31B模型(Google DeepMind)进行推理,结合Silero-VAD、Parakeet STT、Qwen3-TTS,驱动3D头像实现嘴唇同步、表情和手势。
收藏 144 · 2个月前更新
本页记录当日收录项目;运行状态与体验入口按当前结果更新。完整目录见 Space 体验目录。
实时语音对话demo,使用Gemma 4 31B模型(Google DeepMind)进行推理,结合Silero-VAD、Parakeet STT、Qwen3-TTS,驱动3D头像实现嘴唇同步、表情和手势。
图像外绘demo,基于Krea 2 Turbo(8步蒸馏流匹配)和秩32 LoRA,上传图片并指定画布位置,模型填充扩展区域并保留原像素。
运行模型 yijunwang2/krea2-outpaint ↗
27B参数三元权重大模型(权重取-1/0/1,约1.71 bits/weight)的聊天demo,通过Hugging Face推理API运行,支持流式生成文本。
运行模型 prism-ml/Ternary-Bonsai-27B-gguf →
客户端可视化工具,展示Gemma 4的按宽高比保留图像缩放与token预算,输入图像和Nmax值,实时显示不同预算下的分辨率与token数。
该 Space 是超大规模训练手册:面向大型 GPU 集群训练 LLM 的指南,包含本地安装与运行说明,采用 npm 构建与 HTML 片段加载。
该 Space 是交互式科学写作模板,以网页形式呈现 LLM 训练手册,支持交互图表、数学、代码和可检查实验,采用 CC BY 4.0 许可。
输入关键词,跨模型 / 数据集 / 空间 / 工具 / 资讯 / 论文 检索