Analytics Vidhya 中文 关注 DiffusionGemma:Google 基于扩散的开放模型,用于加速文本生成 大型语言模型通常逐个生成 token。虽然这种自回归方法能够带来高质量输出并遵循指令,但对于本地用户而言,由于 GPU 往往花费更多时间在内存中搬运权重而非执行并行计算,因此效率较低。Google DeepMind 的 DiffusionGemma 采取了不同的路径,生成并细化 token 块 […]" DiffusionGemma: Google’s Diffusion-Based Open Model for Faster Text Generation analyticsvidhya.com Analytics Vidhya 中文 RSS thenote.app