TensorX

TensorX · Curated

精选论文解读、AI 笔记与关键洞见。

11 篇精选

MiniMax Sparse Attention

本文介绍了 MiniMax 稀疏注意力机制(MSA),一种基于分组查询注意力(GQA)的高效块状稀疏自注意力方案。通过引入超轻量级的索引分支和协同设计的 GPU 算子,MSA 在 100 万 token 上实现了 28.4 倍的计算量削减以及 H800 显卡上高达 14.2 倍的 Prefill 加速。

LLMSparse AttentionLong Context
阅读论文2026-06-12

ResearchStudio-Reel: Automate the Last Mile of Research from Paper to Poster, Video, and Blog

本文介绍了ResearchStudio-Reel,这是一个创新的学术传播自动化流水线。它能够将一篇 accepted 论文PDF一键转化为印刷级学术海报、带视觉高亮对齐的演讲视频以及高质量双语博客,且所有产出物在原生工具中均完全可编辑,重塑了学术成果发布的‘最后一公里’。

Academic DisseminationAI AgentsMulti-modal Generation
阅读论文2026-07-05

Image Generators are Generalist Vision Learners

本文探讨了图像生成预训练是否能作为通用视觉学习器。通过对生成模型 Nano Banana Pro 进行轻量级指令微调,构建出的 Vision Banana 在 2D 和 3D 视觉理解任务上均达到了 SOTA 级别,证明了生成预训练中蕴含着深层的通用视觉表征。

Image GenerationVisual UnderstandingFoundation Models

Gemma 4 Technical Report

本文深入解析谷歌最新开源的 Gemma 4 架构。通过引入端到端思考模式、无编码器多模态设计、以及高效的多Token预测机制,Gemma 4 在保持极高计算效率的前提下,实现了在复杂推理、长上下文理解与跨模态交互上的跨越式突破。

Gemma 4MultimodalSpeculative Decoding
阅读论文2026-06-19

北京市昌平区探索星信息技术及软件开发工作室

京ICP备2026059466号