功能特性

TensorSharp 目前能力的完整目录。每一项都链接到你可以使用它的页面。

亮点

🧠

多架构

Gemma 4 / 3、Qwen 3 / 3.5 / 3.6、GPT OSS、Nemotron-H、Mistral 3、DiffusionGemma、Qwen-Image-Edit。

🖼️

多模态

图像、视频与音频输入(Gemma 4);多个其他模型支持图像输入。

📄

PDF 文档

在 Web UI 上传 PDF,或在 CLI 传 --pdf —— 文本型 PDF 直接内联,扫描页则交给视觉模型。

🎨

图像编辑

Qwen-Image-Edit 将提示词 + 输入图像转为编辑后的图像(MMDiT 扩散)。

💭

思考模式

结构化的思维链,与可见答案分离。

🛠️

工具调用

跨三种 API 风格的多轮函数调用。

📦

原生量化计算

Q4_K_M、Q8_0、MXFP4、IQ2_XXS 等在 matmul 中直接运算,无需反量化到 FP32。

🔀

连续批处理

vLLM 式分页 KV 缓存,跨请求前缀共享。

推测解码

MTP / NextN 草稿头无损加速单序列解码。

🔗

多 GPU 与多节点

张量并行把一个模型切分到多张 GPU 上(CUDA 与 GGML 皆可),并通过 TCP 网格跨机器扩展。

🔌

Ollama 与 OpenAI API

面向现有工具的即插即用端点,外加浏览器聊天 UI。

模型与模态

生成与控制

性能与扩展

接口与集成