Qwen3-8B
Qwen3-8B 是 Hugging Face 上 Qwen 组织发布的稠密因果语言模型。上游模型卡将其定位为经过预训练和后训练的 8B 级文本生成模型,可在同一模型中切换思考与非思考模式。本站当前只整理仓库来源、...
- 来源
- Qwen
- 访问
- 公开
- 许可
- apache-2.0
- 上游文件
- 15 个 · 42.33 GB
仅展示已发布且完成人工审核的模型信息;具体可用性和用途条件请以详情页及上游原文为准。
Qwen3-8B 是 Hugging Face 上 Qwen 组织发布的稠密因果语言模型。上游模型卡将其定位为经过预训练和后训练的 8B 级文本生成模型,可在同一模型中切换思考与非思考模式。本站当前只整理仓库来源、...
这是基于 Qwen3.6-27B 的 1-bit Bonsai GGUF 版本,面向 llama.cpp 的 CUDA、Metal 和 CPU 推理。上游称模型部署体积约 3.9GB,并给出保留推理与智能体能力的评...
这是面向 Apple MLX 生态的 1-bit Bonsai 27B 版本。上游强调约 3.9GB 的部署体积和移动设备运行能力,并给出相对 FP16 的质量与速度测试;手机可运行性、内存限制、散热和实际吞吐均高...
Cosmos3-Edge 属于 NVIDIA Cosmos 3 物理 AI 世界模型系列,面向机器人、自动驾驶、工业和智能空间等场景。上游将 Cosmos 3 描述为可结合文本、图像、视频和动作轨迹生成视频、图像、...
GLM-5.2 是智谱发布的旗舰语言模型,模型卡将其定位于长流程任务、复杂推理和智能体应用,并提供论文、代码及在线服务链接。资源支持中英文,具体上下文长度、工具调用方式、推理框架与评测结论应以上游技术报告和仓库最新...
Inkling 是一个通用多模态模型,可接收文本、图像和音频输入并生成文本。上游模型卡将其定位于智能体与工具调用系统、编程助手、聊天机器人和检索等应用,并说明支持英语、其他自然语言及多种编程语言;实际能力、可接受使...
Kimi-K2.7-Code 是月之暗面发布的代码方向模型仓库,模型卡提供官方主页、代码产品和社区入口。该资源带有多模态和对话相关标签,具体代码智能体能力、工具协议、上下文限制、部署框架及自定义许可条件应以仓库完整...
LTX-Best-Face-ID 是面向 LTX-2.3 的身份保持型参考图转视频 LoRA。上游说明它通过参考照片与文本提示生成尽量保持人物身份的视频,并提供近景人脸和角色设定图两种参考方式;使用真实人物素材时必...
Laguna S 2.1 是面向智能体编程和长流程任务的混合专家模型,上游说明其总参数约 118B、每个 token 激活约 8B。模型采用滑动窗口与全局注意力混合布局,并强调工具调用、代码任务和长上下文工作;许可...
这是 Unsloth 提供的 Laguna-S-2.1 GGUF 量化版本,面向 Unsloth Studio 和 llama.cpp。上游说明量化文件采用校准方案,并给出约 40GB 的分片下载与 GPU 分层加...
该仓库提供 Laguna S 2.1 的 GGUF 转换文件以及用于推测解码的 DFlash 草稿模型。上游列出从 F16 到 Q4_K_M 等不同精度和体积的文件,架构、许可证和使用要求仍应参考基础模型卡;选择版...
Laguna S 2.1-NVFP4 是 Laguna S 2.1 的 NVFP4 压缩版本,面向本地智能体编程和长流程任务。上游说明其总参数约 117.6B、每 token 激活约 8.5B,并采用滑动窗口与全局...
MOSS-Transcribe-Diarize 0.9B 是面向长音频多说话人转写的端到端音频理解模型。上游说明其支持 50 多种语言、说话人区分、时间戳、声学事件和热词提示,并可单次处理最长约 90 分钟录音;准...
Mage-Flow 是微软发布的原生分辨率图像生成与编辑基础模型,采用面向图像生成和编辑的流式建模方案。上游提供论文、项目页面、代码和相关模型仓库;使用时应核对支持的输入形式、推理管线、分辨率限制、显存需求及许可证要求。
MiniCPM-RobotManip 是一个约 1.5B 参数的视觉—语言—动作模型,面向具身机器人操作任务。上游强调以一套权重覆盖多种下游操作任务,并以紧凑体积支持端侧部署;实际使用需要配合指定机器人环境、传感器...
MiniCPM-RobotTrack 是一个紧凑型视觉—语言—动作策略模型,面向具身目标跟踪任务。上游将其定位于机器人在视觉观察下理解指令并输出动作的场景;接入真实机器人前必须核对模型接口、控制频率、传感器标定、动...
Motif-3-Beta 是 Motif Technologies 发布的预览版混合专家检查点,并非最终版本。上游说明其约有 314B 总参数、每 token 激活约 13B,原生上下文长度为 256K,面向多语言...
Nanbeige4.2-3B 是一个约 3B 非嵌入参数的紧凑型智能体模型,基于 Nanbeige4.2-3B-Base 继续训练。上游介绍其采用循环复用 Transformer 层的结构,并通过监督微调和强化学习...
OvisOCR2 是一个约 0.8B 参数的端到端页面级文档解析模型,基于 Qwen3.5-0.8B 继续训练。给定文档页面图像,它可按自然阅读顺序生成 Markdown,并覆盖正文、公式、表格和视觉区域;上游给出...
这是第三方基于 Qwen3.6-27B 制作的多阶段微调与 GGUF 量化版本,仓库同时提供常规和 MTP 量化文件。模型卡包含大量基准与“去限制”能力声明,本站未独立验证;这类衍生模型可能弱化安全拒答,使用前应重...
这是第三方基于 Qwen3.6-35B-A3B“去限制”版本继续处理的 GGUF 衍生模型。上游称其通过统计与 SVD 方法重建部分权重信号,并强调多模态、智能体和低拒答特性;这些方法与效果未经本站验证,且弱化安全...
这是第三方基于 Qwen3.6-35B-A3B 制作的多模态“去限制”衍生版本。上游明确强调减少拒答并提供多种量化文件;此类修改可能显著改变原模型的安全行为,本站不对其“无拒答”或能力声明背书,使用前应进行严格的安...
这是 Qwythos-9B-Claude-Mythos-5-1M 的 GGUF 量化仓库,可用于 llama.cpp、Ollama、LM Studio 等 GGUF 运行环境。上游称模型基于 Qwen3.5-9B ...
Solar Open 2 是 Upstage 发布的 250B-A15B 开放权重混合专家模型,主要面向办公自动化、文档密集型工作、编程和智能体任务。上游强调混合注意力结构、较低激活参数量和长上下文能力;其许可证标...
这是基于 Qwen3.6-27B 的三值权重 GGUF 版本,面向 llama.cpp、CUDA、Metal 和 CPU 等本地推理环境。上游称其部署体积约 7.2GB,并给出相对 FP16 的压缩与评测结果;这些...
ThinkingCap-Qwen3.6-27B 是基于 Qwen3.6-27B 的微调模型,目标是在尽量保持回答质量与风格的同时减少推理 token。上游称其在多类推理、对话、系统指令、安全、数学、代码和智能体测试...
Unlimited-OCR 是百度发布的视觉文字识别与长文档解析模型,重点面向一次性、长流程的页面内容解析。上游提供论文、代码和模型资料,标签显示其支持多语言 OCR;对表格、公式、版面和长文档的具体效果应结合原论...
Gemma 4 31B-it 是 Google DeepMind 发布的指令微调开放权重模型,支持文本与图像输入并生成文本。上游提供技术报告、开发文档、代码与 Apache 2.0 许可链接;部署前应核对 Gemm...
Krea 2 Identity Edit 是面向 Krea-2-Raw 的图像编辑 LoRA,重点保持人物身份特征。上游说明其支持参考图重构、脸部或人物替换、扩图、局部重绘和虚拟试穿,并提供面向 ComfyUI 的...
Nemotron 3.5 ASR Streaming 0.6B 是 NVIDIA 发布的流式多语言自动语音识别模型。标签显示其采用缓存感知 FastConformer-RNNT 架构,面向低延迟语音转写;支持语言、...