资源目录

AI模型目录

仅展示已发布且完成人工审核的模型信息;具体可用性和用途条件请以详情页及上游原文为准。

模型可咨询

Qwen3-8B

Qwen3-8B 是 Hugging Face 上 Qwen 组织发布的稠密因果语言模型。上游模型卡将其定位为经过预训练和后训练的 8B 级文本生成模型,可在同一模型中切换思考与非思考模式。本站当前只整理仓库来源、...

来源
Qwen
访问
公开
许可
apache-2.0
上游文件
15 个 · 42.33 GB
查看详情 →
模型可咨询

Bonsai-27B-gguf

这是基于 Qwen3.6-27B 的 1-bit Bonsai GGUF 版本,面向 llama.cpp 的 CUDA、Metal 和 CPU 推理。上游称模型部署体积约 3.9GB,并给出保留推理与智能体能力的评...

来源
prism-ml
访问
公开
许可
apache-2.0
上游文件
14 个 · 63.56 GB
查看详情 →
模型可咨询

Bonsai-27B-mlx-1bit

这是面向 Apple MLX 生态的 1-bit Bonsai 27B 版本。上游强调约 3.9GB 的部署体积和移动设备运行能力,并给出相对 FP16 的质量与速度测试;手机可运行性、内存限制、散热和实际吞吐均高...

来源
prism-ml
访问
公开
许可
apache-2.0
上游文件
16 个 · 4.80 GB
查看详情 →
模型可咨询

Cosmos3-Edge

Cosmos3-Edge 属于 NVIDIA Cosmos 3 物理 AI 世界模型系列,面向机器人、自动驾驶、工业和智能空间等场景。上游将 Cosmos 3 描述为可结合文本、图像、视频和动作轨迹生成视频、图像、...

来源
nvidia
访问
公开
许可
other
上游文件
54 个 · 27.47 GB
查看详情 →
模型可咨询

GLM-5.2

GLM-5.2 是智谱发布的旗舰语言模型,模型卡将其定位于长流程任务、复杂推理和智能体应用,并提供论文、代码及在线服务链接。资源支持中英文,具体上下文长度、工具调用方式、推理框架与评测结论应以上游技术报告和仓库最新...

来源
zai-org
访问
公开
许可
mit
上游文件
295 个 · 1.37 TB
查看详情 →
模型可咨询

Inkling

Inkling 是一个通用多模态模型,可接收文本、图像和音频输入并生成文本。上游模型卡将其定位于智能体与工具调用系统、编程助手、聊天机器人和检索等应用,并说明支持英语、其他自然语言及多种编程语言;实际能力、可接受使...

来源
thinkingmachines
访问
公开
许可
apache-2.0
上游文件
125 个 · 1.74 TB
查看详情 →
模型可咨询

Kimi-K2.7-Code

Kimi-K2.7-Code 是月之暗面发布的代码方向模型仓库,模型卡提供官方主页、代码产品和社区入口。该资源带有多模态和对话相关标签,具体代码智能体能力、工具协议、上下文限制、部署框架及自定义许可条件应以仓库完整...

来源
moonshotai
访问
公开
许可
other
上游文件
87 个 · 554.33 GB
查看详情 →
模型可咨询

LTX-Best-Face-ID

LTX-Best-Face-ID 是面向 LTX-2.3 的身份保持型参考图转视频 LoRA。上游说明它通过参考照片与文本提示生成尽量保持人物身份的视频,并提供近景人脸和角色设定图两种参考方式;使用真实人物素材时必...

来源
Alissonerdx
访问
公开
许可
other
上游文件
50 个 · 8.47 GB
查看详情 →
模型可咨询

Laguna-S-2.1

Laguna S 2.1 是面向智能体编程和长流程任务的混合专家模型,上游说明其总参数约 118B、每个 token 激活约 8B。模型采用滑动窗口与全局注意力混合布局,并强调工具调用、代码任务和长上下文工作;许可...

来源
poolside
访问
公开
许可
openmdw-1.1
上游文件
61 个 · 218.98 GB
查看详情 →
模型可咨询

Laguna-S-2.1-GGUF

这是 Unsloth 提供的 Laguna-S-2.1 GGUF 量化版本,面向 Unsloth Studio 和 llama.cpp。上游说明量化文件采用校准方案,并给出约 40GB 的分片下载与 GPU 分层加...

来源
unsloth
访问
公开
许可
openmdw-1.1
上游文件
63 个 · 1.45 TB
查看详情 →
模型可咨询

Laguna-S-2.1-GGUF

该仓库提供 Laguna S 2.1 的 GGUF 转换文件以及用于推测解码的 DFlash 草稿模型。上游列出从 F16 到 Q4_K_M 等不同精度和体积的文件,架构、许可证和使用要求仍应参考基础模型卡;选择版...

来源
poolside
访问
公开
许可
上游未声明
上游文件
8 个 · 412.43 GB
查看详情 →
模型可咨询

Laguna-S-2.1-NVFP4

Laguna S 2.1-NVFP4 是 Laguna S 2.1 的 NVFP4 压缩版本,面向本地智能体编程和长流程任务。上游说明其总参数约 117.6B、每 token 激活约 8.5B,并采用滑动窗口与全局...

来源
poolside
访问
公开
许可
openmdw-1.1
上游文件
27 个 · 133.98 GB
查看详情 →
模型可咨询

MOSS-Transcribe-Diarize

MOSS-Transcribe-Diarize 0.9B 是面向长音频多说话人转写的端到端音频理解模型。上游说明其支持 50 多种语言、说话人区分、时间戳、声学事件和热词提示,并可单次处理最长约 90 分钟录音;准...

来源
OpenMOSS-Team
访问
公开
许可
apache-2.0
上游文件
19 个 · 3.41 GB
查看详情 →
模型可咨询

Mage-Flow

Mage-Flow 是微软发布的原生分辨率图像生成与编辑基础模型,采用面向图像生成和编辑的流式建模方案。上游提供论文、项目页面、代码和相关模型仓库;使用时应核对支持的输入形式、推理管线、分辨率限制、显存需求及许可证要求。

来源
microsoft
访问
公开
许可
mit
上游文件
43 个 · 16.29 GB
查看详情 →
模型可咨询

MiniCPM-RobotManip

MiniCPM-RobotManip 是一个约 1.5B 参数的视觉—语言—动作模型,面向具身机器人操作任务。上游强调以一套权重覆盖多种下游操作任务,并以紧凑体积支持端侧部署;实际使用需要配合指定机器人环境、传感器...

来源
openbmb
访问
公开
许可
apache-2.0
上游文件
21 个 · 3.35 GB
查看详情 →
模型可咨询

MiniCPM-RobotTrack

MiniCPM-RobotTrack 是一个紧凑型视觉—语言—动作策略模型,面向具身目标跟踪任务。上游将其定位于机器人在视觉观察下理解指令并输出动作的场景;接入真实机器人前必须核对模型接口、控制频率、传感器标定、动...

来源
openbmb
访问
公开
许可
apache-2.0
上游文件
28 个 · 928.79 MB
查看详情 →
模型可咨询

Motif-3-Beta

Motif-3-Beta 是 Motif Technologies 发布的预览版混合专家检查点,并非最终版本。上游说明其约有 314B 总参数、每 token 激活约 13B,原生上下文长度为 256K,面向多语言...

来源
Motif-Technologies
访问
公开
许可
上游未声明
上游文件
165 个 · 586.46 GB
查看详情 →
模型可咨询

Nanbeige4.2-3B

Nanbeige4.2-3B 是一个约 3B 非嵌入参数的紧凑型智能体模型,基于 Nanbeige4.2-3B-Base 继续训练。上游介绍其采用循环复用 Transformer 层的结构,并通过监督微调和强化学习...

来源
Nanbeige
访问
公开
许可
apache-2.0
上游文件
24 个 · 7.79 GB
查看详情 →
模型可咨询

OvisOCR2

OvisOCR2 是一个约 0.8B 参数的端到端页面级文档解析模型,基于 Qwen3.5-0.8B 继续训练。给定文档页面图像,它可按自然阅读顺序生成 Markdown,并覆盖正文、公式、表格和视觉区域;上游给出...

来源
ATH-MaaS
访问
公开
许可
apache-2.0
上游文件
15 个 · 1.60 GB
查看详情 →
模型可咨询

Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF

这是第三方基于 Qwen3.6-27B 制作的多阶段微调与 GGUF 量化版本,仓库同时提供常规和 MTP 量化文件。模型卡包含大量基准与“去限制”能力声明,本站未独立验证;这类衍生模型可能弱化安全拒答,使用前应重...

来源
DavidAU
访问
公开
许可
apache-2.0
上游文件
28 个 · 395.16 GB
查看详情 →
模型可咨询

Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V5-GGUF

这是第三方基于 Qwen3.6-35B-A3B“去限制”版本继续处理的 GGUF 衍生模型。上游称其通过统计与 SVD 方法重建部分权重信号,并强调多模态、智能体和低拒答特性;这些方法与效果未经本站验证,且弱化安全...

来源
LuffyTheFox
访问
公开
许可
apache-2.0
上游文件
18 个 · 349.66 GB
查看详情 →
模型可咨询

Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive

这是第三方基于 Qwen3.6-35B-A3B 制作的多模态“去限制”衍生版本。上游明确强调减少拒答并提供多种量化文件;此类修改可能显著改变原模型的安全行为,本站不对其“无拒答”或能力声明背书,使用前应进行严格的安...

来源
HauhauCS
访问
公开
许可
apache-2.0
上游文件
14 个 · 230.39 GB
查看详情 →
模型可咨询

Qwythos-9B-Claude-Mythos-5-1M-GGUF

这是 Qwythos-9B-Claude-Mythos-5-1M 的 GGUF 量化仓库,可用于 llama.cpp、Ollama、LM Studio 等 GGUF 运行环境。上游称模型基于 Qwen3.5-9B ...

来源
empero-ai
访问
公开
许可
apache-2.0
上游文件
15 个 · 311.74 GB
查看详情 →
模型可咨询

Solar-Open2-250B

Solar Open 2 是 Upstage 发布的 250B-A15B 开放权重混合专家模型,主要面向办公自动化、文档密集型工作、编程和智能体任务。上游强调混合注意力结构、较低激活参数量和长上下文能力;其许可证标...

来源
upstage
访问
公开
许可
other
上游文件
108 个 · 466.23 GB
查看详情 →
模型可咨询

Ternary-Bonsai-27B-gguf

这是基于 Qwen3.6-27B 的三值权重 GGUF 版本,面向 llama.cpp、CUDA、Metal 和 CPU 等本地推理环境。上游称其部署体积约 7.2GB,并给出相对 FP16 的压缩与评测结果;这些...

来源
prism-ml
访问
公开
许可
apache-2.0
上游文件
16 个 · 80.58 GB
查看详情 →
模型可咨询

ThinkingCap-Qwen3.6-27B

ThinkingCap-Qwen3.6-27B 是基于 Qwen3.6-27B 的微调模型,目标是在尽量保持回答质量与风格的同时减少推理 token。上游称其在多类推理、对话、系统指令、安全、数学、代码和智能体测试...

来源
bottlecapai
访问
公开
许可
apache-2.0
上游文件
32 个 · 51.78 GB
查看详情 →
模型可咨询

Unlimited-OCR

Unlimited-OCR 是百度发布的视觉文字识别与长文档解析模型,重点面向一次性、长流程的页面内容解析。上游提供论文、代码和模型资料,标签显示其支持多语言 OCR;对表格、公式、版面和长文档的具体效果应结合原论...

来源
baidu
访问
公开
许可
mit
上游文件
20 个 · 6.30 GB
查看详情 →
模型可咨询

gemma-4-31B-it

Gemma 4 31B-it 是 Google DeepMind 发布的指令微调开放权重模型,支持文本与图像输入并生成文本。上游提供技术报告、开发文档、代码与 Apache 2.0 许可链接;部署前应核对 Gemm...

来源
google
访问
公开
许可
apache-2.0
上游文件
12 个 · 162.96 GB
查看详情 →
模型可咨询

krea2-identity-edit

Krea 2 Identity Edit 是面向 Krea-2-Raw 的图像编辑 LoRA,重点保持人物身份特征。上游说明其支持参考图重构、脸部或人物替换、扩图、局部重绘和虚拟试穿,并提供面向 ComfyUI 的...

来源
conradlocke
访问
公开
许可
other
上游文件
28 个 · 7.72 GB
查看详情 →
模型可咨询

nemotron-3.5-asr-streaming-0.6b

Nemotron 3.5 ASR Streaming 0.6B 是 NVIDIA 发布的流式多语言自动语音识别模型。标签显示其采用缓存感知 FastConformer-RNNT 架构,面向低延迟语音转写;支持语言、...

来源
nvidia
访问
公开
许可
other
上游文件
21 个 · 6.79 GB
查看详情 →