抓取结果
ModelScope魔搭社区 ModelScope魔搭社区 ModelScope魔搭社区 模型库数据集创空间开发者实践MCP广场AIGC专区Skills科学智能 去全站搜索看看? 登录 登录社区云 登录社区云,与社区用户共同成长 CSDN账号登录 ModelScope魔搭社区 邀请您加入社区 立即加入 欢迎加入社区 取消 确定 欢迎加入社区 取消 确定 FireRedTTS3 开源:24 语言零样本克隆,克隆/设计/编辑统一建模 魔搭ModelScope社区 2026-08-25 腾讯视频智创开源CoinVE-200K数据集,视频编辑迈向复合多指令新范式 魔搭ModelScope社区 2026-08-24 Ling-3.0 tiny & flash Base Models 正式开源 魔搭ModelScope社区 2026-08-21 Ornith-1.5 开源:端到端自改进训练,35B MoE 激活 3B 即超越同级稠密模型 Gemma-4-31B 魔搭ModelScope社区 2026-08-21 Qwen3.8-27B-DFlash2 开源:1.92B 草稿模型,SGLang 单并发吞吐达自回归 3.4 倍 魔搭ModelScope社区 2026-08-20 提问题 加入社区 ModelScope魔搭社区 https://modelscope.csdn.net 成员 ModelScope旨在打造下一代开源的模型即服务共享平台,为泛AI开发者提供灵活、易用、低成本的一站式模型服务产品,让模型应用更简单。 欢迎加入社区 取消 确定 发布内容 类型 问答 讨论 标题 标签 无匹配数据 加载中 附件 添加附件 可以上传10M以内的文件,支持格式:zip,rar,7z,jpg,png,jpeg 温馨提示:您尚未绑定手机号 为遵守国家网络实名制规定,未绑定将限制内容发布与互动 立即绑定 注意:为提高问题回答效率,我们可能会把您的问题同步到CSDN等合作平台 取消 发布 FireRedTTS3 开源:24 语言零样本克隆,克隆/设计/编辑统一建模 小红书 FireRed 团队开源语音生成与编辑模型 FireRedTTS3,用同一套框架完成三类任务:多语言、多方言的零样本音色克隆,基于自然语言描述的声音设计,以及针对指定区域的精准语音编辑。 给定几秒钟的参考音频,模型可以用该音色说 24 种语言、21 种中文方言;给定一句文字描述,可以生成一个此前不存在的声音;给定一段现成语音,可以只修改指定的片段,其余部分与音色保持不变。克隆、设计、编辑三 魔搭ModelScope社区 1天前 62 腾讯视频智创开源CoinVE-200K数据集,视频编辑迈向复合多指令新范式 腾讯视频智能创作团队,开源了组合指令视频编辑数据集 CoinVE-200K。该数据集包含 20 万组视频编辑样本对,每个视频均为 1080p 分辨率,最长可达 201 帧。每个样本包含 2 至 5 个原子编辑操作,涵盖多个目标主体,包括人物、物体和背景,并覆盖广泛的编辑类型,包括添加、移除、修改以及风格化。 团队同时开源了基于 Wan2.1-T2V-14B 与 Qwen 魔搭ModelScope社区 2026-08-24 17:20:57 35 Ling-3.0 tiny & flash Base Models 正式开源 8 月以来,Ling-3.0 系列模型陆续开放。灵波先后开源 Ling-3.0-flash 和 Ling-3.0-tiny,希望为开发者提供覆盖不同规模、不同任务需求的开放模型选择。 开源之后,越来越多开发者开始基于 Ling-3.0 探索自己的应用场景,灵波也收到了很多来自社区真实的使用和反馈。大家普遍反馈:希望拥有一个更开放、更具可塑性的 Base Model,以便基于自己的数据、任务和目标开 魔搭ModelScope社区 2026-08-21 10:08:39 107 Ornith-1.5 开源:端到端自改进训练,35B MoE 激活 3B 即超越同级稠密模型 Gemma-4-31B Ornith AI 团队开源 Ornith-1.5 系列模型,包含 397B MoE(旗舰)、35B-A3B MoE(每 token 激活 3B)和 9B Dense(含手机端量化版本)三个规格,均采用 MIT 协议。Ornith-1.5 的核心方法是端到端自改进:模型自行提出任务、生成评测脚手架、产出解题轨迹,三者用 GRPO 联合优化形成闭环,不再依赖人工策划的训练任务和固定评测 魔搭ModelScope社区 2026-08-21 09:37:14 609 Qwen3.8-27B-DFlash2 开源:1.92B 草稿模型,SGLang 单并发吞吐达自回归 3.4 倍 Inco AI 团队开源面向 Qwen3.8-27B 的投机解码草稿模型 Qwen3.8-27B-DFlash2。该草稿模型参数量 1.92B、约 3.85GB,与目标模型 Qwen3.8-27B 配合使用,沿用 DFlash 系列一次前向传播并行预测整块 token 的草稿设计,并在此基础上新增轻量路径选择器和双抽头动态卷积,把草稿准确率保持到整块末尾。 在单张 NVIDIA H200、SGLa 魔搭ModelScope社区 2026-08-20 09:52:46 762 1 FastFlowLM 接入魔搭社区:AMD Ryzen™ AI NPU 推理框架,一个参数切换国内下载源 FastFlowLM(FLM)发布 v0.9.46,正式接入魔搭社区(ModelScope)。它是首个专为 AMD Ryzen™ AI NPU 打造的开箱即用推理运行时,使用方式与 Ollama 类似——一行命令拉取模型、一行命令运行,但底层完全针对 NPU 硬件重新设计。此前模型默认从 Hugging Face 拉取,本次新增 --modelscope 1 参数,国内用户可将下载源切换到魔搭,无 魔搭ModelScope社区 2026-08-19 11:05:29 114 B站indexTTS 2.5 开源:五国语言零样本配音,推理提速 2.28 倍 B站 IndexTTS 团队近日在魔搭社区开源 IndexTTS 2.5,一款支持中、英、日、西、阿五语种的零样本语音复刻模型。IndexTTS 系列此前以情感-音色解耦和高情绪还原度在社区获得广泛关注,但也面临两个集中反馈:语种覆盖有限(仅中英)、推理速度不够快。2.5 版本针对这两点做了系统性升级,同时补齐了语速控制能力。 主要技术指标:推理提速约 2.28 倍(A10 环境)、 魔搭ModelScope社区 2026-08-19 10:45:08 161 小红书开源dots3-note Preview:280B 总参数激活 16B,512K 上下文的三模态长程 Agent 模型 小红书 dots studio 团队开源 dots3-note Preview。作为 dots3 系列(将包括 note、jazz、aria 三档)中最轻量的模型,note 总参数 280B、激活参数 16B,支持 512K 上下文,具备文本、视觉和语音的多模态理解能力,并针对复杂推理和长程 Agent 任务进行了优化。 dots3-note Preview 在推理、Agent 及多 魔搭ModelScope社区 2026-08-17 14:17:33 273 走到LLaDA-2.2,关于扩散语言模型上的一些理论和实际思考 过去一年,diffusion language model(dLLM)快速升温。Google 发布了 DiffusionGemma,LLaDA 系列推进到了 2.2,黄高老师团队的 *The Flexibility Trap: Rethinking the Value of Arbitrary Order in Diffusion Language Models* 也获得了 ICML Outsta 魔搭ModelScope社区 2026-08-14 11:34:48 73 LTX-2.5 开源:22B 音画生成模型,原生多镜头、自动时长与 4K HDR Lightricks 开放 LTX-2.5 模型权重。这是 LTX-2 音视频生成模型的最新版本,参数规模为 22B,可根据文本、图像和视频输入生成同步音画。相比 LTX-2.3,LTX-2.5 进一步更新视频解码、提示词理解和蒸馏流程,并新增原生多镜头、自动时长预测、4K HDR 与 RAW 工作流等能力。模型同时提供面向微调的 Dev 权重和固定 8 步推理的 Distilled 权重。 模型 魔搭ModelScope社区 2026-08-14 10:00:26 466 加载更多 欢迎加入社区 取消 确定 ModelScope魔搭社区 加入社区 欢迎加入社区 取消 确定 提供社区服务与技术支持 提供社区服务与技术支持 ©1999-2023北京创新乐知网络技术有限公司 京ICP备19004658号
网站标题
ModelScope魔搭社区
关键词
ModelScope魔搭社区
站点描述
ModelScope魔搭社区 -ModelScope旨在打造下一代开源的模型即服务共享平台,为泛AI开发者提供灵活、易用、低成本的一站式模型服务产品,让模型应用更简单。