Ovis-Image:阿里开源的7B 参数轻量级AI文生图模型
Ovis-Image是由阿里巴巴AIDC-AI团队基于Ovis-U1框架开发的一款轻量级开源文本到图像生成模型,核心参数量仅7B,却能在文本渲染任务上实现媲美20B级开源模型及GPT-4o等闭源模...
Ovis-Image是由阿里巴巴AIDC-AI团队基于Ovis-U1框架开发的一款轻量级开源文本到图像生成模型,核心参数量仅7B,却能在文本渲染任务上实现媲美20B级开源模型及GPT-4o等闭源模...
HivisionIDPhotos 是一款轻量级开源 AI 证件照制作工具,支持纯离线 CPU 推理,集成多套抠图与人脸检测模型,可实现人像精准抠图、多规格证件照生成、自定义底色、排版打印...
MemMachine是一款面向AI智能体的开源通用内存层工具,支持工作(短期)、持久(长期)、个性化(档案)三类记忆,其内存层可跨多个会话、代理及大语言模型持久化,将情景记...
GigaWorld-0是由极佳视界(GigaAI)开源的具身智能专用世界模型框架,其核心定位为“世界模型即数据引擎”,通过GigaWorld-0-Video和GigaWorld-0-3D两大协同组件,首次实现...
PartCrafter是由北京大学、字节跳动与卡内基梅隆大学联合开源的结构化 3D 网格生成模型,该模型创新性地采用组合式潜在空间与局部 - 全局联合去噪 Transformer 架构,可直接...
Mistral 3 是由 Mistral AI 开发的全规模开源多模态 AI 模型家族,该家族涵盖从 3B 参数的边缘轻量模型(Ministral 3 系列)到 675B 参数的云端旗舰模型(Mistral Large 3)...
Flowra是阿里云魔搭(ModelScope)生态下FlowBench平台的核心图形执行引擎与节点包开发工具链,基于Python 3.10+构建,专为AI功能封装与工作流编排场景设计。该项目提供了从节...
Z-Image Turbo Controlnet Union是阿里通义实验室开源的ControlNet扩展模型,基于Z-Image系列单流扩散架构,6B参数实现 photorealistic 渲染,支持Canny、HED、姿态等多模态...
Stand-In是微信CV团队开源的一款轻量级、即插即用的视频生成身份控制框架,核心优势在于仅需训练基础视频生成模型1%的额外参数,就能在人脸相似度和自然度上达到行业领先水...
MobiAgent是一款开源的可定制移动智能体系统,该框架核心包含MobiMind代理模型家族、AgentRR加速框架与MobiFlow评测基准三大模块,支持通过ADB连接Android设备,实现跨应用...