
Github
CausVid是一种基于自回归因果推理架构的AI视频生成模型,专为解决传统模型“生成速度慢、长视频质量差”的痛点而设计。由麻省理工学院计算机科学人工智能实验室(CSAIL)与 Adobe Research 联合研发,这一混合模型可以在几秒钟内生成高质量视频。
官网域名
github.com
平台
Web
语言
未标注
核验时间
2026-05-16
覆盖 14 个实用分类,持续更新优质 AI 工具
精选常用 AI 网站与工具,按分类和关键词快速找到适合你的工具,直接查看官网、平台与功能简介。
收录工具
31,832
一级分类
13
统一标签
388
官网入口
31,832

CausVid是一种基于自回归因果推理架构的AI视频生成模型,专为解决传统模型“生成速度慢、长视频质量差”的痛点而设计。由麻省理工学院计算机科学人工智能实验室(CSAIL)与 Adobe Research 联合研发,这一混合模型可以在几秒钟内生成高质量视频。
官网域名
github.com
平台
Web
语言
未标注
核验时间
2026-05-16

Parakeet-TDT-0.6B-V2是英伟达在语音识别技术领域的又一力作,它基于先进的FastConformer架构,并融合了创新的TDT解码器,是一款专注于英文自动语音识别的强大模型。作为Parakeet模型的升级版本,它不仅继承了前代模型的优秀基因,还在性能和功能上实现了重大突破。
官网域名
app.klingai.com
平台
Web
语言
未标注
核验时间
2026-05-16

MiMo-7B是小米AI实验室发布的首个专为推理(Reasoning)设计的开源大模型,该模型以7亿参数的轻量化架构,结合强化学习优化,展现了在数学、代码和通用推理任务上的卓越性能,甚至超越了多个32亿参数以上的基线模型。
官网域名
app.klingai.com
平台
Web
语言
未标注
核验时间
2026-05-16

F-Lite是一款基于扩散变换器架构的文本到图像生成模型,由Black Forest Labs开发并于2025年最高1024x1024图像,并具备开源特性,适用于正式登陆Hugging Face平台。该模型以10亿参数的轻量化设计,实现了高效、低成本的图像生成能力,支持通过自然语言提示生成高分辨率
官网域名
app.klingai.com
平台
Web
语言
未标注
核验时间
2026-05-16

ChatDLM是Qafind Labs于2025年推出的新一代对话生成大模型,通过融合"区块扩散(Block Diffusion)"与"专家混合(MoE)"技术,该模型在保持7B参数量级的同时,实现了A100 GPU上2800 tokens/s的推理速度,较GPT-4等通用模型提升3-5倍。
官网域名
app.klingai.com
平台
Web
语言
未标注
核验时间
2026-05-16

EmaFusion是Ema公司推出的一款新型AI语言模型,它采用了一种创新的“级联”判断系统,能够动态平衡成本和准确性。与传统的单一策略系统相比,EmaFusion更像是一个“任务智能大脑”,能够智能地拆解复杂的问题,并将其分配给最合适的AI模型来解决。
官网域名
ema.co
平台
Web
语言
未标注
核验时间
2026-05-16

Vidi是字节跳动推出的一款全新多模态模型,它专注于视频理解与编辑领域,旨在通过融合视觉、音频和文本等多种模态信息,为用户提供精准、高效的视频处理解决方案。Vidi不仅能够处理长达一小时的超长视频,还能在时间检索和多模态协同处理方面展现出卓越的性能。
官网域名
app.klingai.com
平台
Web
语言
中文
核验时间
2026-05-16

Flex.2-preview是由Ostris团队发布的一款基于8亿参数的文本到图像扩散模型,专为集成到ComfyUI工作流设计。该模型在Hugging Face上开源,采用Apache2.0许可证,凭借其强大的控制能力与高效生成特性,迅速成为AI艺术创作社区的焦点。
官网域名
app.klingai.com
平台
Web
语言
未标注
核验时间
2026-05-16

Dia是由Nari Labs团队开发的一款拥有1.6亿参数的文本转语音(TTS)模型。它旨在直接从文本提示生成自然对话,并支持包括情绪语调、说话人标记以及(笑)、(咳嗽)、(清嗓子)等非语言音频提示等细致功能。这些功能仅通过纯文本即可实现,使得Dia在语音生成领域具有极高的灵活性和实用性。
官网域名
app.klingai.com
平台
Web
语言
未标注
核验时间
2026-05-16

Magi-1是一款由Sand.ai团队研发的自回归视频生成模型。它采用了先进的深度学习技术,通过预测视频块序列(这些视频块是连续帧的固定长度片段)来生成高质量的视频内容。Magi-1不仅支持因果时间建模,还能实现自然的流式生成,为用户提供了极大的创作自由和灵活性。
官网域名
app.klingai.com
平台
Web
语言
未标注
核验时间
2026-05-16

Nes2Net是专为语音防伪检测量身打造的深度学习模型架构,它直接处理高维特征以避免信息损失,通过独特的嵌套结构实现多层次、多粒度的特征交互,具备无降维处理、多尺度特征提取、轻量化设计以及强鲁棒性与泛化能力等特点,能有效识别多种伪造声音类型,在提升检测精度的同时降低计算成本。
官网域名
app.klingai.com
平台
Web
语言
未标注
核验时间
2026-05-16

MarkItDown MCP(Model Context Protocol)是微软推出的一款强大的文档转换工具,它能够将多种格式的文件(如PDF、Word、PowerPoint、Excel等)轻松转换为Markdown格式。
官网域名
app.klingai.com
平台
Web
语言
未标注
核验时间
2026-05-16

AI Playground是一款集图像生成、图像风格化、文本生成与聊天机器人等功能于一体的AI中心。它支持多种图像和视频生成模型,如Stable Diffusion 1.5、SDXL、Flux.1-Schnell和LTX-Video等等大模型,通过O深度优化,能够GPU处理器上实现高效推理
官网域名
app.klingai.com
平台
Web
语言
未标注
核验时间
2026-05-16

MAI-DS-R1是微软在DeepSeek-R1基础上进行魔改后推出的全新开源模型。它继承了DeepSeek-R1的推理性能,同时在响应敏感话题和降低安全风险方面进行了大幅度增强。这一模型旨在为用户提供更加智能、安全、多语言的AI交互体验。
官网域名
app.klingai.com
平台
Web
语言
多语言
核验时间
2026-05-16

讯飞绘文是科大讯飞股份有限公司推出的一款专为内容运营工作者打造的AI智能写作产品。它基于讯飞星火大模型,通过强大的自然语言处理能力和深度学习技术,重塑了内容创作的全流程。无论是选题、配图、成文还是发布,讯飞绘文都能提供一站式的服务,让内容运营变得更加简单和高效。
官网域名
app.klingai.com
平台
Web
语言
中文
核验时间
2026-05-16

SpatialLM是杭州群核科技自主研发的一款专为三维空间理解设计的大语言模型。它能够从普通手机或相机拍摄的视频中,快速生成物理正确的3D场景布局。这一能力使得SpatialLM在无需昂贵激光雷达或专业设备的情况下,就能实现高精度的空间数据采集与处理。
官网域名
app.klingai.com
平台
Web
语言
未标注
核验时间
2026-05-16

OmniTalker是阿里通义实验室开发的一款基于深度学习和多模态融合技术的新型数字人视频生成大模型。它能够通过上传一段参考视频,实现对视频中人物的表情、声音和说话风格的精准模仿,从而生成高度逼真的数字人视频。
官网域名
app.klingai.com
平台
Web
语言
中文
核验时间
2026-05-16

狸谱App是一款专为二次元爱好者打造的AI创作社区软件。它依托阶跃星辰的多模态大模型,将AI生图技术发挥到了极致,为用户提供了便捷、高效的二次元创作工具。在这里,用户可以尽情发挥自己的想象力,创作出各种风格的二次元美图、同人壁纸以及原创角色。
官网域名
app.klingai.com
平台
Web
语言
未标注
核验时间
2026-05-16

快标书AI是长沙曼巴比特科技有限公司推出的一款基于先进大模型技术的专业AI标书制作工具。该工具能够在 10 分钟内快速生成高质量的投标书,显著提高标书制作效率。平台支持超百万级长文本输出,并具备智能解析招标文件、精准提取关键条款和评分标准的功能,确保生成的投标方案完整、合规且具有竞争力。
官网域名
app.klingai.com
平台
Web
语言
未标注
核验时间
2026-05-16

Kimi-VL与Kimi-VL-Thinking是由国内知名人工智能公司Moonshot AI(月之暗面)于近期开源发布的两款视觉语言模型。这两款模型以其轻量级的架构和卓越的多模态理解与推理能力,迅速在行业内引起了广泛关注。它们不仅在多项基准测试中超越了包括GPT-4o在内的众多大型模型。
官网域名
github.com
平台
Web
语言
中文
核验时间
2026-05-16