OpenAI 最智能、最契合人类意图的模型,适用于编程、网页浏览、科学研究和专业工作。
Google 最智能的 Flash 模型,专为长期软件工程、自主智能体和复杂的多步推理而打造—以 Flash 级的速度和成本,提供前沿水平的性能。
Meta 升级版多模态推理模型,专为长期智能体和编程任务打造,具备更强的指令遵循能力、更高效的工具使用能力,以及 100 万 token 的上下文窗口。
Anthropic 面向编码与知识工作的最先进模型——其研究能力初步展现了 AI 将如何推动科学进步。
将视频翻译成 170+ 种语言与地区口音,并自动对口型。
一张照片+一段文字或音频,生成开口说话的视频,30 种 AI 音色可选。
智能补画视频边缘,一键适配横竖屏任意比例。
输入一句描述,为视频智能生成匹配的音效与环境音。
用 Topaz AI 将视频增强至 720p/1080p/4K、60 帧,细节更清晰。
约 $0.035/秒,真正无限制生成。
阿里巴巴推出的快速多模态推理模型,适用于编程、智能体工作流、视觉理解、文档/代码库分析、桌面交互、图表和长视频等场景。
Z.ai 原生多模态模型,适用于高效编码和长周期智能体任务。
阿里通义万相 3.0 高速版:文字、图片、参考视频/音频、文档、网页输入与标准版一致,端到端生成速度显著提升。
实时会议转写,支持说话人分离、AI 对话清理、翻译和自动生成会议纪要。
Z.ai 的旗舰模型,在编码、软件工程、推理和长程智能体能力方面实现了显著提升。
Google 最新模型,成本更低。
约 $0.005/张,专为大批量生成而打造。
智能 × 速度 × 成本综合排名第一 — Elon 表示。
最适合文本与版式设计
一款拥有更高保真度、更丰富风格,并且文本渲染效果更佳的文字生成图像模型。
阿里通义万相全能参考视频模型:文字、图片、参考视频/音频,甚至一份文档或一个网页都能生成视频。
一款多模态 AI 模型,可生成带原生音频的逼真视频。
Meta 推出的推理模型,专为复杂的智能体任务设计,支持多模态输入,并拥有 100 万 token 的上下文窗口。
全球最佳视频模型
AI 视频检测工具,精准识别视频中的 AI 生成内容。
AI 图片检测工具,精准识别图片中的 AI 生成内容。
支持文生视频、图生视频,以及基于图片、视频和音频参考素材生成视频的多模态视频生成模型。
快速多语言文本转语音。
音乐生成,提供两种模式:歌曲(通过风格提示将歌词生成完整歌曲)和 BGM(根据描述生成器乐背景音乐)。
文本转语音和音效生成;支持参考音频或图片,提供 18 种语言。
根据文本提示生成音乐,时长从 3 秒到 10 分钟。
高度稳定的长篇旁白语音,支持 29 种语言,最多 10,000 个字符。
富有表现力的文本转语音,支持 [whispering] 等音频标签,覆盖 70 多种语言。
一款在推理、编程和多语言任务上表现强劲的旗舰级 AI 模型。
Claude Opus 5 是一款旗舰级大语言模型,专为高度复杂的任务而设计,擅长深度推理、专业编程、长篇分析和高质量内容创作。
Google 的高效模型,具备升级的智能体能力,适合在多智能体工作流中由子智能体执行聚焦任务。
Google 的高效模型,可助力编码、智能体工作流以及网页/应用开发,以更低的 token 用量和更少的模型调用交付高质量输出。
GLM-5.2 是智谱 AI 的旗舰模型,拥有 100 万 token 的上下文窗口,在代码、推理、写作和长周期智能体任务方面表现出色。
Kimi K3 是月之暗面(Moonshot AI)推出的新一代语言模型,专为中文理解、推理、编程、长文本处理和内容创作而设计。
约 $0.007/秒,真正无限生成。
字节跳动推出的新一代图像模型,具备高保真、快速、指令精准生成的能力。
GPT-5.6 Luna 是轻量、高速的版本,专为快速交互而优化。它非常适合快速答疑、简单编程辅助、翻译、摘要以及各种对响应速度要求最高的日常任务。
GPT-5.6 Terra 是专为日常生产力打造的均衡版本。它在推理、编程、写作和多语言表现方面都很出色,同时保持回复快速高效,是大多数用户的理想默认选择。
GPT-5.6 Sol 是旗舰版本,专为高级推理、复杂编程、长上下文任务和高质量写作打造。它最适合那些需要最强综合智能、愿意用一点速度换取更深入、更可靠答案的用户。
Claude Sonnet 5 是 Anthropic 面向高频日常使用推出的高性价比模型,具备快速响应、强大的编程与智能代理任务能力,整体性能接近旗舰级 Opus 系列。
支持文件导入、源文编辑、智能翻译和结果导出,并在多次修订中保持术语、结构和风格一致。
电影级视频生成,配套同步音频。
Claude Fable 5 是一款专为清晰推理、自然写作和可靠任务完成而设计的语言模型。它专注于简洁沟通、创意协作,以及在编程、分析和内容生成等场景中的实际问题解决。
Claude Opus 4.8 是 Anthropic 的旗舰模型,专为高级推理、编程和长上下文任务而设计。它在复杂软件任务、文档分析以及持续的多轮协作方面表现出色。其优势在于深度和可靠性,而速度相比轻量级模型则不是核心重点。
Gemini 3.5 Flash 是一款超快速、轻量级的前沿模型,为高级多模态工作流程提供专业级编码与推理能力,并支持 100 万 token 的上下文窗口。
GLM-5.1 标志着编码能力的一次飞跃。它不再局限于简短的交互,可以在单个任务上自主工作超过 8 小时——从规划、执行到持续优化,直到交付可用于生产环境的结果。
Grok 4.3 是一个 xAI 推理模型,支持文本和图像输入。为代理式工作流程和高事实准确性而构建,提供可调节的推理强度,以处理复杂指令。
阿里巴巴的下一代模型,支持图生/文生/参考生视频,并提供视频编辑功能,实现多模态、高自由度的视频生成与创作。
Alibaba 一体化 AI 视频模型——生成、动画化、参考并编辑视频,具备电影级运动效果和逼真的物理表现。
几乎和 Fable 5 一样智能,价格仅为其 1/10。
DeepSeek 的高效优化 MoE 模型,具备快速推理、100万token上下文窗口,以及适用于高吞吐聊天和编码任务的强大推理能力。
OpenAI 的巅峰智能。精通复杂推理、原生多模态,以及自主的智能体执行。
OpenAI 最先进的模型,用于生成逼真的照片级图像、实现无瑕疵的文字渲染,以及进行高保真编辑。
Kimi 最新、最智能的模型,拥有更强大且更稳定的长期代码编写能力。
Anthropic 的顶级模型,适用于高级推理和复杂编码。
支持参考图的电影级视频生成
字节跳动推出的高速、电影级视频模型。
字节跳动最强大的AI视频模型,具备电影级视觉效果。
OpenAI 的轻量级模型,针对简单的高并发任务进行了优化。
OpenAI 迄今为止最强的 mini 模型,适用于编码、计算机操作和子代理。
以实惠价格提供顶级性能。适用于高级图像生成和无缝编辑的高质量、生产级模型。
你的个人 AI 助手,运行在你自己的设备上。针对语音、浏览器自动化和多智能体工作流进行了优化——本地优先,隐私至上。
根据上传图片替换原图人物面部。
根据上传图片或描述替换原图背景。
根据上传图片替换原图人物衣服。
为图片中人物更换发型发色。
几秒内把你的产品变成高转化的视觉素材。
一键生成专业海报,包含文案、排版和视觉。
OpenAI 最智能的模型,针对长时间运行的工作流、编程代理以及需要大上下文的复杂多轮任务进行了优化。
OpenAI 的新一代模型,以突破性的推理能力和速度,实现即时智能。
Google 成本效率最高的轻量级模型,针对高并发、低延迟任务进行了优化。
Google 的高速图像模型,用于通用生成和编辑,具备高质量和低延迟表现。
字节跳动推出的下一代图像模型,具备实时网页搜索、智能推理和面向企业的视觉生成能力。
Google 升级版旗舰模型,为复杂的实际任务提供更强的推理能力、更高的效率和更可靠的性能。
Anthropic 最强大的 Sonnet 模型,在编程和推理方面提供接近旗舰级的性能。
一款可生成带有原声音轨的电影级视频生成模型。
Anthropic 最强大的模型,专为高级推理、编程和复杂工作流程打造。
Kimi 最多功能的模型,原生支持视觉、文本、推理和智能体任务。
为日常创意使用提供即时且稳定的视频生成
用任意一张生活照直接生成证件照。
用AI技术将原图自动扩展到各种比例。
高清修复图片,可专门针对人脸调整。
AI自动去除图片水印。
AI自动去除图片背景。
阿里巴巴的下一代模型,支持多镜头电影级叙事,实现连贯的视频内容生成。
Google 的高速、高价值推理模型,专为智能体流程和交互式编程优化。
OpenAI 最新的模型,具备自适应推理、更强的自主行为,以及更好的长文本处理能力。
Anthropic 最智能的模型,兼具顶级能力和出色的实用性能。非常适合复杂任务和软件开发。
Google 最强大、最先进的图像生成和编辑模型。
Google最新的旗舰模型,专为需要广泛世界知识和高级跨模态推理的复杂任务设计。
OpenAI 推出的最新通用模型,具有更温暖、更善于遵循指令的特性。
Google 最新的视频生成模型,支持原生音频生成,具有出色的真实感、物理效果和提示还原度。
Anthropic最快、最智能的Haiku模型,以更低的成本和延迟提供接近前沿水平的智能体验。
这是 Anthropic 最先进的 Sonnet 模型,为自主智能体提供强大的编码能力和工具调度能力。
这是 Ideogram 3.0 的高保真、细节更精致的版本。
更快速、更具性价比的 Ideogram 3.0 版本。
将任意PDF即时转换为可互动的AI聊天,让阅读更智能、获取见解更高效。
Gemini 2.5 Flash Image,最先进的图像生成与编辑
OpenAI 推出的超轻量、超高速模型,以极低成本提供强大能力。
OpenAI 推出的高性价比 GPT-5 版本,以更低延迟和更低成本带来高性能体验。
OpenAI 的通用模型,增加了推理能力,缩减了上下文长度,语法校验严格。
OpenAI推理模型,有卓越的推理、编码与数学能力。
可准确识别99种语言,支持演讲者分类,精确文字时间戳。
由 TikTok 推出的图像生成视频模型,具备高保真度和专业级动作多样性。
根据文本指令对图像进行转换,并生成高质量、具备上下文理解能力的视觉内容。
Runway出品的创作自由的创意性文生图模型的高清版本。
Runway出品的创作自由的创意性文生图模型的商用版本。
Google最新的文生视频模型,集成音效生成,是模型中的奢侈品。
Anthropic精简混合模型,自主导航代码库,平衡性能与效率,适用多种开发场景
可以汇总搜索内容和展示来源的经典AI搜索工具。
Google的最新推理模型,擅长编程与科学任务
阿里巴巴开源的推理模型,拥有高效激活参数和出色的推理能力。
收缩了在o3 mini代码实现,增加了多模态的精简推理模型
在o4 mini基础上,优化了推理速度
在o3 mini基础上增加了多模态和联网搜索
Google最新推理模型的快捷版本,数学及代码能力强且响应迅速
AI内容鉴别工具,精准识别文本、图片、音频和视频中的AI生成内容。
执行搜索在线信息、推理、验证、整理多步骤研究探索的高级自研Agent。
OpenAI专为科学、数学、编程优化的高效推理模型
OpenAI的老版本推理模型
优化了上下文缓存的轻量快捷模型。
这是一款以出色的动态控制和动画效果著称的视频生成模型。
一款具备精准文字识别与流畅镜头运动的文本生成视频模型。
最受欢迎的经典图像模型,支持多种参数调整。
Runway出品的创作自由的创意性文生图模型的开源版本。
能力综合、多模态理解好的OpenAI经典模型