Qwen 3.0 Image Pro

Hacker News Top 模型

摘要

QwenCloud 发布了 Qwen-Image-3.0-Pro,一款强大的图像生成模型,支持密集布局、微小文字渲染和原生多语言输出,将其定位为可部署的生产力工具。

暂无内容
查看原文
查看缓存全文

缓存时间: 2026/08/05 16:54

# Qwen-Image-3.0-Pro - QwenCloud 来源:https://www.qwencloud.com/models/qwen-image-3.0-pro - 概述 (https://www.qwencloud.com/models/qwen-image-3.0-pro#overview) - 功能特性 (https://www.qwencloud.com/models/qwen-image-3.0-pro#features) - 定价 (https://www.qwencloud.com/models/qwen-image-3.0-pro#pricing) - 速率限制 (https://www.qwencloud.com/models/qwen-image-3.0-pro#rate-limits) - API 参考 (https://www.qwencloud.com/models/qwen-image-3.0-pro#api-reference) ### Qwen-Image-3.0-Pro 试用 AI (https://www.qwencloud.com/try-ai/chat?models=qwen-image-3.0-pro) https://www.qwencloud.com/compare?models=qwen-image-3.0-pro 加入对比 ## 概述 丰富内容:支持输入多达 4.5k tokens 和包含图中图的密集信息布局,可一次生成报纸、分镜脚本、菜单和试卷等复杂版式。真实细节:支持精确渲染小至 10px 的文字,并生动再现微表情、毛孔和根根发丝等精细细节,接近真实摄影的画质。深度知识:支持原生渲染 12 种语言和 20 多种字体,逼真模拟网页、游戏和直播等主流界面,并充分融入外部知识。Qwen-Image-3.0-Pro 不仅追求“好看”,更追求“好用”,让图像生成真正成为可落地的生产力工具。 ## 功能特性 #### 前缀补全 调用 Qwen API 时启用 Partial Mode,可让模型严格从您提供的前缀文本继续生成。查看文档 (https://docs.qwencloud.com/developer-guides/text-generation/partial-mode) #### 函数调用 使用函数调用将大语言模型与外部工具和系统连接。查看文档 (https://docs.qwencloud.com/developer-guides/text-generation/function-calling) #### 缓存 上下文缓存会存储长上下文请求的共享前缀,以减少重复计算、改善延迟并降低成本。查看文档 (https://docs.qwencloud.com/developer-guides/text-generation/context-cache#implicit-cache) #### 结构化输出 结构化输出有助于确保模型以预期格式返回 JSON 字符串。查看文档 (https://docs.qwencloud.com/developer-guides/text-generation/structured-output) #### 批处理 以异步方式批量处理请求以降低成本。查看文档 (https://docs.qwencloud.com/developer-guides/run-and-scale/cost-optimization#batch-calling) #### 联网搜索 启用联网搜索,让模型使用实时检索到的数据进行回答。查看文档 (https://docs.qwencloud.com/developer-guides/text-generation/web-search#enable-web-search) #### 微调 基于样本数据训练模型,使其更好地适配特定任务。查看文档 (https://docs.qwencloud.com/developer-guides/fine-tuning/overview) ## 定价 ## 速率限制 - RPM 每分钟请求数 1

相似文章

Qwen-Image-2.0 技术报告

Hugging Face Daily Papers

Qwen-Image-2.0 是一个全新的图像生成基础模型,基于 Qwen3-VL 和多模态扩散 Transformer,将高保真合成与精确编辑能力统一起来。它在富含文本的内容、多语言排版以及照片级真实感生成方面表现卓越。