搜索关键词 GPT Image 2
AI & Enterprise
Alibaba发布Qwen Image 3.0:支持最长4500 Token输入,可一次生成整版报纸排版
Alibaba发布新一代图像生成模型Qwen Image 3.0,支持最长4500 Token指令输入,可用于报纸版面、信息图和分镜等复杂文档类图像的一次成图。该模型重点强化了小字号文字、LaTeX数学公式和多语言渲染能力,定位更偏向实际办公生产力工具。不过,Alibaba此次尚未公布开源权重、技术报告、性能对比数据和API价格。
AI & Enterprise
ChatGPT、Gemini Omni可低成本生成短广告:10秒视频约1美元
据报道,只需一张产品图片,配合ChatGPT、Gemini Omni等生成式AI工具,即可在无需实拍的情况下制作面向TikTok和YouTube的10秒左右产品广告。按开发者API计费,视频生成成本约为每秒0.10美元,单条视频生成成本约1美元,后期可通过CapCut完成剪辑,但发布时需满足平台对AI生成内容的标注和披露要求。
AI & Enterprise
OpenAI推出图像生成模型Image 2.0:强化文字渲染,拓展至海报和UI设计场景
OpenAI发布新一代图像生成模型Image 2.0,重点提升文字渲染能力,并改善非拉丁文字的生成准确度。该模型最高支持2K输出,支持更细粒度的图像控制,同时引入“推理”能力,并支持网页搜索、多图生成和结果校验等功能。新模型已于4月22日起向ChatGPT和Codex用户开放,并同步推出gpt-image-2 API。