标签
fal 发布了新的 LoRA 适配器 MiniMax-H3-Realism-People-LoRA,增强 MiniMax H3 视频模型,用于逼真的人物肖像、面部和日常场景。包含训练细节、通过 fal.ai LoRA 端点的用法,以及前后对比。
Bland 发布 Speech v3,声称它是世界上第一个人类语音引擎,并且在 Design Arena 的音频真实感基准测试中名列前茅,超越了 ElevenLabs、Grok、Cartesia 和 OpenAI。
分享一条Prompt技巧,通过添加手持抖动、跑焦、曝光跳变等手法模拟千禧年家用DV风格,使AI视频看起来更真实、不像AI生成。
一个面向Ideogram 4的逼真引擎模型,托管在Hugging Face上,无跟踪下载或推理提供商支持。
用户表达了对于区分真实与AI生成视频的困惑,强调了合成媒体日益逼真的特性。
OpenAI releases GPT-4o Image 2.0, beating Google’s Nano Banana on price, photorealism, and practical tasks like infographics and YouTube thumbnails.