Nano Banana 2 removed from Google Earth2 months agohttps://www.digitaldigging.org/p/nano-banana-2-removed-from-google谷歌于7月30日在谷歌地球中推出了一款逼真的人工智能图像生成功能,允许用户输入一句话,即可生成任意地点的AI图像。该功能于7月31日被撤回,原因是用户分享了违反谷歌政策的图像,尽管有水印和内容过滤器。报告显示,该工具能够生成核电站、弹坑以及虚假灾难场景等敏感主题的图像,表明防护措施不足。谷歌表示该功能是暂停而非取消,他们正在加强安全措施,以便重新发布。
Reimagine the World with Nano Banana in Google Earth2 months agohttps://blog.google/products-and-platforms/products/earth/nano-banana-google-ear...Nano Banana 2 利用谷歌地球的卫星、航空和3D影像实现自定义图像生成,让用户能够创建基于真实世界的概念。五大用例:让历史重现(例如公元78年的庞贝古城)、制作学习信息图(例如自由女神像)、房地产规划(例如将东京地块变为购物区)、可视化项目(例如湖边小屋),以及为场所打造未来主义改造(例如将谷歌园区变为科幻乌托邦)。该功能面向全球谷歌地球网页版用户开放;用户可放大视图,点击“创建图像”,然后输入提示词来生成图像。
Nano Banana can be prompt engineered for extremely nuanced AI image generation2 months agohttps://minimaxir.com/2025/11/nano-banana-prompts/FLUX.1-dev 曾盖过 Stable Diffusion 的风头,但 ChatGPT 的免费图像生成,尤其是‘吉卜力工作室’风格,成为了 AI 图像的新标杆。Google 的 Gemini 2.5 Flash Image(代号 Nano Banana)是一个自回归模型,具有强大的提示遵循能力,支持精细编辑和复杂指令。Nano Banana 凭借其强大的文本编码器和较大的上下文窗口(32,768 个 token),在遵循细微提示方面表现出色,包括 JSON 和 HTML 输入。尽管有这些优势,Nano Banana 在风格迁移(如吉卜力工作室风格)上存在困难,且几乎没有 IP 限制,引发了法律担忧。该模型对 NSFW 内容相对宽松,不过对提示词和生成图像都有审核机制。使用全大写和威胁性语言进行提示工程可以提高遵循度,但该模型在不同任务上的表现有所差异。已发布 Jupyter Notebooks,以证明博文中描述的图像生成具有可复现性。
Nano Banana Pro is the best AI image generator, with caveats2 months agohttps://minimaxir.com/2025/12/nano-banana-pro/Nano Banana和Nano Banana Pro是不同的模型;Nano Banana Pro不是替代品,而是一个具有更高成本和特定优势的补充模型。Nano Banana Pro擅长风格迁移、带语法高亮的代码生成、网页渲染以及高精度的文本渲染。Nano Banana Pro提供更高分辨率的输出(2K/4K),并使用基于Gemini 3 Pro的更强大的文本编码器,该编码器包含一个用于提示理解的强制性思考步骤。Nano Banana Pro支持与Google搜索的接地,以确保信息图表的事实准确性,但结果仍可能有错误,需要验证。系统提示在Nano Banana Pro中是有效的,允许强制执行风格,但对于每图像定制不太有用。Nano Banana Pro可以高效地生成多图像网格,实现经济高效的变体探索,但非常大的网格可能导致质量下降。该模型由于其思考过程倾向于将提示推向现实主义,这可能会降低对超现实或风格化内容的效果。增加的成本和生成时间是频繁使用的主要限制,而强制性思考可能会阻碍非常规输出。
Muse Image: Image Generation Built for Your World2 months agohttps://about.fb.com/news/2026/07/introducing-muse-image-meta-ai/Meta 发布了 Muse Image,这是其 Meta 超级智能实验室推出的首个图像生成模型,现已集成到 Meta AI 中,作为创意伙伴将想法转化为高质量视觉内容用于分享。该模型为 Instagram Stories 提供超过 30 种新 AI 特效,并支持 WhatsApp 聊天中的图像生成功能,目前已在部分国家率先推出,后续将扩展至更多地区。用户可通过简单提示词生成图像、编辑现有照片、在视觉内容中添加文字渲染以及创建功能性二维码,所有操作均可通过与 Meta AI 的自然语言对话完成。Meta AI 内置预设面板提供灵感提示建议,例如修复老照片或重塑造型风格,让创作成果能轻松在 Meta 应用生态中分享。用户可拍摄房间照片后要求 Meta AI 根据偏好风格或潮流趋势,推荐来自网络或 Facebook Marketplace 的真实商品进行空间 redesign。Muse Image 能智能处理提示词:规划构图布局、运用实时网络上下文、融合多重视觉参考,并借助 Muse Spark 模块处理复杂推理任务。该功能支持 @ 提及 Instagram 账户,将公开个人资料照片融入图像以创建个性化图形,用户可自主控制标记设置。编辑操作可直接通过标记工具在照片上进行,Meta AI 会保留对话上下文以便持续优化,无需重新开始。Muse Image 将逐步拓展至更多国家、Facebook、Messenger、Instagram 和 WhatsApp,并计划在未来数周通过 Advantage+ 创意工具向广告商开放。日常创作可免费使用基础功能,高级功能需订阅,Meta 正在开发 Muse Video 以实现个人超级智能的进阶目标。
Nano Banana 2 Lite3 months agohttps://deepmind.google/models/gemini-image/flash-lite/Nano Banana 2 Lite是一款高速、经济高效的Gemini图像模型,专为快速图像生成和编辑而设计。它支持快速原型设计和迭代,相比重型模型,使创作者能够以低成本生成数千张图像。该模型保持了控制性和准确性,支持角色一致性、精确视觉编辑和现实世界知识的整合。应用示例包括用于室内设计的Space Lift、用于交互式学习的Gridscape、用于教育视觉的Peek-A-Word以及用于旅行明信片的Anywhere。性能基准测试显示,该模型在图像编辑和生成方面表现出色,每张1k分辨率图像的延迟较低。来自Figma Weave、Manus AI、Artlist、Weekend和Latitude等公司的评价强调了其在创意和实时工作流中的速度、可靠性和质量。建议用户提供详细提示以获得更好效果,并验证输出,因为该模型可能在处理精细细节、文本准确性和复杂编辑时存在困难。安全功能包括内容过滤和用于AI生成图像水印的SynthID,并在安全性和一致性方面持续改进。法律免责声明指出,像Gemini 3.1 Flash-Lite Image这样的大型语言模型可能产生不准确或冒犯性内容,不应将其用于专业建议。