LensGo 发布 Iris 创意智能体:从“提示词输入框”到“一站式交付引擎”的范式转移
如果你最近使用过 Claude 或 ChatGPT,一定感受到了 AI 的转变:它不再是一个只能回答单一问题的盒子,而是一个能够理解目标、拆解步骤、做出决策并完成任务的智能体(Agent)。然而,在图像和视频生成领域,大多数工具仍停留在单点生成的阶段:输入提示词,获得一张图片。这种模式要求用户必须精通提示词工程、模型参数及比例设置,这对绝大多数创作者而言门槛过高。
为了解决这一痛点,LensGo 推出了全新的 Iris 创意智能体。它并非仅仅是一个更聪明的提示词框,而是一个真正的智能体,能够代表用户进行规划、决策与执行。
核心突破:智能体 vs. 生成器的本质区别
传统的图像生成工具是一个工具(Tool),你需要操作它,并承担所有决策:选择哪个模型、分辨率、如何措辞提示词、生成多少变体以及下一步做什么。
而 Iris 是一个协作伙伴(Collaborator)。它替你处理那些你不想做的决策,只呈现关键选项。具体而言,Iris 实现了四大核心能力,这是传统生成器无法做到的:
- 意图解读:将“为香水广告营造忧郁氛围”这样的模糊指令,转化为包含主体、灯光、构图和情绪的具体简报,无需用户撰写复杂的提示词。
- 套件规划:一次请求即可生成主图、三个社交媒体变体及一段短视频,每个资产都有独立语义标签,方便后续按名称迭代。
- 模型路由:静物摄影、人像和动态视频需要不同的模型。Iris 会自动匹配最佳模型,用户无需记忆庞大的模型目录。
- 确认执行:只有在用户批准计划后,才会开始生成并消耗算力。这种机制既保留了自动化的动力,又保留了人工控制的触发点。
工作流程:严谨的闭环逻辑
在友好的对话背后,Iris 运行着一个严谨的循环:
- 理解(Understand):读取用户消息及参考图片,判断是否具备足够的信息,或需要提出澄清问题。
- 提案计划(Propose a plan):起草结构化计划,列出每一步的标题、选定模型、比例及提示词。用户可在此查看整个套件及总成本。
- 提示词精修(Craft the prompts):通过专门的提示词工程步骤,将简短简报转化为艺术指导指令,涵盖真实摄影风格、镜头选择和布光细节,确保结果从平庸变得精致。
- 确认执行(Execute on confirm):用户批准后,各步骤通过生产流水线生成,结果实时流式输出。
- 按名称迭代(Iterate by name):用户可以说“让主角更温暖”或“给我第二个的竖版”,智能体能精准定位并修改特定资产,保持其他部分不变。
价值主张:谁最需要 Iris?
Iris 特别适合以下群体:
- 小型企业主:需要批量生成品牌资产但无专职设计师。
- 营销人员:厌倦了提示词瘫痪(Prompt Paralysis)和频繁切换工具。
- 创作者:有审美但缺乏耐心去反向研究哪个模型最适合产品摄影。
“先确认后付费”的重要性
自动化若在不询问的情况下消耗资金,是一种负债而非功能。Iris 的设计哲学相反:它可以规划整个套件,但在用户批准计划前绝不消耗任何算力配额。这提供了完整自动化工作室的感觉,同时消除了失控花费的风险。如果计划成本超出预期,用户可以在任何生成开始前编辑缩减方案。
结语
Iris 代表了从操作工具到简报同事的区别。你提供创意和品味,智能体负责解读意图、规划流程、选择模型、打磨提示词并执行,最后交付一个可精细调整的完整资产包。对于那些曾面对空白提示词框不知如何下手的创作者来说,这正是智能体存在的意义。
“An AI creative agent is the difference between operating a tool and briefing a collaborator... You bring the idea and the taste; the agent handles interpretation, planning, model selection, prompt craft, and execution.”
—— LensGo 官方团队