输入关键词搜索 AI 工具、分类,或直接跳转页面
Valley 2.0是字节跳动开发的多模态大型模型官方体验站点,核心定位是为用户提供文本、图像、视频融合的多模态AI能力服务。站点支持多模态内容理解、跨模态内容生成、多轮多模态对话三类核心功能,面向AI技术研究者、内容创作者、电商运营人员、短视频从业者等群体,可应用于学术效果验证、内容素材制作、商品内容解析、视频内容摘要、智能问答交互等多种场景,帮助用户便捷体验开源多模态大模型的实际处理效果。
打开Valley 2.0官方站点,进入首页后可先浏览官方展示的模型能力介绍和示例用例,初步了解模型支持的任务类型和效果表现。
若需要自定义测试,可在交互输入区域选择任务类型,如需上传多媒体文件则点击上传按钮,选择本地的图像或短视频文件完成上传。
在文本输入框中填写对应的指令需求,比如针对上传的视频提问具体问题,或者描述需要生成的图像、视频的内容要求,可按需调整推理参数。
确认输入内容和参数无误后,点击提交按钮等待模型推理,推理过程中可查看进度提示,完成后即可在页面查看输出结果。
对结果满意可点击导出或分享按钮保存内容,如需继续交互可在当前对话基础上补充输入新的指令,开启多轮对话流程。
看完教程,直接上手试试
访问 Valley 2.0 官网