Phi-3-vision-128k-instruct
Phi-3 Vision是一个轻量级、最先进的开放多模态模型,基于包括合成数据和经过筛选的公开可用网站在内的数据集构建,专注于文本和视觉的非常高质量的推理密集数据。,Phi-3 Vision是一个轻量级、最先进的开放多模态模型,基于包括合成数据和经过筛选的公开可用网站在内的数据集构建,专注于文本和视觉的非常高质量的推理密集数据。该模型属于Phi-3模型家族,多模态版本支持128K上下文长度(以token计),经过严格的增强过程,结合了监督微调和直接偏好优化,以确保精确的指令遵循和强大的安全措施
工具简介与核心定位
需求人群 该模型面向广泛的商业和研究用途,特别是在需要视觉和文本输入能力的通用AI系统和应用程序中,适用于内存/计算受限环境、延迟受限场景、通用图像理解、OCR、图表和表格理解等。 使用场景 用于教育领域,帮助学生理解复杂概念。 在商业环境中,用于图像和文本数据的分析和处理。 在研究中,作为生成AI功能的强大基础模型。 产品特色 4.2B参数,包含图像编码器、连接器、投影器和Phi-3 Mini语言模型。 支持文本和图像输入,最适合使用聊天格式的提示。 上下文长度为128K tokens。 使用512 H100-80G GPU进行训练,训练时间为1.5天。 训练数据包含5000亿视觉和文本token。 输出为针对输入生成的文本。 模型训练日期为2024年2月至4月。 模型为静态模型,训练截止日期为2024年3月15日。 使用教程 1. 访问Azure AI模型库并选择Phi-3-vision-128k-instruct模型。 2. 根据需要进行模型的下载或部署。 3. 准备输入数据,包括文本和图像。 4. 设置模型参数,例如温度和最大新token数。 5. 将输入数据传递给模型并接收输出。 6. 分析模型输出,根据应用场景进行进一步处理。
ADK 综合性能评测
核心特色与功能亮点 (Key Features)
典型应用场景与适用行业
核心能力
官方新手上手实操教程指南
1-STEP TUTORIAL准备训练数据并上传到Phi-3-vision-128k-instruct平台;2. 选择预训练模型和训练参数;3. 启动训练任务并监控进度;4. 评估模型效果,导出或部署使用。
1. 准备训练数据并上传到Phi-3-vision-128k-instruct平台;2. 选择预训练模型和训练参数;3. 启动训练任务并监控进度;4. 评估模型效果,导出或部署使用。
同类其它推荐 AI 工具
关于 Phi-3-vision-128k-instruct 的常见问题
Phi-3-vision-128k-instruct通常提供免费试用或免费基础版本,高级功能和更大使用量需要付费订阅。具体价格方案请以官网最新信息为准。
正规的训练模型工具通常会采取数据加密和隐私保护措施,但建议避免上传敏感个人信息或商业机密内容。使用前请仔细阅读产品的隐私政策。
Phi-3-vision-128k-instruct适合对训练模型有需求的人群使用,包括个人用户、自由职业者、中小企业以及大型企业的相关部门。具体适用场景因产品定位而异。
关联底层 AI技术 百科
点击查看 Phi-3-vision-128k-instruct 的底层模型原理,深入探索大算力神经网络构成: