模型介绍
中文整理# Phi-4 模型卡片
模型概述
Phi-4 是微软研究院开发的先进开源模型,基于合成数据集、过滤后的公共领域网站数据以及获取的学术书籍和问答数据集训练而成。该模型旨在确保小型 capable 模型能够使用专注于高质量和高级推理的数据进行训练。Phi-4 经过了严格的增强和对齐过程,结合了监督微调和直接偏好优化,以确保精确的指令遵循和强大的安全措施。
## 主要能力
- 14B 参数的密集解码器-only Transformer 模型
- 文本生成响应
- 专注于推理和逻辑能力
- 适用于内存/计算受限环境和延迟敏感场景
## 输入输出
- *输入:** 文本,最适合使用聊天格式的提示词
- *输出:** 根据输入生成的文本
- *上下文长度:** 16K tokens
运行要求
- GPU:1920 张 H100-80G
- 训练时间:21 天
- 训练数据量:9.8T tokens
基本用法
根据训练数据的特性,Phi-4 最适合使用聊天格式的提示词。
限制
- **语言限制:** 模型主要基于英语文本训练,英语以外的语言性能较差,不支持多语言使用
- **内容风险:** 可能产生不当或冒犯性内容,可能生成看似合理但实际不准确或过时的信息
- **代码能力:** 训练数据主要基于 Python 和常用包如 typing、math、random、collections、datetime、itertools,使用其他包或其他语言生成的代码建议用户手动验证
- **公平性:** 可能对某些群体过度或不足代表,或强化负面刻板印象
- **适用范围:** 不适合对法律状态、资源分配或生活机会有重大影响的场景;高风险场景需额外评估和保障措施
许可证
MIT 许可证
优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。
你将获得什么
完整仓库方式包含该固定版本中的权重、配置、分词器及说明文件;指定版本方式只下载所选文件或整组分片。多模态模型的投影文件、配置等依赖,请按作者说明配齐。
完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。
使用前须知
运行模型需要的设备、工具与依赖,以原作者说明为准。
是否允许商用、修改和分发,请查看模型许可证。
闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。
资料或下载有问题?
登录后可提交反馈。
