微软研究院发布了Phi-4系列小型语言模型,包括基础版phi-4-mini-instruct和专家混合版phi-4-moe-instruct,参数规模分别为54亿和145亿。该系列在多项基准测试中表现优异,在MMLU和HumanEval等任务上超越Llama 3.1等更大规模的模型。

Phi-4系列采用Transformer解码器架构,支持128K上下文长度,训练数据涵盖代码、数学和合成数据。其中phi-4-moe-instruct通过16个专家模块实现性能跃升,同时保持推理效率。模型已在Hugging Face上以MIT许可证开源,可供研究使用。