PLLuM:波兰语言模型全新 2026 版
PLLuM,常被非正式地写为“Plum”,是一个波兰语言模型家族,旨在服务于波兰语、公共行政、商业和个人用户。 所提供的信息图表代码已迁移到安全的 React/Recharts 组件中,因为门户网站的文章内容不会运行外部的 Chart.js 脚本或 CDN 代码。在门户上发布的版本保留了信息图表的性质,但使用了来自公开来源的确认数据。 最重要的更正涉及事实。如果无法在原始文档中证实,则没有必要在公开材料中将“Plum 2.0”描述为拥有 1.5 万亿个 token 和 32K 固定窗口的模型。数字化部于 2026 年 5 月 21 日宣布,PLLuM 系列扩展了 11 个新模型,变体包括 4B、8B、12B 和 70B。4B、8B 和 12B 模型存在基础版、指令版和对话版,而最大的 70B 变体则用于更复杂的任务。 根据数字化部的公告,训练数据集包含约 700 万篇经过筛选的波兰语文本,这些文本在质量、合法性和来源透明度方面都经过了挑选。该材料还描述了 1.75 万个新的原生指令、超过 6,000 个多轮对话,以及考虑到项目早期阶段的数据后,总计约 8 万个手工创建的指令。PLLuM-12B 模型在 Hugging Face 上的卡片将其描述为专注于波兰语、选定的斯拉夫和波罗的海语言以及英语;它还指出经过清洗和去重后有 150B 个 token,并且可用于完全开放商业模型的 token 有 28B。 PLLuM的价值不在于它能自动击败最大的前沿模型。它的意义更具实践性:它为波兰提供了一层本地AI,可以用于测试、审计和与公共文件、教育、公民服务和企业流程集成。最合理的应用包括基于自有资源的RAG(检索增强生成)、文本摘要、协助起草文档、案件分类、支持公务员工作以及必须深入理解波兰语境的语言工具。 专业的部署仍然需要谨慎。PLLuM,如同所有LLM一样,可能会产生幻觉、混淆来源、生成过于自信或不适用于特定情况的答案。因此,它应该在有限权限、人工控制、行为审计和基于真实文档的质量测试下运行。对PLLuM的最佳评估不应来源于民族情感或营销表格,而应来源于其自身任务的比较:波兰信函、规章制度、程序、往来信件、技术文件和公民查询。 文章的互动部分将该模型展示为基础设施:一个变体家族、数据集、指令、训练流程和部署风险。这种呈现方式比简单的“越大越好”图表更接近现实。在AI领域,赢得的不再是单个模型,而是整个过程:数据、许可证、测试、监控、工具集成以及决策责任。 来源 数字化部:更多、更快、波兰语。PLLuM模型家族正在扩大 数字化部:PLLuM - 波兰语言模型。它如何工作以及可以用于什么? PLLuM:项目官方网站 CYFRAGOVPL/PLLuM-12B-nc-chat-2412, Hugging Face PLLuM: A Family of Polish Large Language Models, arXiv </ul