返回首页 >

工业大省有“模”力|浪潮海若词元工厂让行业大模型走出“对话框”、走进“产业端”

2026-10-09 06:51   大众新闻·大众日报

  在肖雪看来,开发行业大模型仅靠工程师团队定制开发,人才、算力、算法、数据处处是瓶颈。“过去做模型,是开发人员手工调优、手工开发,像手工作坊;而行业落地又是分散的、小型的、定制化的,一把钥匙开不了所有的锁。”他给出的破题办法,是用模型制造模型,让手工作坊升级为流水线。

  2025年1月,浪潮海若词元工厂的前身在济南建成:75道标准工序、180套工具,把数据、算力、算法拧成一条产线;1400余家生态伙伴的能力被嵌入各道工序,覆盖20多个行业。

  “炼”成一个行业模型,需要几道工序?

  工厂里,一个行业大模型究竟是怎样“炼”成的?记者跟着一张订单,走完了整条产线。

  订单来自石化链主企业,目标是做一个管道设备防腐蚀模型。企业交给工厂的,是5万多条数据。

  原始数据首先来到数据车间。经过安全审查将身份证号码等个人信息脱敏,再作特征分析。这个过程中,技术人员发现数据里设备类信息占了大头,分布严重不均。“就像人上学,一旦偏科,训练出来的模型也只会答一类题。”现场技术人员说。

  这就需要工厂为数据“增广”:配齐10万条行业数据,再让模型自己生成40多万条,重点补齐短板,最终凑成58万条分布均衡的“教材”。

  最见功夫的是标注,也就是一条条告诉模型什么是对、什么是错。人工先精标6000条“样板题”,再让三五个不同的模型分头标注剩下的50多万条,结果一致才算通过,出现分歧就交给人工裁决。11道工序、60套工具跑下来,数据准备被压缩到两周以内。

猜你喜欢

热点新闻

{$loop_num=0}