【导(dǎo)语(yǔ)】在(zài)智(zhì)能(néng)助(zhù)手(shǒu)、ChatGPT和(hé)文心(xīn)一(yī)言(yán)等(děng)AI技(jì)术(shù)的(de)背(bèi)后(hòu),隐(yǐn)藏(cáng)着(zhe)大(dà)语(yǔ)言(yán)模(mó)型(xíng)的(de)强(qiáng)大(dà)力(lì)量(liàng)。这(zhè)些(xiē)“超(chāo)级(jí)语(yǔ)言(yán)大(dà)脑(nǎo)”能(néng)读(dú)、能(néng)写(xiě)、能(néng)答(dá)题(tí),甚(shén)至(zhì)能(néng)“讲(jiǎng)故(gù)事(shì)”,代(dài)表(biǎo)着(zhe)人(rén)工(gōng)智(zhì)能(néng)的(de)最(zuì)前(qián)沿(yán)。然(rán)而(ér),在(zài)它(tā)们(men)顺(shùn)畅(chàng)回(huí)应(yīng)我(wǒ)们(men)的(de)背(bèi)后(hòu),是(shì)中(zhōng)国(guó)科(kē)研(yán)工(gōng)作(zuò)者(zhě)在(zài)无(wú)顶(dǐng)级(jí)算(suàn)力(lì)、无(wú)完(wán)整(zhěng)生(shēng)态(tài)条(tiáo)件(jiàn)下(xià),从零构建属于中国自己的“AI语言大脑”的艰辛历程。本文将带您深入了解大语言模型的炼成之路、国产大模型的破局挑战、科研者的动人故事,以及AI如何融入中国语言和文化。在第九个“全国科技工作者(zhě)日(rì)”之(zhī)际(jì),让(ràng)我(wǒ)们(men)向(xiàng)这(zhè)些(xiē)时(shí)代(dài)的(de)记(jì)录(lù)者(zhě)、文化(huà)的(de)守(shǒu)望(wàng)者(zhě)致(zhì)敬(jìng)。
“你(nǐ)好(hǎo),我(wǒ)是(shì)你(nǐ)的(de)智(zhì)能(néng)助(zhù)手(shǒu),请(qǐng)问(wèn)有(yǒu)什(shén)么(me)可(kě)以(yǐ)帮(bāng)您(nín)?”
也(yě)许(xǔ)你(nǐ)早(zǎo)已(yǐ)习(xí)惯(guàn)了(le)和(hé)智(zhì)能(néng)手(shǒu)机(jī)、客(kè)服(fú)机(jī)器(qì)人(rén)“对(duì)话(huà)”的(de)场(chǎng)景(jǐng);也(yě)许(xǔ)你(nǐ)用(yòng)过(guò)ChatGPT、文心(xīn)一(yī)言(yán)这(zhè)样(yàng)的(de)AI生(shēng)成(chéng)文字(zì)、翻(fān)译(yì)、写(xiě)代(dài)码(mǎ)。它(tā)们(men)背(bèi)后(hòu)的(de)核(hé)心(xīn)技(jì)术(shù),叫(jiào)做(zuò)大(dà)语(yǔ)言(yán)模型。这是当今人工智能最前沿的代表之一——能读、能写、能答题,甚至能“讲故事”,像一个永不疲倦的智慧图书馆。

图片来源:百度文心一言首页
而你或许不知道,在它们顺畅回应你的那一刻,藏着成千上万名中国科研工作者夜以继日的努力。他们在没有顶级算力、没有完整生态的条件下,从零构建出属于中国自己的“AI语言大脑”,用技术和汗水书写下这个时代的科技答卷。
1、超级“语言大脑”是如何炼成的?
所谓“大语言模型”,指的是一种通过学习大量文本数据,从而具备语言理解与生成能力的人工智能系统。它不是真正“懂”语言,而是通过庞大的参数和复杂的训练机制,让机器学会了“预测下一个词”。这个过程,需要成百上千亿级的模型参数、千万本书的总信息量、数周甚至数月的训练时间。
比如ChatGPT,背后是OpenAI花费数亿美元、使用几千张高端GPU显卡和超大语(yǔ)料(liào)训(xun)练(liàn)出(chū)的(de)成(chéng)果(guǒ)。而(ér)在(zài)中(zhōng)国(guó),自(zì)主研(yán)发(fā)出(chū)拥(yōng)有(yǒu)数(shù)百(bǎi)亿(yì)甚(shén)至(zhì)千(qiān)亿(yì)参(cān)数(shù)的(de)语(yǔ)言(yán)模(mó)型,是科研者面对的一场“硬仗”。
2、国产大模型,破局之路走得很难
研发大语言模型,最难的不是“写代码”,而是“通盘突破”:
01语料难
中文的语言结构更复杂、歧义性更强,公开高质量中文语料少。科研者不得不从网页、书籍、论文、论坛中手动清洗出语料,还要过滤“低质文本”和“敏感内容”。一个模型的训练语料,往往需要上百人投入数月筛选处理。
02算力紧
大模型训练是(shì)资(zī)源(yuán)密(mì)集型(xíng)工(gōng)程(chéng)。以(yǐ)千(qiān)亿(yì)参(cān)数(shù)模(mó)型(xíng)为(wèi)例(lì),动(dòng)辄(zhé)需(xū)要(yào)数(shù)千(qiān)张(zhāng)GPU服(fú)务(wu)器(qì)支(zhī)持(chí),而(ér)在(zài)芯(xīn)片(piàn)领(lǐng)域,我(wǒ)国(guó)受(shòu)制(zhì)于(yú)供(gōng)应(yīng)链(liàn)“卡(kǎ)脖(bó)子(zi)”。于(yú)是(shì)科(kē)研(yán)者(zhě)用(yòng)“模(mó)型(xíng)压(yā)缩(suō)”“并(bìng)行(xíng)调(diào)度(dù)”等(děng)方(fāng)式(shì)做(zuò)减(jiǎn)法(fǎ),用(yòng)最(zuì)少(shǎo)的(de)资(zī)源(yuán)跑(pǎo)出(chū)最(zuì)好(hǎo)的(de)效果。
03对标高
ChatGPT带来的震撼让世界意识到:谁掌握了大模型,谁就能在人工智能时代的中占据重要地位。中国必须有自己的AI底座,自己的语言理解系统。为此,“悟道”“ChatGLM”“文心一言”“天书”“百川”“DeepSeek”等国产大模型接连问世。
根据国家互联网信息办公室最新披露的数据显示,截至2025年4月,已成功通过备案的人工智能大模型数量达到了346家——从通用模型,到金融、医疗、教育等行业专用模型,这背后,是无数科研团队昼夜鏖战的成果。
3、那些让人动容的科研者故事
2023年,天数智芯的天垓100国产GPU加速卡迎来了一场硬仗——为北京智源研究院训练70亿参数的Aquila语言模型提供算力支持。面对国产GPU与国际顶尖产品的性能差距,天数智芯产品线总裁邹翾带领团队展开了一场技术攻坚战。他们日夜兼程,重构IXCCL通信库,优化混合精度训练方案,硬是将多卡通信效率提升至98%,最终实现了连续19天的稳定训练。当Aquila语言模型如期完成训练并达到预期效果时,这支团队用行动证明:在算力自主化的道路上,中国人的创新精神永远不会被硬件条件所限制。

图源:pexels
在高校、研究所、企业、实验室,从“算法调优”到“数据治理”,从“推理优化”到“模型压缩”,每一个细节都凝聚着无数人沉默却坚定的努力。他们或许不在镜头前,不在热门话题里,却正是AI革命的无名英雄。
4、把AI写进中国语言和文化
“我们希望让AI用中文思考。”这是很多国产大模型团队的共同目标。
不仅仅是翻译得(de)通(tōng)顺(shùn),更(gèng)要(yào)理(lǐ)解(jiě)中(zhōng)国(guó)语(yǔ)言(yán)的(de)语(yǔ)境(jìng),理解我们的典故(gù)、成(chéng)语(yǔ)、对(duì)联(lián)、诗(shī)词,甚至是“一个眼神”的情感含义。科研者正在将这些“文化基因”注入AI中。
有人用模型进行古文翻译,有人训练AI生成中医问诊语言,还有人尝试用AI保护濒危方言。AI不是替代人类,而是服务社会、传承文明的新工具。大语言模型正逐渐从科研实验室走进医疗、教育、司法、工业、文旅等多个领域,为人类解决实际问题,也为中国讲好自己的故事提供了新的载体。
5、写在“全国科技工作者
2025年5月30日,是第九个“全国科技工作者日”。我们将目光投向那些或许无名却做着意义非凡的事情的科技工作者,他们在国产AI道路上,仰望星空,脚踏实地。
在大模型这场没有硝烟的科技竞赛中,他们不仅是工程师,更是文化守望者,是时代的记录者。他们用代码构筑语言的秩序,用数据打造理解的基石,用算法塑造思维的逻辑。
他们是这个时代最可敬的人之一。
致敬中国每一位科技工作者,向你们说一声:节日快乐,未来可期。
供稿单位:重庆理工大学计算机科学与工程学院
作者:重庆理工大学 张佳雯
审核专家:倪伟
声明:除原创内容及特别说明之外,部分图片来源网络,非商业用途,仅作为科普传播素材,版权归原作者所有,若有侵权,请联系删除。

官方网站-首页
关注我们
小客服微信