【TotalTrainingTime:1小时28分27秒】
「这时间坏了吧?」陈工脱口而出。
齐教授顾不上教授的体面,半蹲着身子,开始快速翻看编译日志和CUDA运行态监控。
屏幕上的实时数据显示得清清楚楚:GPU利用率在训练期间长期维持在93.2%的数值。
双卡显存占用稳定,没有发生任何一次显存溢出。
PCle总线带宽利用率极低,说明绝大部分计算都在显存内部的高速cache中完成的。
而最终模型在测试集上跑出来的89.4%的识别率,更是铁一般的事实,做不了任何假I
「你用的什麽显卡?」
"GTX580。
「6
游戏显卡?
在传统的CPU伺服器上,需要不吃不喝,辛辛苦苦跑上整整13个小时才能完成的训练闭环。
在这个少年的编程下,两块被所有人视为不务正业的游戏卡,居然把训练时长压缩到了一小时二十八分钟!
「我们现在可以重新测试一个数据集吗?」
「当然可以,反正也花不了多长时间。」漆昊自信地说。
齐教授重新选了一个数据集。
「我们就跑这个!这是大飞上个月刚发来的航拍数据集,整整18000张包含复杂室内光影和高噪点遮挡的图像。」
「由於多通道特徵极度交错,以前在至强伺服器上跑,光是前向传播的特徵对齐就能生生磨蹭掉一个半小时,整套叠代下来更是需要耗费将近大半天的时间,我们平时根本不敢轻易用它来做模型验证。」
「小漆,这个数据集的规模和复杂度,可比你刚才跑的那套普通数据要高得多,你敢用它现跑吗?」
「当然可以,无非就是多花个几分钟罢了。」
漆昊坦然说道,然後他修改了配置文件里的数据集加载路径,随後熟练地在终端输入了编译和运行指令。
「第一轮叠代,开始加载数据————」
控制台的第一行日志跳了出来,整个实验室的人的目光都被吸引过去了。
当第一轮叠代结束,用时6分3秒!
陈工第一个打破了沉默,他难以置信地低头看了看自己手机上的秒表,又擡头看了看屏幕上的日志,茫然了起来:「老曾,我刚才没眨眼吧?那个最难啃的C3航拍数据集,第一轮前向计算和反
本章未完,请点击下一页继续阅读!