留意到一个智驾比赛,规则也很直给,以全国50座城市为分站比赛,由车主或素人进行参赛,继而评分。
当我们讨论智驾能力时,总会代入瞬时体验而得出刻板评价,但事实上模型时刻都在调整变化,上周的体验跟这周的体验,极大可能会完全不一样,而同一个版本,在不同城市路况,表现也会有所差异。
所以媒体在做智驾的评价,往往追求某个时间段的瞬时高光表现,而真正能力应该拉长时间维度,看平均表现,所以说智驾评价的说服力在愿意开启智驾的车主身上。
而这个智驾比赛则很好地涵盖了以上两个维度的表现力。我们看到卓驭在昆明站以及沈阳站都能拿到亚军。
我选取我自己体验过的版本作为参照,卓驭高悟性大模型4.1,我们在深圳发现它的蠕行礼让行人这点做得非常出色,但在某些车道选择效率上会有点逊色,而留意图3,涉及安全项的扣分项中无一扣分,仅是效率为度失分,而屈居亚军。这跟我们短暂的体验评价结果是一致的。
我们还留意到,卓驭这套智驾方案在昆明站也是拿第二,这次沈阳站也是第二,一北一南两站都显示出足够的泛化能力的稳定性,而具体输在哪里,从中其实也给卓驭点明了提升空间在哪,这样的比赛挺好的。我和汽车的日常


