晨枫 发表于 2025-3-19 13:30 / L0 C7 Y {8 i* X: G不知道有没有必要弄到那么复杂的份上。 |" j. C) C' Y1 V; t* Z4 m
; i! x1 i8 b! V% J
战斗机气动控制面只有那么些:襟翼、副翼、前缘襟翼、平尾、方向 ...
, W/ X7 P0 A9 O$ y
晨大好。) L) R% s& V/ b4 F7 I
- l A5 ~1 U: |9 C! M我说把yolo换成基于多模态大模型的解决方案,其实是简化,而不是复杂化。$ G4 V8 q( J* }9 S% j* a
; x6 |/ w' w a6 g* h2 h* z
这个问题的关键是在于yolo自身的定位是传统的图像检测分类识别,这个是需要进行监督学习的。而多模态大模型在具备泛化能力的前提下,有推理和理解能力,这个可以在一定程度上采取强化学习甚至是无监督学习的模式。7 x$ C' b6 \. [$ P T
4 H8 y T3 s0 Z; J$ z
不过这个论文本身应该是远远达不到南华早报说的那个功能强度的。