深度分析
PAJAMA 登場:程式蒸餾取代 LLM 評審,成本降 50 倍、速度提升 47 倍
大型語言模型(LLM)作為自動化評審(LLM-as-a-judge)雖已成為業界標準,但其高昂的 API 成本、緩慢的推論速度以及不透明的決策過程,嚴重限制了可擴展性與可靠性。
深度分析
大型語言模型(LLM)作為自動化評審(LLM-as-a-judge)雖已成為業界標準,但其高昂的 API 成本、緩慢的推論速度以及不透明的決策過程,嚴重限制了可擴展性與可靠性。
深度分析
面對大量類別的標註瓶頸,研究提出Bias‑InducedConstrainedLabeling(BICL)透過限制每類的互補標籤候選集合並使用視覺語言模型進行負向提示標註,能大幅降低監督不確定性並在CIFAR‑100與TinyImageNet‑200上顯著提升分類效能。
深度分析
跨視角語意多目標追蹤(CRMOT)需在多鏡頭間為自然語言指向的目標維持一致身分,但以往方法仰賴大量逐幀空間標註與跨視角身分對應。本文提出弱監督新範式,先以基礎模型(如 SAM3)生成單視角軌跡,透過Affinity-guided Cross-view Re-prompting精煉並對齊成跨視角偽標籤;