6月20日,昆侖萬維(300418)發布軟件工程(Software Engineering, SWE)自主代碼智能體基座模型Skywork-SWE,在開源32B模型規模下實現了業界最強的倉庫級代碼修復能力。
相比傳統的代碼生成任務(如代碼編程題解答),SWE任務更加貼近真實的軟件開發流程,涵蓋了從定位BUG、修改源代碼,到驗證修復效果的完整閉環。
昆侖萬維團隊通過構建超過1萬個可驗證的GitHub倉庫任務實例,打造出目前最大規模的可驗證GitHub倉庫級代碼修復的數據集,并系統性驗證了大模型在軟件工程任務上的數據縮放定律(Scaling Law)。
Skywork-SWE-32B模型在SWE-bench Verified基準上取得38.0% pass@1準確率,刷新Qwen2.5-Coder-32B系列模型在OpenHands代碼框架下的最佳成績。
進一步引入測試時擴展技術后,模型表現提升至47.0%的準確率,不僅超越了現有參數規模在32B以下的開源模型,也顯著效縮小了與閉源模型之間的性能差距。
文章內容僅供閱讀,不構成投資建議,請謹慎對待。投資者據此操作,風險自擔。
海報生成中...
海藝AI的模型系統在國際市場上廣受好評,目前站內累計模型數超過80萬個,涵蓋寫實、二次元、插畫、設計、攝影、風格化圖像等多類型應用場景,基本覆蓋所有主流創作風格。
IDC今日發布的《全球智能家居清潔機器人設備市場季度跟蹤報告,2025年第二季度》顯示,上半年全球智能家居清潔機器人市場出貨1,2萬臺,同比增長33%,顯示出品類強勁的市場需求。