熱門資訊> 正文
2026-07-10 23:46
ZoomInfo Technologies Inc.近日宣佈推出GTM Bench基準測試系統,專門用於評估大型語言模型和人工智能代理在真實市場推廣任務中的表現。
GTM Bench從兩大維度對AI系統進行評分:「任務完成度」衡量系統完成所要求工作的比例,「數據溯源性」衡量返回數據可追溯至真實、現時來源的比例。在首輪測試中,ZoomInfo的GTM.AI獲得綜合指數77分,而Apollo為47分,Exa為36分,開放網絡搜索為31分。ZoomInfo系統完成了98%的操作工作,每千條記錄可返回478條可驗證記錄,遠超其他系統的7至35條,每項任務成本僅0.79美元。
值得一提的是,ZoomInfo也坦誠公佈了自身表現欠佳的四類場景,包括純文案撰寫及外部工具無法訪問的自有CRM數據等領域,數據溯源性的衡量亦以ZoomInfo自身驗證記錄爲基準,而非經獨立審計完成。
第二版GTM Bench將新增多步驟代理工作流、國際覆蓋及自有數據評估維度。其他數據提供商和AI代理開發者也可提交系統參與測試。GTM.AI作為ZoomInfo的上下文數據層,提供對逾1億家企業、5億個聯繫人及數十億條信號數據的訪問能力,已與Salesforce Agentforce、HubSpot Breeze、微軟Copilot、Claude、ChatGPT等實現集成。
責任編輯:張俊 SF065