IT之家 7 月 29 日消息,科技媒體 Wccftech 昨日(7 月 28 日)發(fā)布博文,報道稱 OpenAI 公司研究員 Jeffrey Wang 指出,AMD 攜手 Cerebras 公司聯(lián)合開發(fā) AI 推理解決方案表現(xiàn)“令人難以置信”。
IT之家此前報道,該解決方案主要針對超低延遲 AI 推理場景,將整合 AMD 的 Helios 機架級解決方案與 Cerebras 的晶圓級引擎,從而應(yīng)對英偉達和 Groq 合作。
按照雙方披露的路線,Helios 機架承擔(dān)高性能、可擴展吞吐引擎角色,主要處理提示詞與大上下文窗口。
Cerebras 的 Wafer-Scale Engine 則負責(zé)對內(nèi)存帶寬要求更高的 Token 生成與解碼環(huán)節(jié),強調(diào)超低時延表現(xiàn),結(jié)合使用 2 個計算引擎,預(yù)估可以將每瓦每秒 token 數(shù)量提高 5 倍。


OpenAI 的研究員 Jeffrey Wang 高度評價 AMD 聯(lián)合開發(fā)的 AI 推理解決方案,表示:
我們內(nèi)部在 Cerebras 芯片上運行某些 OpenAI 模型,表現(xiàn)非常出色,其推理速度非常亮眼。
對于我們?nèi)粘9ぷ鞫?,以前我可能需要等待幾分鐘才能完成一項任?wù),而現(xiàn)在切換任務(wù)的瞬間,該任務(wù)就已經(jīng)完成了,這大大提高了我們的工作效率。

相關(guān)閱讀:
廣告聲明:文內(nèi)含有的對外跳轉(zhuǎn)鏈接(包括不限于超鏈接、二維碼、口令等形式),用于傳遞更多信息,節(jié)省甄選時間,結(jié)果僅供參考,IT之家所有文章均包含本聲明。