← 返回 AI 資訊

#AI 基礎設施

共 1 篇文章

模型發布

Inception 發布 Mercury 2.5:擴散式 LLM 實現每秒 1,100 Tokens,推理速度刷新行業記錄

總部位於加州的 AI 初創公司 Inception 於 9 月 8 日推出 Mercury 2.5,採用擴散式語言模型(dLLM)架構,生產環境下推理速度突破每秒 1,100 tokens。不同於傳統自回歸模型的逐 token 生成方式,擴散式架構以並行方式逐步精煉整段文字,從根本上改變了推理吞吐量的計算經濟學。