蚂蚁集团发布3.0闪电模型,每个令牌激活51亿个
By: www.tokenpost.kr|2026/08/05 07:46:44
0
分享
蚂蚁集团的AI组织InclusionAI发布了3.0闪电模型,该模型在总参数1240亿中仅激活每个令牌51亿个。FP8量化版的容量约为BF16版的一半,约为128GB。3.0闪电的BF16原版和FP8量化版已在Hugging Face和ModelScope上以MIT许可证发布,并可通过SGLang或vLLM进行分发。该模型采用专家混合(Mixture-of-Experts,MoE)结构,根据输入仅调用部分专家网络,从而减少计算量。基本上支持256K上下文窗口,并可扩展至1M令牌。在高频任务中,目标是实现每秒最多1000个令牌的峰值推理速度和低于100毫秒的首个令牌响应时间。根据官方文档,3.0闪电采用了KDA和MLA层以5:1的比例交叉排列的混合线性注意力结构。3.0闪电将于韩国时间7月23日凌晨1点至8月7日凌晨0点59分59秒免费提供,8月份将应用75%的折扣,正常价格为每百万输入令牌0.40元,每百万输出令牌1.20元。
-- 价格
--
--
--
本内容仅供参考,不构成任何金融、投资、法律或税务建议。文中提及的任何活动、奖励、线上活动或相关信息,不应被视为对购买、出售或交易任何加密资产的推荐、招揽或邀请。加密资产具有高波动性,存在价值损失风险。WEEX服务、产品及相关活动的可用性可能因地区而异。用户在参与前有责任确保符合当地适用法律法规。
猜你喜欢

B.AI 上线小米 MiMo-V2.5 全模态模型免费调用

阿里巴巴发布Qwen3.8-2.4T-A95B模型,面向中国超算互联网
阿里巴巴(Alibaba)的超大型MoE模型Qwen3.8(Qwen3.8)-2.4T-A95B已在中国超算互联网发布。企业和开发者可以利用中国制造的异构加速卡和FlagOS(FlagOS)软件...

DeepSeek V4 Pro于4月24日上线
DeepSeek V4 Pro在API和聊天界面中再次被捕捉到。然而,官方文件中已明确指出V4 Pro和V4 Flash自4月24日起提供,因此难以视为新发布...

微信发布 WeLM 大模型系列,推动 AI 应用落地

Mira Murati 发布开源大模型 Inkling 上线 OpenRouter

估值 10 亿,英伟达重注!Prime Intellect 正在洗掉 Web3 标签?

一位投资人对具身、模型与算力的17条判断

Token 出海,将中国电力卖给全世界
一场没有硝烟的电力战争。

Enflame,这家中国的Nvidia竞争者即将上市

2150亿美元的山寨币反弹依赖于比特币保持其恢复的市场结构
山寨币反弹增加了2150亿美元,TOTAL2超过1万亿美元。比特币的75,800美元重新夺回可能决定这一走势是否持续。

AI正处于信用扩张期,AI越强,美联储反而越需要降息

Coldcard黑客在114百万美元盗窃后未动用87%的被盗比特币

短期美国国债减少290亿美元,稳定币需求面临考验
外资投资者在6月向美国金融市场净流入1335亿美元(约合184.6万亿韩元),但短期美国国债持有量减少了290亿美元(约合40.1万亿韩元)。美元稳定币...

矿机资产折旧与税务成本回收分析

Metaplanet的比特币转移:是在出售还是仅仅在Coinbase上保管?

HashKey与富兰克林坦伯顿合作!「链上美国政府流动性基金」抢滩亚洲

巴基斯坦开始接受虚拟货币经营者的许可证申请,要求在9月5日前注册

Telegram:在被捕两年后,帕维尔·杜罗夫指责法国
在被捕两年后,帕维尔·杜罗夫指责存在政治压力。针对Telegram的法国调查仍在进行中。
B.AI 上线小米 MiMo-V2.5 全模态模型免费调用
阿里巴巴发布Qwen3.8-2.4T-A95B模型,面向中国超算互联网
阿里巴巴(Alibaba)的超大型MoE模型Qwen3.8(Qwen3.8)-2.4T-A95B已在中国超算互联网发布。企业和开发者可以利用中国制造的异构加速卡和FlagOS(FlagOS)软件...
DeepSeek V4 Pro于4月24日上线
DeepSeek V4 Pro在API和聊天界面中再次被捕捉到。然而,官方文件中已明确指出V4 Pro和V4 Flash自4月24日起提供,因此难以视为新发布...
微信发布 WeLM 大模型系列,推动 AI 应用落地
Mira Murati 发布开源大模型 Inkling 上线 OpenRouter
估值 10 亿,英伟达重注!Prime Intellect 正在洗掉 Web3 标签?
...







