moe - 乐酷网站内搜索
搜索:moe
共找到 5 条结果
Olmo-core 3 开源MoE训练栈Olmo-core 3 开源MoE训练栈 今天刷到 Ai2 放出了 Olmo-core 3,这次重点是把 MoE 训练系统重新设计了一遍,目标直接瞄着万亿参数级别,同时还要保住计算效率。他们自己说这是下一代 Olmo 背后的核心系统之一,代…https://talk.lekuidc.com/388.html
企业数智化升级,大模型怎样才能低成本高效落地?企业数智化升级中,大模型落地常受算力成本、数据治理与工程化能力制约。本文从算力选型、模型压缩、数据闭环与场景切入,解析低成本高效能落地的关键路径。https://xinwoyun.com/1197.html
DeepSeek新Flash把KV缓存砍到1/4DeepSeek新Flash把KV缓存砍到1/4 刚看到DeepSeek-V4.1-Flash上线API,第一反应是这波打的不是参数牌,而是成本牌。552B的MoE,但输入只激活8B、输出16B,非对称架构把「想得多」和「算得省」拆开做,b…https://talk.lekuidc.com/353.html
企业需部署 DeepSeek、千问模型,怎样选择硬件?成本预算大概多少?想把 DeepSeek 或千问部署进自己内网,先别急着买卡:7B 模型 FP16 约占 16GB 显存,单张 RTX 4090 24GB 就能跑;32B 量化后约 20-24GB,单卡 48GB 或双卡更稳。到底该选多大模型、要不要量化、自…https://news.xiumiyun.com/3967.html
DeepSeek V4.1 Flash 模型上线国家超算互联网DeepSeek V4.1 Flash 模型上线国家超算互联网 DeepSeek V4.1 Flash 模型今日上线国家超算互联网中心。用户可登录国家超算互联网官网,从首页进入「模型服务」页面,即可快速打开 DeepSeek V4.1 Fl…https://talk.lekuidc.com/188.html