-
英伟达发布 Audex 统一模型:30B 总参数,避免多模态扩展后文本能力下滑问题
英伟达于今年 6 月发表论文,推出 Audex(Nemotron-Labs-Audex-30B-A3B)统一音频-文本大语言模型,总参数量 30B,激活参数 3B,支持音频输入与音频输出。
AI资讯2026-07-08AI资讯 -
NVIDIA 确认 Feynman 世代 Rosa CPU 采用 Rigel 内核,单核性能再提升
其符合 Arm v9.2 指令集要求,主要改进包括更高效的指令传递、更大的 L2 缓存、更高效的内存管理。Rosa CPU 预计 2028 年面世。
AI资讯2026-07-08AI资讯 -
消息称 DeepSeek 正在自研 AI 芯片:面向推理场景,减少依赖英伟达、华为
据路透社报道,AI 初创公司 DeepSeek 正在研发面向推理场景的自有 AI 芯片,旨在降低对英伟达和华为的依赖。该项目已启动约一年,目前处于早期阶段,正与设计、制造及存储厂···
AI资讯2026-07-07AI资讯 -
因制造工艺问题,英伟达 Kyber 机架平台可能延期至 2028 年推出
据 CNBC 报道,因 PCB 中介板制造难度过高,英伟达下一代 AI 机架系统 Kyber 可能推迟至 2028 年推出。这反映了随着系统规模扩大,英伟达高速产品更新节奏正受到制造能力的···
AI资讯2026-07-06AI资讯 -
英伟达开源 TwoTower AI 模型:保留 98.7% 质量,Token 生成提速 2.42 倍
英伟达昨日(7 月 2 日)发布博文,宣布推出 Nemotron-Labs-TwoTower,是一种基于预训练自回归骨干网络的离散扩散语言模型,致力于解决大模型 Token 生成速度瓶颈。
AI资讯2026-07-03AI资讯 -
消息称英伟达 Rubin Ultra AI 加速器放弃 4-Die 方案
消息源 @SemiAnalysis_ 昨日(6 月 30 日)在 X 平台发布推文,爆料称因制造执行问题,英伟达原定 2027 年推出的 Rubin Ultra AI 加速器将放弃 4-Die 方案,改为 2-Die 方案···
AI资讯2026-07-01AI资讯 -
英伟达刷新 DeepSeek V4 推理纪录:单 Token 成本降至 1/5,AI 吞吐量最高提升 20 倍
英伟达昨日(6 月 30 日)发布博文,宣布在英伟达 Blackwell 平台上,通过优化推理软件栈,相比较 DeepSeek V4 模型 1 个月前上线初期,单 Token 成本最多降至五分之一。
AI资讯2026-07-01AI资讯
微信客服