Sana 是 NVIDIA 发布的一个开源项目,专为加速大规模深度学习模型训练而设计。通过 GPU 加速、分布式训练以及高效的数据处理,Sana 极大提升了计算机视觉、自然语言处理等任务的训练效率。项目提供模块化设计,支持多种神经网络架构,并可在多个 GPU...
分类: Nvdia
華爾街對DeepSeek的衝擊有不同解讀
美股人工智能概念爆發小股災,英偉達狂瀉近17%收市,市值蒸發5,890億美元,是美股史上單日最多;多隻晶片股跌幅雙位數,納斯達克指數坐挫3%。資金擁向周期股以及與AI關聯較少的股份,道瓊斯指數倒升近300點收市。中國的生成AI模型DeepSeek開放與公眾使用,震撼科技界及華爾街
Mistral AI 和NVIDIA 发布 Mistral NeMo 12B
Mistral AI 宣布发布 Mistral NeMo,这是一个由 NVIDIA 协作开发的 12B 参数模型,具备高达 128k 令牌的上下文窗口。 该模型旨在支持企业应用,包括聊天机器人、多语言任务、编码和摘要。在其尺寸类别中,Mistral NeMo...