跳至内容
每时AI

每时AI

  • 资讯
  • 国际
  • 分享
  • 大模型
  • 学术
  • 开源
  • 机器人
  • 关于我们

H800 GPU

MiniMax重磅开源M1模型:百万上下文超DeepSeek R1,实现性能与效率双杀

2025年6月17日11时 作者 AI科技大本营

国内 AI 六小虎之一的 MiniMax 正式开源其首个推理模型 M1,支持百万级上下文长度,在性能和效率方面表现出与众不同的技术路径和表现。

分类 分享 标签 53.47万美元、 CISPO算法、 H800 GPU、 Lightning Attention、 M1、 MiniMax 发表评论

DeepSeek V3论文细节:如何绕开CUDA的垄断!

2025年1月29日22时 作者 Datawhale

DeepSeek 使用英伟达 PTX 编程技术,在硬件受限条件下训练出高性能语言模型,展示了在减少对算力需求的同时提升性能的可能。

分类 分享 标签 10倍效率、 20流处理器、 CUDA壁垒、 DeepSeek、 H800 GPU、 MoE语言模型 发表评论

国产AI之光,正在超越ChatGPT!

2024年12月28日16时 作者 路过银河AI

DeepSeek V3发布技术报告,其高效能和低算力依赖使其成为当前最强开源基础模型。预训练阶段成本仅为557万美元,性能对标GPT-4o及Claude-3.5-Sonnet。

分类 分享、 大模型 标签 557万美元、 671B参数、 AIME 2024、 DeepSeek V3、 H800 GPU、 深度求索 发表评论

AGI AI AI技术 Anthropic ChatGPT Claude DeepSeek DeepSeek-R1 DeepSeek R1 GitHub GPT-4o LLM Meta OpenAI Python Sam Altman 人工智能 人形机器人 具身智能 大型语言模型 大模型 大语言模型 字节跳动 工业机器人 开源 强化学习 微软 扩散模型 技术创新 智能体 木易 机器学习 深度学习 清华大学 生成式AI 用户体验 百度 腾讯 自然语言处理 英伟达 谷歌 阿里云 阿里巴巴 马斯克 黄仁勋

分类

  • 分享
  • 国际
  • 大模型
  • 学术
  • 开源
  • 机器人
  • 资讯
  • 皮衣换唐装,首次中文演讲,老黄亮相链博会展望物理AI,人形机器人各种火爆出圈儿
  • 黄仁勋最新演讲: AI下一波浪潮将是机器人系统
  • 阿斯麦Q2销售超预期,AI推动订单大增
  • 明星初创公司Anthropic推出专业金融AI服务
  • 突发!Cursor全面限制国内使用部分模型,非常彻底!

2025 年 7 月
一 二 三 四 五 六 日
 123456
78910111213
14151617181920
21222324252627
28293031  
« 6 月    

归档

  • 2025 年 7 月
  • 2025 年 6 月
  • 2025 年 5 月
  • 2025 年 4 月
  • 2025 年 3 月
  • 2025 年 2 月
  • 2025 年 1 月
  • 2024 年 12 月
  • 2024 年 11 月

AI新闻 | X平台 | APK反编译 | 京ICP备2024096144号 |
© 2025 每时AI • Built with GeneratePress
 下载我们的APP,AI秒送达!  立即下载
×