跳至内容
每时AI

每时AI

  • 资讯
  • 国际
  • 分享
  • 大模型
  • 学术
  • 开源
  • 机器人
  • 关于我们

32B模型

逐个token太慢!大模型原生并行出token,CMU、英伟达新作Multiverse

2025年6月17日23时 作者 机器之心

CMU Infini-Al-Lab 研究人员提出 Multiverse,一种支持原生并行生成的新型生成模型框架,显著提高大语言模型的推理效率和速度。

分类 学术、 资讯 标签 32B模型、 MapReduce、 Multiverse、 卡耐基梅隆大学、 原生并行生成、 生成模型 发表评论

DeepSeek-R1发布后的100天复现之旅方法总结

2025年5月3日14时 作者 机器学习算法与自然语言处理

MLNLP社区发布论文介绍复现推理大模型技术,强调让AI学会思考而非仅背答案;提出监督微调与强化学习两大方法,并讨论未来发展方向。

分类 学术 标签 32B模型、 DeepSeek团队、 MLNLP社区、 强化学习(RLVR)、 数据质量、 监督微调(SFT) 发表评论

2025年 AGI AI AI技术 Anthropic ChatGPT Claude DeepSeek DeepSeek-R1 DeepSeek R1 GitHub GPT-4o LLM MCP Meta OpenAI Python Sam Altman 人工智能 人形机器人 具身智能 大型语言模型 大模型 大语言模型 字节跳动 开源 强化学习 微软 扩散模型 技术创新 智能体 木易 机器学习 深度学习 清华大学 生成式AI 用户体验 百度 腾讯 自然语言处理 英伟达 谷歌 阿里云 阿里巴巴 马斯克

分类

  • 分享
  • 国际
  • 大模型
  • 学术
  • 开源
  • 机器人
  • 资讯
  • 真·遥遥领先!华为式“AI全家桶”亮相HDC2025,鸿蒙、盘古与384超节点照亮新可能
  • AI大模型驱动的开源知识库搭建系统,可以做成钉钉、飞书、企业微信等聊天机器人。
  • OpenAI或将失去孙正义200亿美元投资
  • 六个安全Agent设计模式:有效防止Prompt注入攻击
  • 扎克伯格盯上了OpenAI前首席科学家Ilya的公司!

2025 年 6 月
一 二 三 四 五 六 日
 1
2345678
9101112131415
16171819202122
23242526272829
30  
« 5 月    

归档

  • 2025 年 6 月
  • 2025 年 5 月
  • 2025 年 4 月
  • 2025 年 3 月
  • 2025 年 2 月
  • 2025 年 1 月
  • 2024 年 12 月
  • 2024 年 11 月

AI新闻 | X平台 | APK反编译 | 京ICP备2024096144号 |
© 2025 每时AI • Built with GeneratePress
 下载我们的APP,AI秒送达!  立即下载
×