跳至内容
每时AI

每时AI

  • 资讯
  • 国际
  • 分享
  • 大模型
  • 学术
  • 开源
  • 机器人
  • 关于我们

DyT

CVPR2025|恺明+LeCun联手带来没有归一化层的Transformer!

下午11时 2025/03/16 作者 极市干货

>>
加入极市CV技术交流群,走在计算机视觉的最前沿
本文目录
1
DyT:取代 Transform

分类 学术 标签 DyT、 PyTorch、 函数、 原理、 实验分析、 应用场景 发表评论

何恺明LeCun暴击Transformer命门,9行代码砍掉归一化层!性能反而更强了?

下午11时 2025/03/14 作者 新智元

恺明LeCun、清华姚班刘壮联手,用9行代码砍掉了Transformer「标配」归一化层,创造了性能

分类 资讯 标签 DyT、 动态线性变换、 参数优化、 注意力机制、 自监督学习、 训练效果 发表评论

何恺明LeCun联手改造Transformer!9行代码替代归一化层,性能不减还加速

下午4时 2025/03/14 作者 量子位

何恺明和LeCun团队提出替代Transformer归一化层的DyT方法,其性能达到或超过标准Transformer。通过几行PyTorch代码实现,适用于多种任务和模型架构。

分类 资讯 标签 CVPR最佳论文奖、 DyT、 LeCun、 Meta AI Research、 何恺明、 归一化层 发表评论

2025年 AGI AI AI技术 Anthropic ChatGPT Claude DeepSeek DeepSeek-R1 DeepSeek R1 GitHub GPT-4o LLM Manus Meta OpenAI Python Sam Altman 人工智能 人形机器人 具身智能 大型语言模型 大模型 大语言模型 字节跳动 开源 强化学习 微软 扩散模型 技术创新 智能体 木易 机器学习 深度学习 清华大学 生成式AI 用户体验 百度 腾讯 自然语言处理 英伟达 谷歌 阿里云 阿里巴巴 马斯克

近期文章

  • 纯Prompt提示LLM的多阶段知识图谱三元组抽取及Schema生成方案
  • ROS MCP Server:自然语言控制机器人,从此告别复杂指令!
  • 囤的提示词每次都要找半天,怒肝10小时做出个插件解决!
  • AI 模型大爆发:字节豆包 1.6、OpenAI o3-pro、Mistral 同周登场! AI Weekly 6.9-15
  • 首例!苹果竟被AI大模型Claude写论文驳斥:思考幻觉的幻觉!

分类

  • 分享
  • 国际
  • 大模型
  • 学术
  • 开源
  • 机器人
  • 资讯
2025 年 6 月
一 二 三 四 五 六 日
 1
2345678
9101112131415
16171819202122
23242526272829
30  
« 5 月    

归档

  • 2025 年 6 月
  • 2025 年 5 月
  • 2025 年 4 月
  • 2025 年 3 月
  • 2025 年 2 月
  • 2025 年 1 月
  • 2024 年 12 月
  • 2024 年 11 月

AI新闻 | X平台 | APK反编译 | 京ICP备2024096144号 |
© 2025 每时AI • Built with GeneratePress
 下载我们的APP,AI秒送达!  立即下载
×