推荐类别

栏目分类

优惠 video-t3:提高视频大型语言模型(Video LLMs)在处理时间推理方面的能力

  • video-t3:提高视频大型语言模型(Video LLMs)在处理时间推理方面的能力
    AI
  • 香港大学、北京大学和加州大学圣地亚哥分校的研究人员推出新方法T3,它旨在提高视频大型语言模型(Video LLMs)在处理时间推理方面的能力。这些模型通常在理解视频内容时遇到困难,尤其是在跟踪随时间变化和理解时间 ...... 阅读全文

    优惠 新型编程辅助框架CursorCore:能够通过对话的方式,帮助程序员更高效地编写和修改代码

  • 新型编程辅助框架CursorCore:能够通过对话的方式,帮助程序员更高效地编写和修改代码
    AI
  • 中国科学技术大学认知智能国家重点实验室和科大讯飞(华中)人工智能研究院的研究人员推出新型编程辅助框架CursorCore,这个框架能够通过对话的方式,帮助程序员更高效地编写和修改代码。想象一下,你正在编写一个程 ...... 阅读全文

    优惠 全新TTS系统F5-TTS:能够将文本信息转换成听起来自然且富有表现力的语音

  • 全新TTS系统F5-TTS:能够将文本信息转换成听起来自然且富有表现力的语音
    AI
  • 上海交通大学、剑桥大学,吉利汽车研究院(宁波)有限公司的研究人员推出一个名为F5-TTS的全新文本到语音(Text-to-Speech,TTS)系统。这个系统能够将文本信息转换成听起来自然且富有表现力的语音。想象一下,你正 ...... 阅读全文

    优惠 基于Mamba架构构建的大语言模型Falcon Mamba 7B

  • 基于Mamba架构构建的大语言模型Falcon Mamba 7B
    AI
  • 阿拉伯联合酋长国阿布扎比技术创新研究所推出大语言模型Falcon Mamba 7B,它是基于一种新颖的架构——Mamba架构构建的。这个模型经过了大量数据的训练,并且在性能上超过了其他一些知名的、基于Transformer架构的模型 ...... 阅读全文

    优惠 TinyEmo:用于情感推理和分类的小型多模态语言模型系列

  • TinyEmo:用于情感推理和分类的小型多模态语言模型系列
    AI
  • TinyEmo是一个用于情感推理和分类的小型多模态语言模型系列。你可以把TinyEmo想象成一个迷你的情感分析专家,它能够理解图片中的情感内容,并给出相应的分类。例如,一个社交媒体用户分享了一张看起来孤独的图片,Ti ...... 阅读全文

    优惠 Diversity-Rewarded CFG:提高音乐生成模型在创作过程中的多样性和质量

  • Diversity-Rewarded CFG:提高音乐生成模型在创作过程中的多样性和质量
    AI
  • 谷歌发布论文,论文的主题是关于如何提高音乐生成模型在创作过程中的多样性和质量。想象一下,你是一位音乐制作人,想要创作出既符合某个主题又充满新意的音乐作品。但是,如果你每次创作出来的作品都大同小异,那就 ...... 阅读全文

    优惠 CritiCS:使用大语言模型(LLMs)来创造具有叙事连贯性和创造力的长篇故事

  • CritiCS:使用大语言模型(LLMs)来创造具有叙事连贯性和创造力的长篇故事
    AI
  • 韩国蔚山科学技术研究院人工智能研究生院推出CritiCS,使用大语言模型(LLMs)来创造具有叙事连贯性和创造力的长篇故事。想象一下,你是一位作家,想要写一个既有趣又能让读者一直猜不到下一步会发生什么的长故事, ...... 阅读全文

    优惠 喜加一 复古街机风格独立游戏《Castle Break》限时免费领取,为新作《Zero Orders Tactics》预热! 0元

  • 复古街机风格独立游戏《Castle Break》限时免费领取,为新作《Zero Orders Tactics》预热!
    STEAM
  • 由 Pauloondra 开发的复古街机风格独立游戏《Castle Break》现正于 Steam 平台开启限时免费活动。玩家只需登录 Steam 账号,前往游戏商店页面即可轻松领取,永久收藏这款游戏。此次免费活动旨在为开发者即将于11月发 ...... 阅读全文

    优惠 用于加速音乐生成的新技术Presto!:通过减少采样步骤和每个步骤的成本,来加速基于分数的音乐生成模型的推理过程

  • 用于加速音乐生成的新技术Presto!:通过减少采样步骤和每个步骤的成本,来加速基于分数的音乐生成模型的推理过程
    AI
  • 加州大学圣地亚哥分校、Adobe Research的研究人员推出一种用于加速音乐生成的新技术Presto!,Presto!通过减少采样步骤和每个步骤的成本,来加速基于分数的扩散变换器(一种生成音乐的模型)的推理过程。例如,你是一 ...... 阅读全文

    优惠 新型大型视频语言模型Grounded-VideoLLM:擅长于理解视频中的精细时刻,并能够推理出具体发生在视频哪个时刻的事情

  • 新型大型视频语言模型Grounded-VideoLLM:擅长于理解视频中的精细时刻,并能够推理出具体发生在视频哪个时刻的事情
    AI
  • 加州大学戴维斯分校、弗吉尼亚理工大学、香港中文大学、英伟达、Adobe Research 、复旦大学和Meta AI的研究人员推出一种新型大型视频语言模型Grounded-VideoLLM。这个模型特别擅长于理解视频中的精细时刻,并能够推 ...... 阅读全文

    优惠 互动聊天创新项目Future You:通过让用户与年长版的自己进行对话,减少焦虑,指导年轻人做出更好的选择

  • 互动聊天创新项目Future You:通过让用户与年长版的自己进行对话,减少焦虑,指导年轻人做出更好的选择
    AI
  • 麻省理工学院媒体实验室、KASIKORN 实验室、哈佛大学和加利福尼亚大学安德森管理学院的研究人员推出创新项目Future You,它是一个互动聊天平台,使用人工智能技术帮助用户与他们的“未来自我”进行对话。这个平台旨在 ...... 阅读全文

    优惠 苹果推出新型多模态大语言模型MM1.5:提升对包含丰富文本的图像理解、视觉指代和定位以及多图像推理的能力

  • 苹果推出新型多模态大语言模型MM1.5:提升对包含丰富文本的图像理解、视觉指代和定位以及多图像推理的能力
    AI
  • 苹果推出新型多模态大语言模型MM1.5,它是为了提升对包含丰富文本的图像理解、视觉指代和定位以及多图像推理的能力而设计的。简单来说,MM1.5就像一个超级聪明的助手,它可以阅读和理解图片中的文字,告诉你图片里发 ...... 阅读全文
    我要爆料 我的收藏 顶部
    快速登录

    自动登录 忘记密码?