来源:星火智游网 责编:网络 时间:2025-04-18 12:25:37
人工智能初创公司 Cohere 的非营利研究实验室本周发布了一款多模态 “开放” AI 模型 ——Aya Vision。该实验室声称,该模型在行业内处于领先地位。

Aya Vision 能够执行多项任务,包括撰写图片说明、回答与照片相关的问题、翻译文本以及生成23种主要语言的摘要。Cohere 表示,他们通过 WhatsApp 免费提供 Aya Vision,希望能让世界各地的研究人员更方便地获取技术突破。

Cohere 在其博客中指出,尽管人工智能已经取得了显著进展,但在不同语言之间的模型表现仍存在很大差距,尤其是在涉及文本和图像的多模态任务中。“Aya Vision 的目标就是帮助缩小这一差距。”
Aya Vision 有两个版本:Aya Vision32B 和 Aya Vision8B。更为先进的 Aya Vision32B 被称为 “新边界”,在某些视觉理解基准测试中表现超越了体量为其两倍的模型,包括 Meta 的 Llama-3.290B Vision。同时,Aya Vision8B 在某些评估中表现也优于一些体量为其十倍的模型。

这两个模型在 AI 开发平台 Hugging Face 上以 Creative Commons4.0许可证的形式提供,用户需遵循 Cohere 的可接受使用附录,且不可用于商业应用。
Cohere 表示,Aya Vision 的训练采用了一种 “多样化的” 英语数据集,实验室将这些数据集翻译后,使用合成标注进行训练。合成标注是指由 AI 生成的标注,有助于模型在训练过程中理解和解释数据。尽管合成数据存在潜在缺点,但像 OpenAI 等竞争对手也在越来越多地使用合成数据来训练模型。
Cohere 指出,使用合成标注训练 Aya Vision 使得他们能够减少资源的使用,同时仍能取得竞争力的表现。“这展示了我们对效率的重视,利用更少的计算资源实现更多成果。”
为了进一步支持研究界,Cohere 还发布了一套新的基准评估工具 ——AyaVisionBench,旨在考察模型在视觉与语言结合任务中的能力,如识别两张图像的差异和将屏幕截图转换为代码。
当前,人工智能行业正面临所谓的 “评估危机”,这主要源于流行基准的广泛使用,这些基准的总分与大多数 AI 用户关心的任务的能力相关性较差。Cohere 声称,AyaVisionBench 为评估模型的跨语言和多模态理解提供了一个 “广泛且具有挑战性” 的框架。
官方博客:https://cohere.com/blog/aya-vision
划重点:
🌟 Aya Vision 模型被 Cohere 称为行业最佳,能够执行多种语言和视觉任务。
💡 Aya Vision 有两个版本,分别为32B 和8B,表现超越体量更大的竞争模型。
🔍 Cohere 还发布了新的基准评估工具 AyaVisionBench,旨在改善 AI 模型评估问题。
在当今数字化的时代,互联网提供了丰富多样的资源和娱乐选择。其中,成人视频网站成为了一部分用户寻求刺激和娱乐的途径。对于这些网站的使
在这个信息爆炸的时代,漫画作为一种受欢迎的娱乐形式,已经成为了许多人生活中不可或缺的一部分。而对于漫画爱好者来说,找到一个丰富多样
三年片在线观看大全哔哩哔哩,乃现今网络视听之盛宴,诸多影视资源汇聚于此,诚为观众提供多元化之选择。无论古今中外,各类影片悉皆应有尽
在这个信息爆炸的时代,人们对于娱乐的需求越来越高。而影视、剧集和综艺节目无疑是人们最喜爱的娱乐方式之一。麻斗传媒官方网站作为一个专
Cohere推出全新升级的多模态AI模型Aya Vision,包括32B和8B两个不同性能版本供用户选择
深入探讨《暗黑破坏神2》第二幕雇佣兵的特点与使用策略
使用DiskGenius工具修复硬盘坏道并有效提升硬盘整体健康水平的方法与步骤
春雨-p8yiy-vb423-xb4.apk:深度解析这款创新应用的独特功能及其多元化应用场景
Word文档中如何快速生成1到100的数字列表及其格式化技巧
长沙创新推出“超智能融合”基础教育大模型 引领智能教学新模式的探索与实践
如何在龙息神寂中快速增强战力的有效方法与技巧分享
天下霸图中的隐藏道具与掉落物品全面解析与获取详解
捣蛋鹅中文版下载:一款轻松搞笑的休闲模拟经营游戏,带给你无尽乐趣
怎样在《我的世界》中正确使用32767级的附魔指令以获得超强武器和装备