浦语·灵笔 2.5 OmniLive:探索未来多模态智能生成的最新突破
InternLM-XComposer 2.5 OmniLive是一个多模态生成模型,专注于视觉和语言理解领域。它在图像处理、文本生成、对话系统等多个维度都实现了技术创新,支持高度的定制化和优化,尤其适合需要高度多功能性的AI应用场景。
SEARCH INTELLIGENCE
从资讯、AI应用到创新实践,让每一次搜索都能抵达更完整的数智脉络。
PRODUCT DISCOVERY
InternLM-XComposer 2.5 OmniLive是一个多模态生成模型,专注于视觉和语言理解领域。它在图像处理、文本生成、对话系统等多个维度都实现了技术创新,支持高度的定制化和优化,尤其适合需要高度多功能性的AI应用场景。
INTELLIGENCE FEED
英伟达正洽谈以超130亿美元收购AI开源平台Hugging Face,双方尚未达成协议,微软亦与后者接触。Hugging Face年化营收已突破1.5亿美元,但若被英伟达收购,其对竞争对手硬件和模型的开放中立性将面临考验。
阿里巴巴通义千问(Qwen)系列开源AI模型在过去六个月内全球累计下载量突破30亿次,超越Meta和谷歌成为全球下载量第一的AI模型,其衍生模型数量也大幅领先竞争对手。
阿里巴巴达摩院与浙江大学、香港科技大学联合推出推理引擎Inferix,通过块扩散方法实现任意长度高质量视频生成。该技术已在游戏、教育、娱乐领域展现应用潜力,并面向开发者开源。
小米正式开源原生端到端语音模型Xiaomi-MiMo-Audio,基于上亿小时训练数据实现少样本泛化能力,并在多项基准测试中超越同规模开源模型及闭源模型。该模型通过三重技术创新突破传统语音范式,全套技术方案已开源发布。
腾讯混元宣布开源四款专为消费级显卡设计的小尺寸AI模型,显著降低硬件门槛,适用于笔记本、手机等低功耗场景。模型具备快慢双思考模式、256k长上下文窗口及强化学习agent能力,已获Arm、高通等芯片平台支持部署。
法国AI初创公司Mistral发布首个语音理解模型Voxtral系列,提供开放且经济高效的音频处理方案。该模型支持多语言操作,提供不同参数版本,商业集成成本低至每分钟0.001美元。
阿里开源了Qwen3-Embedding系列模型,涵盖Embedding和Reranker组件,专为文本表征、检索与排序任务优化。该模型在多项基准测试中表现突出,支持超过100种语言,并已在ModelScope、Hugging Face和GitHub平台提供资源。
Mistral AI与Cerebras Systems达成战略合作,推出全新开源AI助手Le Chat,凭借超高速响应和创新定价策略,迅速成为市场瞩目的焦点。该产品在性能和隐私保护方面做出了差异化的选择,成为对抗OpenAI和DeepSeek的强有力竞争者。
开源倡议组织(OSI)发布了首个开源AI定义候选版本,明确了AI系统开源的四项基本自由。该定义候选版本在透明度和数据使用问题上进行了妥协,计划在2024年10月正式发布最终版本。