1300 亿参数、256K 上下文:MAI Code 1.1 Flash 模型升级并计划引入 Win11
微软宣布将 1300 亿参数的 MAI Code 1.1 Flash 模型引入 Windows 11。该模型采用 3-bit 量化技术使体积缩小 80%,并新增多模态看图写代码能力,旨在降低端侧部署门槛并提升开发辅助效率。
SEARCH INTELLIGENCE
从最新动态到实用工具,找到你关心的内容。
微软宣布将 1300 亿参数的 MAI Code 1.1 Flash 模型引入 Windows 11。该模型采用 3-bit 量化技术使体积缩小 80%,并新增多模态看图写代码能力,旨在降低端侧部署门槛并提升开发辅助效率。
2026年10月7日,谷歌宣布 SynthID 面向全球用户开放。该工具支持检测图片、视频和音频等多模态 AI 生成内容,目前已集成至 Gemini 应用和 Chrome 浏览器,日均验证请求达 100 万次。
微软研究院联合哈佛大学与麻省理工学院博德研究所推出实验性多模态AI研究系统 Project Quine。该系统作为生物学“世界模型”,旨在衔接计算建模与湿实验,已在胰腺癌药物筛选中展现加速效能,目前仅限科研使用。
谷歌正式推出带 Live Avatar 功能的 Gemini 3.8 Live,为原生实时对话模型带来接近实时的视觉呈现。该功能支持 97 种语言无缝切换与异步工具调用,现已在 Gemini Enterprise 上线并向企业开放 API 接入。
阿里发布新一代原生全模态模型 Qwen3.8-Omni-Flash,支持 1M 上下文与长音视频理解,音视频能力对标 Gemini 3.8 Flash。其百万 Token 输入价格降至 0.8 元,大幅降低多模态应用开发门槛。
美国国立卫生研究院宣布,加州大学旧金山分校团队研发出一种新型脑机接口,首次在同一系统中同步解码瘫痪患者的预期语言与上肢动作,并发现同步表达的脑信号与单一模式不同,需以同步任务数据训练解码器。
DeepSeek 将快速、专家、识图三大模式合并为统一智能模式,用户无需手动切换,模型自动检测查询复杂度并激活相应能力。同时预告 V4.1 Flash 模型即将上线,在性能、费用、速度等指标上全面超越 V4 Pro。
蚂蚁集团发布并开源百灵系列首个原生多模态大模型 Ling-3.0-flash-VL,引入视觉反馈闭环机制,使模型从一次性看图生成转向观察-行动-验证-修正的持续任务执行模式。模型总参数 124B,单次推理激活 5.5B,原生支持图像、文本与视频输入,上下文窗口达 256K Token。
深度求索上线实验性多模态视觉模型 DeepSeek-V4-Flash-Vision-Exp 并开放 API,支持图文混合输入,纯文本能力与 V4-Flash 持平,视觉 Agent 能力接近 Opus-4.8,图片按 token 计费且价格与 V4-Flash 一致。
OpenAI正式推出GPT-Realtime-1.5多模态模型,支持实时音频和视觉处理,实现低延迟交互。该模型显著优化响应速度,开放API接口,并采用端到端加密和内容过滤确保安全。