-
阿里达摩院开源全球首个专家级通用医疗影像 AI 模型 DAMO RADAR:可一次性识别超 146 种病症,成果登《科学》
9月18日讯 阿里达摩院今日宣布,与浙江大学医学院附属第一医院等机构研发出的通用医疗影像 AI 模型 DAMO RADAR,登上国际顶级学术期刊《科学》(Science)。 该模型面向腹部增强 CT 诊断,可一次性识别超过 146 种病症,其准确性首次达到影像科专家级水平,现已正式开源。 据介绍,达摩院采用视觉-语言学习方法(Vision-Language Learning),让模型直接学习医学影…... 魔果智讯
- 0
- 0
- 0
-
智谱 GLM-5.3-FlashX 模型上线,更快、更流畅
9月18日讯 智谱今日宣布推出 GLM-5.3-FlashX(最高 200 tokens/s),为企业与开发者带来更快、更流畅的模型体验。 智谱官方表示,GLM-5.3-Flash 此前以“Ox Alpha”之名与全球开发者见面,获得海内外开发者的广泛认可,调用量持续攀升。面对快速增长的需求,智谱在 10 万张国产芯片提供的推理算力基础上,进一步加大对 Infra 侧的投入与推理优化。GLM-5.…... 魔果智讯
- 0
- 0
- 0
-
阿里发布 Qwen3.8-Omni-Flash 全模态模型:音视频能力提升,百万 Token 图文音视频输入 0.8 元
9月18日讯 阿里千问今日正式上线新一代原生全模态模型 Qwen3.8-Omni-Flash,并已在千问 AI 平台提供。该模型可同时处理文本、图像、音频和视频输入,支持 1M 上下文。 全模态模型指可同时处理文本、图像、音频、视频等多种输入形式。官方称,该模型在保持同尺寸文本模型能力的同时,全模态能力较上一代明显提升。 在累计 30 项评测上,Qwen3.8-Omni-Flash 相比上一代 Q…... 魔果智讯
- 0
- 0
- 0
-
人形机器人可“自主做家务”,Figure 发布 Helix 2.5 模型
9月18日讯 人形机器人企业 Figure 今日发布了 Helix 2.5 模型,能让机器人“自主做家务”。 从 Figure 官方介绍获悉,Figure 在美国旧金山湾区租了 30 套房子,机器人没有进行额外训练,到了地方就开始自己收拾房子。 Helix 2.5 的构建旨在回答一个问题 —— 类人生物能否进入一个它从未见过的家,并立即自主工作? 为此,Figure 在全球人类行为数据集 Inde…... 魔果智讯
- 0
- 0
- 0
-
谷歌最强数学推理 AI 模型曝光:100 万词元上下文,专攻数学难题
9月18日讯 消息源 @lyraxana 于 9 月 16 日在 X 平台发布推文,爆料称谷歌正基于 DeepThink V3 模型,构建内部代号为 Mathematica 的实验 AI 模型,主要针对繁重计算、复杂的符号问题求解特别优化,预估将成为谷歌最强数学推理 AI 模型。 API 数据显示,该模型内部标识符为“models / deepthink-mathematica-tf-r…... 魔果智讯
- 0
- 0
- 0
-
小米直播训练 MiMo-V2.6 模型,罗福莉称沉寂半年钻研一件事
9月17日讯 小米 MiMo 大模型负责人罗福莉今日发文,自 4 月份开源 MiMo-v2.5 后,小米沉寂了近半年,花时间研究了一件事 —— 强化学习究竟能扩展到多远。 MiMo-V2.6 目前正处于强化学习中间阶段。该团队为其扩展了三项能力: 计算(每步约 20 亿个 Token,1,568 个 Prompt × 16 条 Rollout,完全异步) 环境和工具(多任务智能体强化学习,一次运行…... 魔果智讯
- 0
- 0
- 0
-
基于全国产化算力训练,讯飞星火语音基座大模型 Spark-Audio-1.0-Preview 上线
9月16日讯 科大讯飞今日宣布 Spark-Audio-1.0-Preview 上线,这是一款基于全国产化算力训练的语音基座大模型。 过去,大模型处理音频大多采用级联方案:先把语音转成文字,再交给大模型理解。这种做法有两个明显短板: 信息丢失。文字只能记录说了什么,会丢掉语音里自带的语气、情绪,还有背景环境音等关键信息,导致模型对场景的判断不完整,自然也会影响到最后的结果。 链路割裂。这套系统把语…... 魔果智讯
- 0
- 0
- 5
-
豆包大模型 2.1 Pro 更新 0915 版本:Agent 交付更可靠,多模态 Coding 进化
9月16日讯 火山引擎官方今日宣布为豆包大模型 2.1 Pro 更新至 0915 版本,API 全量上线火山方舟。 从官方获悉,豆包工作已完成升级,用户下载或升级至最新版,选取“豆包 2.1 Pro(0915 新版)”模型即可体验。 本次升级围绕企业生产级需求,覆盖 Agent 任务交付、多模态 Coding、多模态理解与 Token 效率优化。 除豆包外,TRAE 已同步接入 0915 版本。今…... 魔果智讯
- 0
- 0
- 0
-
vivo 发布四款蓝心大模型,推出系统级蓝心 Harness
9月16日讯 在今日的 2026 vivo 开发者大会上,vivo 发布了四款新的蓝心大模型。 「听得懂你的蓝心语音大模型 RealTime」全新的端到端语音理解架构,融入更多你的个人化信息。更重要的是,嘈杂环境、轻声说话、带着口音、连续表达、中英混着说,它都听得懂。 「记得住你的蓝心端侧大模型 Nano」它的使命就是实时感知、沉淀个人记忆。它能融合理解屏幕、图像、视频、文本和文件,不仅看懂当下,…... 魔果智讯
- 0
- 0
- 0
-
谷歌推出 Gemini 3.8 Live 和 3.8 Live Extended Thinking 实时对话模型,支持 97 种语言切换
9月16日讯 当地时间 9 月 15 日,谷歌宣布推出 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking。谷歌称这是其迄今最先进的实时对话模型,在智能和并行推理方面有重大升级,让 AI 对话更直观智能。 两款新品分别为面向规模部署与成本优化的 Gemini 3.8 Live,以及面向高复杂度任务、强化多步推理能力的 Gemi…... 魔果智讯
- 0
- 0
- 6
-
阶跃发布 StepAudio 3 系列语音大模型,拿下多个全球第一
9月15日讯 今日阶跃正式发布 StepAudio3 系列模型,包括 StepAudio3Realtime、StepAudio3ASR、StepAudio3TTS、StepAudio3Gen 和 StepAudio3Music,其中多款模型在 Artificial Analysis 榜单中位列全球第一。以上五款模型,目前均已上线阶跃星辰开放平台。 官方称,StepAudio 3 系列分别面向几类核…... 魔果智讯
- 0
- 0
- 3
-
马斯克:Grok 4.8 模型本周完成训练,参数量 2.5 万亿
9月14日讯 xAI 首席执行官埃隆 · 马斯克今天在 X 平台透露,Grok 4.8 将是一款参数量达 2.5 万亿的 AI 模型,使用全新 C++ 软件栈训练。 马斯克表示,Grok 4.8 将在本周完成训练、启动强化学习(RL)。... 魔果智讯
- 0
- 0
- 6
-
月之暗面 Kimi K2.8 Preview 模型全量上线 Kimi Code,综合性能接近 K3
9月11日讯 月之暗面 Kimi K2.8 Preview 模型今日全量上线 Kimi Code,Model ID 不变,仍为 kimi-for-coding,客户端与第三方工具无需修改配置即可使用。 官方表示,K2.8 Preview 综合性能接近 K3,思考效率更高。编码与智能体能力全面提升,思考(thinking)效率较 K2.7 Code 显著改善,全部会员档位均开放最高 1M 上下文窗口…... 魔果智讯
- 0
- 0
- 8
-
小米开源工业级目标说话人语音识别大模型 Xiaomi-CocktailASR-1
9月11日讯 小米技术今日发文宣布,小米正式发布并开源工业级目标说话人语音识别大模型 Xiaomi-CocktailASR-1。 官方表示,Xiaomi-CocktailASR-1 旨在解决“鸡尾酒会”难题(当前语音识别技术已经可以以较高精度识别一个人所讲的话,但是当说话的人数为两人或者多人时,语音识别率就会极大地降低,这一难题被称为鸡尾酒会问题)。 该模型采用端到端 LLM 架构,以目标说话人的…... 魔果智讯
- 0
- 0
- 0
-
OpenAI 扩大实时语音模型能力:GPT-Live-1 上线 API,支持打断处理、工具调用和电话语音智能体
9月11日讯 OpenAI 今日宣布将 GPT-Live-1 引入 API,开发者可据此打造支持实时语音交互的应用和业务流程。该模型支持全双工对话,能够同时听取和输出语音,并在对话过程中处理打断、停顿及背景噪声。 GPT-Live-1 还支持电话场景,可用于预订餐厅、客户服务等全双工语音智能体。OpenAI 表示,开发者可以将其与 Codex 等工具连接,也可以通过 OpenAI Presence…... 魔果智讯
- 0
- 0
- 12
-
高德发布全球首个 3D 原生城市世界模型 ABot-Earth 0.7,实现从星球到街景的全尺寸 AI 生成
9月10日讯 今日阿里巴巴集团旗下高德正式发布全球首个 3D 原生城市世界模型 ABot-Earth 0.7。依托 3D 原生技术架构与高德海量时空数据积累,ABot-Earth 0.7 支持从星球到街景的一体化全尺寸 AI 生成,并将多种空间信息组织为可连续进入、自由探索和实时交互的三维数字孪生世界,从而构建起目前覆盖范围最广的数字地球,覆盖超过 196 个国家和地区。 “大模型理解语言,高德空…... 魔果智讯
- 0
- 0
- 9
-
刷新全球开源模型多项评测 SOTA,宇树科技开源全新一代通用人形机器人基座模型 UnifoLM-WLA-1.0
9月10日讯 宇树科技宣布完全开源 UnifoLM-WLA-1.0 具身基座模型,刷新全球开源模型多项评测 SOTA。单模型统筹桌面与全身移动操作,支持跨任务、跨末端执行器泛化。 据介绍,UnifoLM-WLA-1.0 是宇树科技全新一代通用人形机器人基础模型,依托大规模通用多模态感知与理解数据,融合以交互为中心的世界建模,全面提升空间感知与理解能力,在多项具身推理评测中领先国内外开源模型,亦可比…... 魔果智讯
- 0
- 0
- 8
-
DeepSeek 快速、专家、识图模式合并升级,V4.1 Flash 今日正式发布
9月10日讯 DeepSeek 今日宣布将原有的快速模式、专家模式和识图模式合而为一,这意味着用户将不再需要手动切换。 DeepSeek 将其整合为统一的智能模式,模型可自动检测查询复杂度、在检测到图片输入时激活视觉能力,并根据任务难度调整处理能力。 在此之前,多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp 已上线 DeepSeek API 平台,…... 魔果智讯
- 0
- 0
- 12
-
面壁智能开源 MiniCPM5-2B AI 模型:AA 榜单全球 4B 以下第一,初具端侧通用 Agent 能力
9月9日讯 面壁智能昨日联合 OpenBMB 开源社区正式开源新一代“小钢炮”MiniCPM5-2B。 MiniCPM5-2B 的参数规模为 2B,是一款高密度端侧语言基座模型,支持工具调用、深度搜索、代码生成等任务,官方称初步实现了端侧通用 Agent 雏形。 根据榜单 Artificial Analysis Intelligence Index(以下简称「AA 榜单」)的最新评测,M…... 魔果智讯
- 0
- 0
- 16
-
蚂蚁百灵系列首个原生多模态模型 Ling-3.0-flash-VL 发布开源,引入视觉反馈闭环机制
9月9日讯 蚂蚁集团今日宣布推出并开源百灵系列首个原生多模态大模型 Ling-3.0-flash-VL。 该模型基于 Ling-3.0-flash 的 MoE(混合专家)架构拓展,总参数量为 124B,单次推理激活 5.5B 参数,原生支持图像、文本与视频输入,上下文窗口达到 256K Token。 模型围绕“更可靠、更高效完成真实任务”的方向,引入了视觉反馈闭环机制。不同于一次性的“看图生成”,…... 魔果智讯
- 0
- 0
- 8
-
OpenAI 最强 AI 生图模型:ChatGPT Images 2.5 登场,延迟降低 50%、新增 Sketch 草图
9月9日讯 OpenAI 今天(9 月 9 日)官宣发布 ChatGPT Images 2.5,图像生成延迟最多降低 50%,并新增 Sketch 草图参考、模板库、图片内评论标注等实用功能,是该公司当前最先进的图像生成模型。 相比较 2026 年 4 月发布的 Images 2 模型,Images 2.5 重点降低了图像生成延迟,在细节锐度、自然光照和纹理丰富度方面均有提升的情况下,延迟最多降低…... 魔果智讯
- 0
- 0
- 6
-
DeepSeek 官宣明日 flash 系列 AI 模型降价:输出为每百万 Token 4 元
9月9日讯 据 DeepSeek 开放平台公告,官方宣布将于北京时间明日(2026 年 9 月 10 日)12 时起执行新价格,调整 Flash 系列定价。 根据明日调整的新价格: 空闲时段: 输入缓存命中价格为每百万 Token 0.02 元 输入缓存未命中为每百万 Token 1 元 输出为每百万 Token 4 元 高峰时段各项价格均为上述空闲时段价格的两倍。 经查询公开资料,Flash 系…... 魔果智讯
- 0
- 0
- 5
-
DeepSeek V4.1 Flash 中间版本内测:新模型结构,原生多模态支持,更快更强、成本更低
9月8日讯 据网友反馈,DeepSeek 今日在官方交流群内发布通知,DeepSeek V4.1 Flash 的中间版本内测,采用了新的模型结构,原生多模态支持、能力更强、速度更快、成本更低。 内测用户可保持 base_url 不变,将模型名设置为 deepseek-v4.1-flash-expires-on-0910 即可调用,当前计费与 deepseek-v4-flash …... 魔果智讯
- 0
- 0
- 11
-
科大讯飞星火 X2.5 模型正式发布:293B-A30B MoE,全国产平台训练
9月7日讯 科大讯飞 (iFlytek) 今日正式发布星火 Spark-X2.5 多语言文本生成模型。该模型基于全国产平台训练,采用 MoE 框架,模型参数 293B-A30B,支持 256K 上下文。 星火 X2.5 全面提升代码和智能体能力,同时覆盖 200 余种语言,在语言理解、答题、推理等通用任务上保持优异的效果。 这款模型目前已在讯飞星辰 MaaS 平台上线,定价如下: 输入:…... 魔果智讯
- 0
- 0
- 12























































