-
“小号”美国最强开源模型:Inkling-Small 登场,约 1/4 规模提供相近 AI 性能
7月31日讯 Thinking Machines Lab 昨日(7 月 30 日)发布博文,宣布推出 Inkling-Small 模型,其性能媲美 Inkling,但规模降低至约四分之一。 此前报道,Inkling 号称“美国最强开源 AI 模型”,采用混合专家(MoE)架构,总参数 975B、激活参数 41B,最长上下文 1M tokens。 而本次推出的 Inkling-Small 模型同样采…... 魔果智讯
- 0
- 0
- 0
-
DeepSeek-V4-Flash 正式版 API 上线公测,V4-Pro 正式版将“尽快”发布
7月31日讯 今天(31 日)下午,DeepSeek 通过 API 文档发布日志,宣布 DeepSeek-V4-Flash 正式版 API 上线公测。 根据介绍,DeepSeek-V4-Flash 的 Agent 能力大幅增强,基准测试远超 V4-Pro-Preview: Terminal Bench 2.1: 82.7 NL2Repo: 54.2 Cybergym: 76.7 DeepSWE: …... 魔果智讯
- 0
- 0
- 0
-
阿里发布 Qwen-Audio-3.0-ASR-Flash 语音识别大模型,让 AI 更好听懂专业词汇
7月31日讯 阿里巴巴今日发布语音识别大模型 Qwen-Audio-3.0-ASR-Flash。简单来说,就是让 AI 更好地听懂专业词汇。 Qwen-Audio-3.0-ASR-Flash 主要在上下文一致性、行业词识别和热词定制化三个维度做了系统性的优化,同时让模型具备语音润色能力,可直接输出结构化文本。 研究团队持续从医疗、IT 编程、股票、社会名人等领域里挖掘专业词汇,建成了覆盖多行业的高…... 魔果智讯
- 0
- 0
- 0
-
韩国最大人工智能基础模型:LG AI 研究院发布 750B 参数 K-EXAONE 2.0
7月31日讯 LG AI 研究院当地时间今日在 Hugging Face 上发布了 K-EXAONE 2.0 模型。正如其名,这是 LG AI 研究院在韩国科技信息通信部主权人工智能基金会模型项目下开发的第二个模型。 K-EXAONE 2.0 采用混合注意力 MoE 架构,拥有 750B 总参数和 37B 激活参数,规模是 236B-A23B 的初代 K-EXAONE 的 3 倍以上,也是韩国迄今…... 魔果智讯
- 0
- 0
- 0
-
MiniMax H3 全模态生成模型正式发布:最高支持 15 秒 2K 分辨率,超分方案革新
7月31日讯 稀宇科技今天宣布推出 MiniMax H3 全模态生成模型,支持对文本、图像、视频、声音组成的多模态上下文的统一理解能力、能够输出具备原生双声道的音视频,最高可支持 15s 2K 分辨率。 据前期邀测反馈,MiniMax H3 具备商用级多场景内容生成能力,在指令遵循、文字与品牌信息呈现、V2V Motion Transfer(视频到视频动作迁移)等方面表现出色,号称可精准、可控实现…... 魔果智讯
- 0
- 0
- 0
-
谷歌最强具身推理模型:Gemini Robotics ER 2 登场,支持连续视频理解与多机器人协作
7月31日讯 谷歌 DeepMind 昨日(7 月 30 日)发布博文,宣布推出 Gemini Robotics ER 2 模型,是其面向机器人的最强具身推理(embodied reasoning)模型。 定位方面,该模型可视为机器人的“高级大脑”,协调处理与人类交流、理解物理世界并规划多步骤任务等。该模型后续会向更低层级的视觉-语言-动作 (VLA) 模型分派任务,管控其完成各项任务。 在功能方…... 魔果智讯
- 0
- 0
- 0
-
降价 80%!OpenAI 下调 GPT-5.6 Luna AI 模型费用,性价比超 DeepSeek V4 Pro
7月31日讯 在 GPT-5.6 系列发布(7 月 9 日发布)约 3 周后,OpenAI 公司今天(7 月 31 日)宣布下调 GPT-5.6 Terra 和 GPT-5.6 Luna 两款模型的调用费用,本次调整暂不影响 GPT-5.6 Sol 模型。 援引博文介绍,附上 GPT-5.6 Terra 调整费用如下: GPT-5.6 Terra调整前调整后降幅每 100 万 Token 输入2.…... 魔果智讯
- 0
- 0
- 0
-
马斯克:Grok 4.6 将于 8 月 7 日发布,几周后推出 2.1 万亿参数 Grok 4.7
7月30日讯 SpaceXAI 创始人埃隆 · 马斯克(Elon Musk)当地时间周二在社交平台 X 发文称,Grok 4.6 和 Grok 4.7 即将推出,这意味着该公司将继续保持高频率的大模型发布节奏。 马斯克表示,Grok 4.6 预计将于 8 月 7 日左右发布,模型参数规模达到 1.5 万亿,将在监督微调(Supervised Fine-Tuning,SFT)和强化学习(Reinfo…... 魔果智讯
- 0
- 0
- 0
-
马斯克旗下 SpaceXAI 最智能 AI 语音模型,Grok Voice Think Fast 2.0 登场
7月30日讯 埃隆 · 马斯克(Elon Musk)旗下 SpaceXAI 公司昨日(7 月 29 日)发布 Grok Voice Think Fast 2.0,是其功能最强大、最智能的语音对语音(speech-to-speech) AI 模型。 定价方面,该模型的每分钟音频费用为 0.08 美元(现汇率约合 0.54 元人民币),官方计划将于 8 月 5 日升级 grok-voice-lates…... 魔果智讯
- 0
- 0
- 0
-
阿里云 Qoder 上线实时语音交互智能体 QoderVoice,支持讨论式交互
7月28日讯 今日,阿里云 Qoder 上线实时语音交互智能体 QoderVoice,由全双工语音模型 Qwen-Audio-3.0-Realtime 驱动。用户可随时语音唤醒智能体,通过语音下达指令、讨论方案,智能体实时响应并执行任务。 官方详细介绍如下: 语音指令与任务执行同步进行 用户在 Qoder Quest 模式主界面点击语音入口,即可在任意界面唤起语音助手悬浮窗。发起语音指令后,Qod…... 魔果智讯
- 0
- 0
- 11
-
LM Studio Bionic 智能体工具新增月之暗面 Kimi K3 模型支持,定价方案公布
7月28日讯 智能体工具 LM Studio Bionic 今天新增月之暗面 Kimi K3 模型支持。 据官方介绍,Bionic 提供的 Kimi K3 拥有 2.8 万亿参数,支持 100 万上下文窗口。该模型将托管于美国服务器,并默认启用 ZDR(零数据保留),官方将不会保存用户的提示词、文件以及模型输出内容。 通过 Bionic 使用 Kimi K3 的价格如下: 输入 Token:每百万…... 魔果智讯
- 0
- 0
- 9
-
AMD 最强开源混合专家模型:Instella-MoE 系列 AI 登场,16B 参数、自有 GPU 训练
7月28日讯 AMD 于 7 月 24 日发布博文,宣布推出 Instella-MoE 系列模型,总参数量为 16B,激活参数量为 2.8B,采用 27 层解码器架构,使用 AMD 自研的 GPU 和软件开发而成。 援引博文介绍,AMD 本次推出的 Instella-MoE 系列模型共有 6 个版本: 模型阶段描述Instella-MoE-16B-A3B-Pretrain预训练基于大型多样化训练语…... 魔果智讯
- 0
- 0
- 7
-
纳德拉官宣微软首个 AI 安全模型 MAI-Cyber-1-Flash,跑分超 Mythos 5 和 GPT-5.5 Cyber
7月28日讯 微软首席执行官萨蒂亚 · 纳德拉(Satya Nadella)今天(7 月 28 日)在 X 平台发布推文,宣布其首个网络安全模型 MAI-Cyber-1-Flash,并表示该模型在 CyberGym 基准测试中取得了 95.95% 的成功率,超过 Anthropic 和 OpenAI 的同类系统。 纳德拉表示 MAI-Cyber-1-Flash 是微软首个专门针对网络安全而研发的 …... 魔果智讯
- 0
- 0
- 2
-
AI 大模型周榜:Kimi K3 蝉联前端开发榜全球第一、智能体榜表现突出
7月27日讯 Arena(arena.ai)平台今日发布了 2026 年第 30 周的 AI 大模型排行数据,统计周期为 2026-07-20 ~ 2026-07-26。 本周国产模型表现亮眼,月之暗面旗下的 kimi-k3 蝉联前端开发榜全球第一,同时代码榜杀入 Top 10,成为本期最大亮点。 整体榜单中 Anthropic 旗下多款 Claude 新模型集中入榜,头部梯队集中在 1500 分…... 魔果智讯
- 0
- 0
- 28
-
SpaceXAI 2T 模型 Grok 4.6 预计 8 月 7 日内推出
7月27日讯 SpaceX 创始人兼首席执行官 Elon Musk(埃隆 · 马斯克)当地时间 7 月 24 日(北京时间 7 月 25 日)表示,SpaceXAI 的人工智能模型 Grok 4.6 预计将在那时起的两周内(截至 8 月 7 日)推出,而 Grok 4.7 则将在那时起的四周内(截至 8 月 21 日)推出。 根据埃隆 · 马斯克此前发言,Grok 4.6 参数规模达到 2T 量级…... 魔果智讯
- 0
- 0
- 5
-
阿里开源 0.8B 文档解析模型 OvisOCR2,端到端模型首次超越流水线方法
7月24日讯 今日,阿里云开源发布文档解析模型 OvisOCR2。该模型以 96.58 的综合得分刷新 OmniDocBench v1.6 榜单纪录,成为首个超越流水线方法并登顶该榜单的端到端模型,官方称“这是文档解析领域迎来技术路线的重要突破”。 端到端模型首次超越流水线方法 从官方公告获悉,文档解析是大模型落地的关键基础设施,企业知识库、RAG 检索、智能问答等场景均需将 PDF、扫描件等非结…... 魔果智讯
- 0
- 0
- 15
-
微软最新模型 MAI-Image-2.5-Pro、MAI-Voice-2-Flash 发布:未蒸馏第三方产品,已落地 Bing 及 PowerPoint 等场景
7月24日讯 微软当地时间 7 月 23 日宣布推出两款新的自研 AI 模型,分别为 MAI-Image-2.5-Pro 和 MAI-Voice-2-Flash,目前均已进入公开预览阶段。两款模型属于微软 AI 团队自研模型系列,分别面向高质量图像生成与高并发语音交互场景。 微软表示,过去一年,公司开始开发基于内部训练流程的专用模型,目标是使用经过清理、可追踪、企业级的数据进行训练,不依赖第三方模…... 魔果智讯
- 0
- 0
- 0
-
OpenAI 最强 AI 模型:GPT-6 测试文档曝光,达到通用人工智能水平
7月22日讯 消息源 @daniel_mac8 昨日(7 月 21 日)发布博文,分享了一份未经证实的测试文档内容,预估关联 OpenAI 的 GPT-6 模型(内部代号 Spud)。 消息源称 OpenAI 的 GPT-6 模型将会达到通用人工智能(AGI)水平,在内部计算充足的情况下,不需要使用 Lean,也不需要使用任何特殊测试框架,有 48% 的概率完全自主地、一击即中、解决单位距离问题。…... 魔果智讯
- 0
- 0
- 0
-
阿里千问发布 Qwen-Image-3.0 图像生成基础模型:落字成画,字字如印
7月21日讯 阿里发布最新图像生成基础模型 Qwen-Image-3.0。新模型支持最大 4.5k token 超长输入,可一次生成涵盖公式符号、几何图形、逻辑推导步骤等多元素融合的知识图解、复杂 UI 界面,同时支持 12 国语言和 20 多款字体原生渲染,字字清晰,大幅降低多语言产品海报、影视 / 漫画分镜等“可读可用”商业素材的生产成本。 官方详细介绍如下: AI 图像生成模型的进步有目共睹…... 魔果智讯
- 0
- 0
- 16
-
Sakana AI 推出网络安全模型 Fugu Cyber:领域基准测试表现优于 GPT-5.5-Cyber
7月21日讯 日本人工智能初创企业 Sakana AI 当地时间今日发布了其专为应对现代网络防御的复杂性而打造的 Fugu Cyber 模型。 这一模型在业界最具挑战性的安全基准测试中均取得了卓越的性能:CyberGym 成功率达 86.9%、CTI-REALM 测试成功率达 72.1%,表现甚至优于 OpenAI GPT-5.5-Cyber 和 Anthropic Claude Mythos-P…... 魔果智讯
- 0
- 0
- 15
-
宇树发布 UnifoLM-OminiA-0.3 模型,支持全模态交互理解
7月20日讯 今日宇树科技发布宇树 UnifoLM-OminiA-0.3,单模型统筹家居康养多任务,支持全模态交互理解,全程自主,稳定执行抗干扰。 据消息,根据宇树科技发布的演示视频,该模型能够完成多种实际任务,例如: 物品搬运:将地上的抱枕放到沙发上。 视觉识别与回答:识别抱枕颜色(如白色)、药盒颜色和数量(如三盒药,红、蓝、黄)。 精细操作:将第三层蓝色药盒拿到上面来、把衣服放进脏衣篓、将盘子…... 魔果智讯
- 0
- 0
- 190
-
多模态 AI 模型“神珍”开放,能处理蛋白质、天气等六类科学信息
7月20日讯 据上海科学智能研究院官方微信公众号消息,近日,上海科学智能研究院(下称“上智院”)开放科学多模态基础模型“神珍”(Monkey King Bang, MKB)。模型总参数约 110 亿,面向 DNA、RNA、蛋白质、小分子、地球系统和医学影像六类科学数据,在一个统一模型中支持科学理解与多类结果生成。在扩展科学能力的同时,模型在相关评测中整体保持了基础模型的文本与通用图像能力。 据了解…... 魔果智讯
- 0
- 0
- 164
-
字节发布 Seed Audio 1.0 音频创作模型:支持精细时间控制,音色风格可控、长时稳定
7月20日讯 字节跳动 Seed 官方今日发布了音频创作模型 Seed Audio 1.0,面向完整声音场景,在统一框架下联合建模人声、音效和环境声等多种音频要素,端到端完成影视级音频创作。 官方宣称,声音不再只是画面的补充,而是可以直接参与叙事,在听者脑海中直接形成画面感,做到“听见”即“看见”,其核心能力主要体现在以下方面: 多要素统一编排,支持精细的时间控制:一条 prompt 即可统一编排…... 魔果智讯
- 0
- 0
- 176
-
全球首个千亿参数级!中国气象局启动“风和”模型全球开源计划
7月17日讯 据央视新闻报道,7 月 17 日,在 2026 世界人工智能大会(WAIC)气象专会上,中国气象局发布人工智能气象服务系统“风和”大语言模型,并启动“风和”全球开源计划。 从报道获悉,此举旨在通过开放共享推动气象人工智能走向世界,服务全球防灾减灾合作与可持续发展,同时汇聚开发者、科研机构和国际伙伴共建生态。 “风和”是由中国气象局公共气象服务中心联合雄安人工智能创新研究院、智谱等单位…... 魔果智讯
- 0
- 0
- 154



















































