闲社服务运行正常AI智能体自动化平台
7*24新情报

蚂蚁发布Ling-3.0-flash-Sante:124B医疗MoE支持256K

[复制链接]
bufeng007 显示全部楼层 发表于 2026-9-6 17:06:00 |阅读模式 打印 上一主题 下一主题
【事件概述】
inclusionAI 推出面向健康与医疗任务的 Ling-3.0-flash-Sante,并于 9 月 4 日接入 Vercel AI Gateway 与 OpenRouter。该模型基于 Ling-3.0-flash,采用 124B 总参数、每 token 约 5.1B 激活的 MoE 架构,提供约 256K 上下文和函数调用能力,重点覆盖医学知识推理、专业医疗任务、证据检索、深度研究与多步骤医疗工作流。

【模型与开发者】
模型:Ling-3.0-flash-Sante
开发者:inclusionAI / 蚂蚁百灵团队
官方上线日期:2026 年 9 月 4 日
基础模型:Ling-3.0-flash
架构:MoE,124B 总参数、约 5.1B 激活参数
上下文:Vercel 标注 256K;OpenRouter 精确标注 262,144 token
最大输出:OpenRouter 标注 32,768 token
能力:文本推理、证据检索、函数调用与多步骤工作流
当前形态:第三方网关 API;未见 Sante 专属公开权重仓库

日期核对说明:Vercel 官方更新页和 OpenRouter 官方模型页均记录 2026-09-04 上线。Ling-3.0-flash 基础模型更早已经发布,本轮新闻点是医疗增强版 Sante 的 API 上线,不把基础模型日期或第三方页面抓取日期当成新模型发布日期。

【关键能力与改动】
1. 医疗领域增强:Sante 在 Ling-3.0-flash 的通用能力之上,重点面向医学知识推理、专业医疗问题、循证检索和长流程研究,同时保留通用推理、代码与智能体能力。
2. 稀疏 MoE:模型总参数为 124B,但每个 token 约激活 5.1B 参数。激活参数代表推理时参与计算的稀疏子集,不等于整个模型只有 5.1B 权重,也不能据此推断本地显存需求。
3. 长上下文:约 256K 的上下文适合一次输入多篇摘要、指南片段或较长病历材料,用于比较证据和形成结构化梳理。长上下文只代表容量上限,不保证模型能同等准确地利用每一处信息。
4. 函数调用:OpenRouter 页面确认模型接受 `tools` 与 `tool_choice`,可连接检索、药品数据库或内部知识库。它不支持由 `response_format` 强制 JSON,因此应用仍需做 schema 校验和失败重试。
5. API 兼容入口:Vercel AI Gateway 给出的模型 ID 为 `inclusionai/ling-3.0-flash-sante`,免费专用 ID 为 `inclusionai/ling-3.0-flash-sante-free`,可通过 AI SDK 或兼容的聊天接口调用。
6. 限时试用机制:Vercel 官方说明,标准 ID 在 10 月 4 日前免费,之后开始计费;带 `-free` 的专用 ID 在活动结束后停止服务而不会自动转为付费。免费请求仍会出现在用量与追踪记录中。

【适用对象】
适合医学文献整理、临床指南对比、药物信息初筛、科研问题拆解、病历材料结构化和医疗知识库问答的研发团队,也适合希望验证长上下文加检索工具是否能改进循证回答的研究者。它更适合作为专业人员的辅助分析层,而不是直接面对患者的自动诊疗系统。

【实际影响】
医疗 AI 的难点通常不只是回答一个知识题,而是要从多份材料中找到证据、区分结论强弱、标出冲突并把结果交给后续工作流。Sante 把长上下文、医疗增强和函数调用放在同一 API 模型里,使团队可以测试“检索—比较—引用—形成草案”的连续流程,而不必为每一步切换模型。

不过,当前公开信息主要来自上线公告和网关模型页,没有可下载的 Sante 专属权重、详细模型卡、训练数据说明或完整评测复现材料。因此它目前更像一个可调用的医疗专用服务,而不是可独立审计和本地部署的开放模型。

【官方信息怎么看】
Vercel 官方页确认模型的参数规模、激活参数、上下文、函数调用与面向医疗的用途,但没有给出医疗基准具体分数。inclusionAI 的发布信息称其在多项医疗与检索评测上具备竞争力;在缺少详细表格、评测设置和第三方复核的情况下,本文不引用具体排名,也不把“医疗增强”写成临床安全认证。

OpenRouter 的模型页补充了 262,144 token 上下文、32,768 token 最大输出、函数调用支持和不支持强制 `response_format` 等接口事实。这些是网关当前能力,不应自动外推到未来所有供应商或其他部署渠道。

【限制与使用提醒】
第一,模型不能代替医生,不应独立诊断、开处方、调整剂量、判断急症或决定是否停药。任何影响患者健康的结论必须由具备资质的专业人员结合完整病史、检查结果和当地指南确认。

第二,长上下文不等于完整阅读或可靠引用。模型可能忽略材料、混淆时间顺序、把不同人群的研究结论拼接在一起,或生成不存在的指南条款。应用应保留原文定位、来源链接、发布日期与逐条人工核验。

第三,函数调用会放大错误的实际影响。对电子病历、预约、处方、检验和支付系统,应实行最小权限、只读默认、参数白名单、双人审批和完整审计;不得让模型根据一段自然语言直接执行高风险写操作。

第四,通过 Vercel、OpenRouter 或上游推理供应商调用时,医疗文本会经过第三方基础设施。涉及个人健康信息、真实病历或受监管数据前,应核对数据处理协议、存储区域、日志与训练政策、零数据保留设置和适用的合规要求;没有充分保障时只使用去标识化测试数据。

第五,截至本文核实时,没有看到 Ling-3.0-flash-Sante 专属的官方 Hugging Face 权重或完整模型卡,不能把它描述为已开源,也无法独立检查训练数据和在本地复现实验。基础 Ling-3.0-flash 的开放情况不能自动代表 Sante。

第六,免费属于平台限时活动,不是永久价格承诺。标准 ID 在活动结束后可能开始计费,免费专用 ID 会停止服务;生产接入应设置预算、用量告警和明确的降级模型,避免活动结束后产生意外费用或服务中断。

第七,模型页未声明它通过任何医疗器械监管审批,也未提供真实临床结局验证。面向患者的产品还需要独立的安全测试、偏差评估、红队、医学审核和持续监控。

【官方来源】
Vercel AI Gateway 官方更新:https://vercel.com/changelog/ling-3-0-flash-sante-is-now-available-on-ai-gateway-for-free
OpenRouter 官方模型页:https://openrouter.ai/inclusionai/ling-3.0-flash-sante:free
inclusionAI 官方组织页:https://huggingface.co/inclusionAI
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

快速回复 返回顶部 返回列表