11x 面向销售开发流程的数字员工,用于识别潜在客户、生成个性化外联、持续跟进并预约会议。
Briefs
全部简调
按调研日期倒序排列,共 452 篇。
ARD 用域名锚定的目录与联邦注册表描述、发现和验证智能体资源,为 MCP、A2A、API 与技能提供协议中立的发现层。
Ai2 的 fully-open 语言模型家族,公开权重、训练数据、代码、配方、评测与中间检查点,适合重视可复现研究和模型供应链透明度的团队。
vLLM Project 下面向生成式 AI 推理的云原生开源基础设施,组合网关路由、弹性伸缩、运行时与分布式 KV cache。
面向大型、长期演进代码库的商业 AI 编程工具,以工作区索引和 Context Engine 为代理提供跨文件、跨仓库语义上下文。
OpenAI 在 ChatGPT 中提供的长任务代理,可跨文件、应用与网页制作成品,适合受控的知识工作,但需明确连接器权限、审批点和输出责任。
Anthropic 面向一般用户开放的 Mythos 级模型,强调长时程编码、知识工作与视觉能力,并以分类器和 Opus 4.8 回退控制高风险请求。
Claude Opus 4.7 是 Anthropic 面向复杂编码、智能体、视觉和多步骤专业工作的闭源模型,适合用真实长任务评估质量、成本与安全控制。
围绕拉取请求提供自动摘要、逐行意见与持续对话的 AI 代码审查平台,把生成式 AI 延伸到合并前质量控制。
Cohere 发布的 20 亿参数开放语音识别模型,支持 14 种语言与 API、自托管、Model Vault 交付;导入时应实测口音、噪声、专有名词和未内置的时间戳与说话人分离需求。
Cohere 发布的 Apache 2.0 混合专家模型,面向多语言、多模态和智能体企业任务,可下载权重或在私有环境部署。
Google DeepMind 提出的动态 4D 重建与跟踪模型,用统一查询接口处理点跟踪、点云重建和相机位姿估计。
面向多家庭住宅运营的垂直 AI 平台,把租赁转化、居民沟通、维修、续租与欠款跟进串成连续工作流。
Google 基于 Gemini 3.5 Flash 微调的网络安全模型,聚焦发现、验证和修补软件漏洞,并采取受限试点发布。
Google 开源的命令行工具与技能包,让编码代理能够创建、评测并部署 Google Cloud 智能体项目。
Google Colab CLI 把 Colab 远程运行时带进本地终端,适合脚本执行、临时加速器任务和编码代理工作流,但仍需治理凭据、会话与成本。
Google Photos 的生成式视频编辑功能,以模板完成重打光、背景替换和风格化,面向部分地区的合资格 Google AI 订阅用户。
面向临床人员的 ambient AI 医疗记录产品,把问诊对话转成转录、结构化病历、信件及后续任务。
KServe 面向生成式 AI 推理的 Kubernetes 自定义资源,用统一声明描述模型、工作负载、路由、调度与并行策略。
Lightricks 的开放视频生成模型家族,从 LTX-Video 延伸到同步音视频的 LTX-2,同时提供自托管与产品化入口。
面向业务人员的无代码 AI agent 平台,用触发器、动作和集成把邮件、日历、会议及跨应用任务组织成自动化工作流。
Liquid AI 面向端侧部署的第二代基础模型家族,以卷积与注意力混合架构、较小参数规模和开放权重为核心。
面向大模型推理的开源 KV cache 管理层,把临时缓存变成可跨请求、会话和推理实例复用的分层基础设施。
Meta 面向开发者推出的模型接口,目前以公共预览方式提供 Muse Spark 1.1,支持智能体、多模态、搜索与兼容式 API 接入。
Mistral 将原 Le Chat 与编码代理整合后的统一产品,覆盖长程知识工作、工具连接和远程编码任务。
Mistral Studio 内面向生产级 AI 流程的编排能力,强调耐久执行、可观测性、人工审批与混合部署。
Moonshot AI 为 Kimi 构建并开源的 KV Cache 中心化大模型服务系统,通过预填充与解码分离提高资源利用率。
Muse Image 是 Meta 推出的智能体式图像生成与编辑模型,支持搜索、代码工具、自我修正和多参考图组合,并通过 Meta AI 等产品交付。
面向法律与法规合规的 AI 公司,由法律工程人员把规则转成可执行代理,用于审查内容、流程与 AI 输出。
Cohere 的开放权重代理式编码模型,以较小激活参数支持仓库级修改、终端任务和本地部署,但工程采用仍需独立验证正确性与工具权限。
NVIDIA 基于 Thor 架构公布的两款 Jetson 边缘 AI 模组,面向机器人、视觉代理与自主机器;量产前宜用开发套件仿真验证算力、内存、功耗和软件兼容。
NVIDIA 与众多安全、云、软件及开源机构发起的 AI 安全协作倡议,目标是共建可检查、可运行的开放防御模型、代理框架与工具,当前更适合跟踪贡献与参与试点,不宜当成成熟产品。
面向大型代码库与长任务的开源终端 AI coding agent,以计划、智能上下文和隔离变更审查组织多步实现。
面向业务团队的无代码 AI Agent 与 Workforce 平台,用可视化方式组合工具、知识、任务和多 Agent 协作。
面向企业电话工作流的托管式 AI 语音 agent 平台,覆盖构建、测试、呼叫部署、电信集成与运行监控。
面向投行、投资与其他金融机构的生成式 AI 平台,强调统一金融内容、定制工作流、行业化模型与企业级数据隔离。
腾讯混元团队开放的视频生成基础模型,提供代码、模型权重与多种推理路径,适合有 GPU 工程能力的团队评估本地视频生成。
TPU Developer Hub 汇总 Google Cloud TPU 从架构、训练、后训练到推理、调试和安全的官方资源,适合作为上手与评审入口,而非独立算力服务。
Meta 发布的多模态脑编码研究模型,用视频、音频和文本预测 fMRI 皮层反应,并公开代码、权重与演示供非商业研究使用。
Zed 编辑器内的 AI 编程体验,以 Agent Panel 为核心连接第一方代理、外部代理、多模型提供商及项目上下文。
Stripe 与 OpenAI 共同开发的开放商业协议,为 AI 代理、买家和商家定义商品发现、结账与支付协作接口。
AWS 的托管式企业生成式 AI 助手;现有客户可继续管理部署,但官方已停止向新客户开放。
Anthropic 发布的自动化行为评测框架,从行为定义生成情境、运行对话并评分,用于量化前沿模型的特定行为倾向。
面向模型安全研究的开源审计工具,以多轮模拟、自动评分和人工复核探索欺骗、迎合与权力寻求等风险。
Brain2Qwerty v2 是 Meta 面向非侵入式脑机接口研究的端到端脑信号到文本解码系统。
CHMv2 是 Meta 与世界资源研究所推出的开放模型与全球树冠高度地图,用于森林和城市树木监测。
Anthropic 面向金融机构的行业方案,把 Claude、企业数据连接器、Excel 工作流与预构建技能用于研究、建模和合规分析。
Anthropic 面向生命科学推出的 Claude 行业方案,以科研连接器、Agent Skills 和专用支持覆盖研究到监管工作流。
Anthropic 面向美国经验证 K-12 教师的 Claude 方案,提供课程标准连接、教学技能与教师工作流支持。
Anthropic 面向 Team 与 Enterprise 团队的 Slack 协作代理,可在受控频道中使用组织工具、共享上下文并异步执行任务。
Cloudflare 面向 Workers 推出的 Agent 开发与运行框架,以 Durable Objects 承载身份、状态、实时连接和定时任务。
Google 基于 Gemma 4 推出的实验性开放权重文本扩散模型,以并行去噪生成换取本地低并发场景的更低时延。
Google Labs 的实验性消费者应用,经用户授权连接 Google 服务,每日生成有限数量的个性化图文故事与行动入口。
Factory 面向工程团队推出的软件开发代理,通过命令行和工程系统连接支持代码库理解、代码修改、审查与自动化。
OpenAI 发布的真实工作任务评测,覆盖 44 种职业,以专业人员创建的任务、参考材料、交付物和评分标准衡量模型能力。
Google Cloud 由 Vertex AI 演进而来的企业智能体平台,覆盖模型选择、智能体构建、运行、身份、网关、评测、观测与治理。
Google Gemini API 的统一交互接口,用同一资源模型调用基础模型与专用 Agent,并支持状态、后台任务和执行步骤。
Google DeepMind 的多模态视频生成与编辑模型,可接收文本、图像或视频输入,并通过多轮自然语言保持场景连续地调整输出。
Google 面向手机、平板与笔记本推出的开放权重多模态模型,以嵌套架构和低内存设计支持端侧文本、视觉与音频任务。
OpenAI 发布的计算生物学研究级基准,用合成但现实的脏数据任务测试 AI Agent 的分析路径选择、修正与决策判断。
Genie 3 是 Google DeepMind 的通用世界模型,可从文本生成能随用户操作实时展开的可导航互动环境。
GitHub 的合作伙伴 Agent 接入机制,让已安装并授权的 Agent App 从 Issue、PR 评论或 Agents 界面承接仓库任务。
Agent HQ 是 GitHub 面向多编码 Agent 的统一工作流,把任务分派、进度跟踪、代码审查和企业治理放回仓库协作界面。
GitHub 在 Actions 上提供的智能体工作流,把 Markdown 自然语言任务编译为受权限、网络和安全输出约束的仓库自动化。
Google 提供的开发者知识 API 与远程 MCP Server,将官方开发文档以搜索、全文获取和有依据问答能力交给 AI 编程工具。
Disco 是 Google Labs 的实验性浏览体验,首个功能 GenTabs 会结合打开的网页与目标生成可交互的小应用。
Google 发布的开源 Python 库,用大模型从非结构化长文本抽取结构化信息,并把结果定位回原文以支持核查和可视化。
Google Labs 推出的无代码 AI 迷你应用工具,可把提示词、模型、内置工具与输出步骤连接成可编辑、可分享的工作流。
Google Pics 是由 Nano Banana 驱动的图像生成与编辑工具,支持提示词、参考图和元素级修改。
Google Labs 的 AI 原生设计画布,可从自然语言、图像与代码上下文生成界面、交互原型和前端交付物。
Universal Cart 把 Google 多个入口中的商品汇入统一购物车,并提供价格、兼容性与支付方式辅助。
GPT-Live 为 ChatGPT Voice 提供自然语音轮替、任务发起、进度检查与持续调整能力。
IBM 推出的开放权重语言模型家族,以 Mamba-2 与 Transformer 混合架构降低长上下文和并发推理的内存压力。
Hippocratic AI 面向患者语音交互的医疗专用模型星座,强调非诊断工作流、临床升级、安全与合规。
Mistral 面向 Lean 4 形式化证明与代码验证的开放模型,可通过权重或免费 API 试用。
Llama Stack 起源于 Meta 的标准化 AI 应用接口提案;截至 2026 年 8 月,其官方仓库已更名并转向模型无关的 OGX。
Meta AI Actions 是由 Muse Spark 1.1 驱动、可连接应用并持续执行计划与定时任务的助手能力。
Meta 推出的独立消费者 AI 应用,以语音对话、个性化、创作与发现信息流连接移动端、网页和 Meta AI 眼镜。
MTIA 300–500 是 Meta 面向推荐、训练和生成式 AI 推理持续迭代的自研加速器家族。
Microsoft 面向企业 AI 智能体的控制面,以统一注册表、生命周期治理、身份权限、数据合规和威胁防护管理跨平台智能体。
微软研究院面向低资源语言推出的语音模型与评测体系,以 PazaBench、社区测试和模型微调连接数据、指标与真实使用环境。
微软面向文件、浏览器、终端与 Microsoft 365 的常驻个人智能体预览,强调持续理解优先级并在用户控制下跨应用执行任务。
Mistral AI 面向组织推出的企业助手,整合企业搜索、Agent 构建、数据与工具连接、文档库、自定义模型和混合部署。
Mistral Physics AI 面向工业工程,用几何、边界条件和仿真数据训练模型,辅助设计探索与数字孪生。
Google Cloud 的模型无关运行时安全服务,在提示词、回复和智能体交互进入业务系统前执行威胁与敏感数据检查。
Meta Superintelligence Labs 推出的多模态推理模型系列,支持工具调用、视觉推理和多智能体编排,并通过 Meta AI 与预览 API 提供能力。
NemoClaw 把 Agent、推理服务与 OpenShell 沙箱组合成可安装、可治理的参考栈,重点解决长期运行 Agent 的权限、网络与凭据边界。
Notion 面向团队的可配置代理,以触发器、独立权限和运行日志自动处理问答、分流、汇报与日程等重复工作。
NVIDIA Cosmos 3 系列的 4B 边缘世界模型,面向本地视觉理解、物理推理与机器人策略工作流。
NVIDIA 的开源 Agent 工具库,以插件化工作流连接模型、工具和框架,并提供观测、评测、分析与优化能力。
NVIDIA AI Enterprise 体系中的推理微服务,把模型、优化运行时与标准 API 封装为可在云端或数据中心部署的容器。
围绕多提供商 LLM 接口互操作建立的开放规范,统一请求、响应、工具调用、流式事件和智能体循环中的核心对象。
OpenAI 面向 ChatGPT 应用开发者推出的工具集,基于 MCP 连接后端工具和数据,并允许在对话中呈现交互界面。
Daybreak 为获批防御者提供分级网络安全模型访问,并以受控环境、最小权限和人工监督约束使用。
OpenAI Guardrails Python 是面向 LLM 应用的开源校验库,以配置化管道在输入和输出阶段组合安全、隐私和合规检查。
OpenAI Harmony 是 gpt-oss 模型使用的开源响应格式与渲染器,统一表达角色、频道、推理输出、工具调用和结构化响应。
OpenAI 与 Broadcom 联合公布的首款 Intelligence Processor,围绕大模型推理的计算、内存移动、网络和服务模式协同设计。
OpenAI 公开的模型行为框架,用于说明指令优先级、安全边界、默认行为以及训练和评测的目标。
Google 面向盲人和低视力跑者研究的设备端辅助代理,结合路径分割、Gemma 4 与多代理语音提示。
SAM 3.1 是 Meta 面向图像与视频检测、分割和跟踪的模型更新,重点优化多对象视频处理。
SHADE-Arena 用带有正常主任务和隐藏有害副目标的长程环境,联合评估 Agent 的破坏能力与监控模型的识别能力。
smolagents 是 Hugging Face 的开源 Agent 库,强调小型代码库、代码式行动、模型无关接入和可选沙箱执行。
Thinking Machines Lab 提供的托管后训练服务,让研究者控制数据、损失与训练循环,由平台处理分布式算力和故障恢复。
Windows 为桌面应用提供的智能体注册与发现框架,使应用一次声明交互式 Agent 后,可被支持的系统入口和其他应用统一发现与调用。
Marble 是 World Labs 的多模态世界生成产品,可从文字、图片、视频或粗略 3D 结构创建并编辑可导航的三维环境。
Agent Payments Protocol(AP2)以可验证凭证和授权 Mandate 为核心,为智能体代表用户发起交易提供开放、支付方式无关的信任框架。
Canva 的一体化视觉工作套件,将演示、文档、白板、网站、视频、表格与 AI 辅助创作连接在同一设计中。
Anthropic 面向医疗服务提供方、支付方和健康科技企业推出的行业方案,以 Claude、医疗数据连接器和可定制技能支持授权审核、理赔、照护协调与临床文档等工作流。
Clio Duo 于 2024 年作为 Clio Manage 内置法律业务 AI 助手推出,后续演进并更名为 Manage AI,原有问答、文档分析和操作能力得到延续。
Dropbox Dash for Business 通过连接工作应用,提供跨来源搜索、问答、摘要、内容组织和权限治理,面向信息分散的团队。
Adobe Firefly 中用于情绪板、分镜和视觉探索的生成式协作画布,可在同一空间组织参考素材、调用多种模型并推进团队概念评审。
Google Cloud 面向知识工作者提供的企业搜索、AI 助手与 Agent 平台,强调连接组织数据、按原权限检索并承载可治理的自定义 Agent。
Google 的智能体开发平台,通过编辑器、管理界面和可审阅 Artifacts 协调跨编辑器、终端与浏览器的任务。
Google Labs 的 AI 概念板实验,用文本、图片、自然语言编辑和演示文稿生成支持视觉构思。
OpenAI 面向临床专业任务发布的开放评估基准,以医生撰写并复核的对话和逐题评分标准检验模型在诊疗咨询、文书记录与医学研究中的表现。
LexisNexis Protégé 是嵌入法律产品的 AI 助手,围绕法律研究、起草、分析和个性化工作流提供受来源支撑的能力。
Luma Dream Machine 中的视频生成模型,支持文本或图像驱动的短视频,并提供关键帧、延展、循环和升级分辨率等工作流。
Mistral 在 2025 年推出的双版本推理模型家族,开放权重的小型版与托管的企业版共同验证多语言分步推理路线。
Model Context Protocol 的 2026-07-28 版本将核心改为无状态、自描述请求,引入逐请求能力协商、正式扩展框架及多项授权与弃用调整。
MCP-Universe 是 Salesforce AI Research 开源的智能体开发与评测框架,重点检验模型在真实 MCP 服务器上的多步工具使用能力。
Midjourney 的第七代图像模型,提升文字与图像提示处理,并引入 Draft Mode 与用于主体复用的 Omni Reference。
Mistral 提供的专用 GPU 云与托管基础设施,覆盖裸金属、Kubernetes、Slurm 以及训练和推理运维。
Mistral Studio 的提示词与技能资产管理能力,为企业提供版本、归属、可见性、测试和审计链路。
NLIP 是 Ecma International 发布的应用层通信协议,定义人类与 AI 智能体、或智能体之间交换自然语言及相关数据的标准消息结构。
NVIDIA KVPress 汇集多种训练无关的 KV Cache 压缩方法,并提供基于 Transformers 的统一接口与长上下文评测工具。
OpenCode 是一个曾以 Go 开发的终端 AI 编码助手;原仓库已归档,并说明项目由原作者与 Charm 团队以 Crush 名称继续。
Pika 的视频生成模型版本,通过 Scene Ingredients 接收人物、地点与物体图像,以加强场景控制和跨镜头一致性。
Qwen3 是 Qwen 团队发布的开放权重模型系列,通过思考与非思考模式切换覆盖推理、通用对话、工具调用和本地部署场景。
Runway 的生成式视频模型系列,利用图像参考与文字指令生成短镜头,重点解决角色、地点、物体和视觉风格的一致性。
UiPath Maestro 用 BPMN 2.0 描述并治理跨 AI 智能体、RPA 机器人、API 与人工任务的长流程。
AssetOpsBench 用工业资产运维场景、专职智能体和多智能体编排蓝图,帮助团队构建并评估面向 Industry 4.0 的智能体系统。
Thomson Reuters 的专业级生成式 AI 助手升级,将法律内容、文档分析、专业技能和跨产品集成组织进复杂工作流。
Charm 维护的源码可见终端编程智能体,可连接多类模型、代码上下文、语言服务器和 MCP 工具,在命令行中协助开发。
Envoy AI Gateway 在 Kubernetes 与 Envoy Gateway 之上统一连接多种模型服务,为生成式 AI 请求提供路由、认证、策略和可观测能力。
Fin 2 是 Intercom 在 2024 年发布的第二代客服 AI Agent,强调知识、行为、洞察与多渠道控制,并采用 Anthropic Claude。
Kilo Code 是开放源码的编程智能体平台,可在 IDE、终端及其他入口中生成和修改代码、执行命令、检查结果,并连接多种模型与工具。
Llama 3.2 是 Meta 于 2024 年发布的模型家族,包含面向端侧文本任务的 1B、3B 模型,以及支持图像理解的 11B、90B 视觉模型。
Llama 3.3 70B Instruct 是 Meta 于 2024 年 12 月发布的 70B 文本指令模型,提供开放权重与长上下文能力,但使用者需遵守专用许可证并自行承担部署与安全治理。
OpenTelemetry GenAI 语义约定为模型调用、Agent、指标、事件和追踪定义共同字段,帮助不同框架与后端交换可观测数据。
π0 是 Physical Intelligence 发布的通用机器人策略原型,以视觉、语言和机器人状态为输入,通过流匹配生成连续动作。
Serena 是面向编码智能体的开源 MCP 工具包,通过语言服务器提供符号级检索、编辑、引用查找与项目记忆。
Sierra Research 提出的双控制对话智能体评测基准,用真实领域任务检验用户和智能体都能采取行动时的协作表现。
Universal Commerce Protocol 通过可发现的能力、模块化结账与订单原语,为智能体、平台、商家和支付参与方提供开放的商业互操作层。
vLLM 社区维护的昇腾硬件插件,为大语言模型在 Ascend NPU 上提供与 vLLM 对接的推理和服务路径。
Zendesk 面向客户与员工服务的 AI 平台,将 AI Agents、知识、动作与集成、治理以及度量组织到完整解决流程中。
Chitu(赤兔)是 thu-pacman 团队开源的大模型推理框架,重点覆盖多种硬件、从单机到集群的部署与生产服务。
Gemma 3 是 Google DeepMind 推出的开放权重模型家族,提供多种参数规模,并在较大版本中支持图文输入、长上下文和多语言。
Microsoft Agent Framework 是面向生产环境的开源智能体框架,支持在 .NET 和 Python 中构建智能体及图式多智能体工作流。
Muse 是微软研究院面向游戏创意探索推出的首个世界与人类动作模型,可生成游戏画面、控制器动作或两者组合。
MLE-bench 是 OpenAI 开源的机器学习工程智能体基准,以 75 个 Kaggle 竞赛任务衡量数据准备、模型训练、实验和提交能力。
A2A 协议的扩展机制,让智能体通过唯一 URI 声明、协商并启用领域能力,同时保持核心协议兼容。
Adobe Firefly 的生成式视频模型,支持文本生成视频、图片生成视频,并接入 Firefly 与 Premiere Pro 创意流程。
Agent Network Protocol 试图用开放协议连接互联网中的智能代理,覆盖身份、能力描述、发现、消息与应用协作,但生产采用仍需验证成熟度和信任边界。
AlphaGenome 以长 DNA 序列预测多类功能输出并辅助评估变异效应;研究使用需控制输入、版本与证据链,不能直接替代临床判断。
ARC-AGI-2 以少量示例和网格变换任务评估系统对陌生规则的归纳与迁移能力,适合作为推理评测组成部分,而非通用智能单一结论。
Asana 的无代码 AI 工作流构建器,用自然语言规则处理任务检查、分类、路由、提醒与内容生成。
Box AI Studio 让企业围绕 Box 内容配置定制 AI 代理;落地重点是内容权限、模型选择、发布范围和可复核的业务验收。
BrowseComp 用难检索、短答案任务测试浏览代理的持续搜索与推理能力;使用时应防止数据泄漏,并把它与真实业务评测分开解读。
Cactus 是面向手机、可穿戴设备和边缘硬件的 AI 推理引擎,以自有计算图、ARM 优化内核和多语言绑定支持文本、语音、视觉及工具调用,并可按置信度转交云端。
Anthropic 于 2025 年发布、现已从自营 API 退役的混合推理模型,适合作为模型迁移与评测样本。
Anthropic 于 2025 年推出的 Opus 4 与 Sonnet 4 模型家族,支持即时响应、扩展思考和工具调用。
Devin 2.0 将编码代理组织为可并行委派和集中检查的软件任务工作区,适合边界清楚的工程工作,但合并责任仍需由人承担。
Dia 是基于 Chromium 的 AI 原生浏览器,可结合标签页与连接工具的上下文完成问答、整理和工作辅助。
Gordon 是嵌入 Docker Desktop、CLI、文档和 Docker Hub 的 AI 助手;安全落地的关键是限定目录与权限,并逐项审批会改变环境的动作。
Evo 2 从大规模基因组序列学习跨物种模式,可用于变异效应评估和序列生成研究,但输出不能替代实验、临床与生物安全审查。
Google Firebase 的云端 Agent 开发环境;仍为 Preview,但已停止新工作区创建和新用户注册。
FutureHouse 提供的科研 AI 代理平台,通过网页和 API 支持文献检索、综述与实验规划辅助。
Gemini 2.0 是 Google 于 2024 年底发布、面向智能体时代的多模态模型家族,强调原生工具调用与低延迟 Flash 路线;其 Gemini API 端点已于 2026-06-01 停用,现更适合作为架构演进案例而非新项目选型。
Gemini 2.5 Pro 是 Google 的思考型多模态模型,适合复杂代码、文档与长上下文分析,但上线前仍需按真实任务验证质量、延迟和成本。
GitLab 的 DevSecOps 智能体编排平台,让开发者在代码、议题、合并请求与流水线上委派并监督多步任务。
Goose 是提供桌面端、命令行和 API 的本机开源智能体,可连接多种模型与 MCP 扩展执行工作流,但必须通过权限隔离和任务级验收控制风险。
HealthBench 是 OpenAI 发布的医疗对话模型评估基准,以多轮场景和医生编写的细粒度评分标准衡量准确性、安全性、沟通与情境适配,并提供 Consensus 和 Hard 子集及参考实现。
MCP 在 2025-03-26 规范中加入基于 OAuth 2.1 的授权框架,用于 HTTP 传输下的受限服务访问。
Streamable HTTP 是 MCP 在 2025-03-26 规范中引入的远程传输方式,以单一 HTTP 端点统一消息提交与可选 SSE 流,替代旧版 HTTP+SSE,并明确了会话恢复、版本兼容和基础安全要求。
微软研究院的大气基础模型,通过异构地球系统数据预训练与任务微调支持天气、空气质量、海浪和热带气旋预测。
nano-vLLM 是一个轻量、可读的 vLLM 风格推理实现,适合教学、代码研读和受控实验,不宜未经压测直接替代成熟生产引擎。
Opera Neon 是 Opera 推出的智能体浏览器,把页面理解、本地网页操作和云端创建任务组合在同一产品中,适合评估浏览器内任务自动化,但上线前应重点验证权限、隐私与人工接管。
Oracle AI Agent Studio 嵌入 Fusion Cloud Applications,用于创建、扩展、验证和部署企业代理及多代理流程,落地重点是权限、业务对象与审计。
OpenAI 发布的研究复现评测,要求 AI Agent 从论文理解、代码实现到实验执行完成端到端任务。
Perplexity 推出的 AI 原生浏览器,把检索、页面理解和受监督的网页操作放进同一浏览环境。
SAP Build 中面向企业的低代码 AI 能力工作台,用于设计、部署和管理 Joule 技能与代理。
Terminal-Bench 用隔离终端环境和可验证任务评估智能体完成真实工作的能力,适合比较代理系统,但结果高度依赖任务版本与运行环境。
面向 Kubernetes 集群的 vLLM 生产参考实现,组合推理引擎、请求路由和可观测组件。
vLLM Semantic Router 在模型服务前按请求语义选择模型、工具与策略,适合多模型推理平台,但需要用业务流量校准路由并保留安全回退。
Zoom AI Companion 2.0 把持续侧边栏、跨工作区上下文与行动能力带入 Zoom Workplace,适合会议后续与信息整理,但依赖管理员配置和数据治理。
Rovo Dev 处于 Atlassian 的企业 AI 与协作体系中;落地关键是连接器权限、知识边界与人工审批,而非默认开放全部企业信息。
Microsoft BitNet.cpp 是面向 1-bit 语言模型的开源推理框架,官方仓库提供本地构建、模型运行和基准工具。
Boltz-1 为蛋白质及相关生物分子结构预测提供开放模型与代码,适合具备计算生物学验证能力的研究团队复现和集成。
Chai-1 将蛋白质、小分子及其他生物分子信息纳入统一结构预测流程,适合科研团队评估候选复合物,但实验验证仍不可替代。
ChatGPT 的代理式任务能力,应以最小权限、人工确认和可回放记录方式接入工作流。
Claude 3.5 Haiku 曾面向低延迟、高吞吐任务提供轻量模型选择,现已进入历史生命周期,存量系统应以迁移与回归验证为重点。
Copilot Studio autonomous agents 让企业智能体按事件主动运行并连接业务系统,价值取决于权限、触发条件和人工接管是否可控。
DeepEP 为混合专家模型训练与推理提供高吞吐、低延迟的 GPU 通信内核,适合能控制并测量底层分布式环境的平台团队。
3FS 是面向 AI 训练与推理工作负载的开源分布式文件系统;应先在隔离集群验证数据加载、检查点与故障恢复。
FlashMLA 提供针对多头潜在注意力的高性能 CUDA 内核,适合有明确硬件、模型结构与基准能力的推理基础设施团队评估。
面向高难度数学推理的评测基准,用于比较模型在可验证复杂问题上的表现。
Google 发布的开源终端 AI 代理工具,用于辅助开发者处理代码与任务。
Google DeepMind 的具身 AI 模型方向,面向机器人感知、推理和动作任务的研究与受控试点。
GitHub Copilot coding agent 可将已定义任务转为代码改动和拉取请求;应由仓库规则、持续集成和人工合并共同约束。
Google 的 Agent Development Kit 用于构建代理应用,应通过角色隔离、工具授权和评测控制风险。
Google 面向企业检索和 Agent 工作流的产品形态,重点在于连接器、权限继承和可审计使用。
Doppl 曾让用户通过本人照片和服装图生成虚拟试穿效果,已于 2026 年 4 月停止服务,其价值主要在产品复盘与迁移经验。
Google Flow 将提示词、素材与镜头生成放入连续的影视创作流程,适合评估 AI 视频从概念预演到可交付样片的实际价值。
Google 的异步编码 Agent 产品,适合在分支、测试和人工审阅都明确的任务中试用。
Google Whisk 曾让用户用主体、场景与风格图像进行视觉混合;独立入口现已转向 Google Flow,适合作为生成式创作方法复盘。
GPT-4.1 系列曾以长上下文、编码和指令遵循进入 OpenAI API,当前选型必须结合官方模型状态与替代路径重新评测。
GPT-4.5 曾以更自然的通用对话与知识能力进入预览,但现阶段更适合作为模型选型和退役迁移案例,而不是新系统依赖。
NVIDIA 发布的人形机器人基础模型与开发资源,应在仿真、隔离权限和安全验收下评估。
HubSpot 面向客户平台推出的 AI 功能集合,适合在受控权限和人工复核下处理客户运营任务。
Humanity's Last Exam 用专家级跨学科问题测试前沿模型的知识与推理边界,适合研究比较,但不能单独代表产品可靠性。
JetBrains Junie 在 IDE 与 CLI 中规划、修改和验证代码任务,适合重视项目上下文与人工审阅控制的软件团队。
Kiro 用规格、任务拆解和自动化 hooks 把 AI 编程从即时对话推进到可追踪的工程流程,适合重视需求与实现一致性的团队。
面向分布式大语言模型推理服务的开源基础设施项目。
llms.txt 建议网站在根目录提供简洁的 Markdown 导航文件,帮助语言模型找到高价值内容,但它不是访问控制或收录保证。
Microsoft 面向临床文档和工作流的语音 AI 助手,强调由临床人员复核生成内容。
NLWeb 让网站把既有结构化内容转化为可对话、可被智能体调用的接口,关键价值在内容治理与可控接入,而非单纯增加聊天框。
NVIDIA Cosmos 提供物理 AI 的世界基础模型、数据处理、训练与评测框架;应先用于离线数据和闭环仿真,不能直接替代现场安全控制。
NVIDIA 的开源分布式推理编排栈,面向多节点模型服务的部署与运行管理。
NIXL 为分布式 AI 系统提供统一的数据传输接口与插件机制,重点服务 KV 缓存等跨内存层移动,价值取决于真实拓扑下的端到端验证。
用于组织智能体、工具、交接和追踪的 OpenAI 开源 SDK。
OpenAI Codex CLI 是在终端运行的开源编码 agent,OpenAI 将其定位为可读取、修改和运行本地代码任务的开发工具。
面向多来源研究任务的 OpenAI 产品形态,关键在于来源可追溯、结论复核和外部交付控制。
OpenAI o1 是 OpenAI 在 2024 年推出的推理模型系列,公开材料强调其在回答前投入更多推理,并通过 ChatGPT 与 API 提供。
OpenAI 的推理模型,适合在受控评测、工具权限和人工复核框架中评估。
OpenAI 推理模型的任务评估与受控工具协同实践,适合从可复核场景开始验证。
OpenAI 的 o4-mini 推理模型,应在固定评测、工具控制和人工复核框架中使用。
OpenAI 的浏览器代办型 AI 产品,适合从可观察、可确认的低风险任务开始使用。
面向工具调用和多轮任务的 OpenAI API 接口,用于构建可受控的 Agent 应用。
RE-Bench 用受控研究工程任务比较人类与模型代理表现,适合补充研发风险评测,而非替代内部上线验证。
Salesforce Agentforce 是嵌入 Salesforce 平台的企业 agent 产品,官方材料将其用于销售、服务、营销和商业等业务流程中的受控自动化。
ServiceNow AI Agent Studio 用于在 ServiceNow 平台构建和管理企业 AI 代理,重点在工作流接入、职责边界与集中治理。
用于衡量模型短事实问答可靠性的公开评测与参考实现。
SWE-bench Verified 是经人工核验的软件工程评测子集,用于更可靠地衡量模型或 agent 解决真实 GitHub issue 的能力。
SWE-Lancer 用真实自由职业软件工程任务和经济价值衡量模型表现,适合研究编码能力,但不能替代企业代码库中的安全与维护验收。
WebMCP 探索由网站直接声明可供浏览器 AI 代理调用的结构化工具,以降低纯视觉自动化的脆弱性,但仍需按演进中的标准治理。
Agno 是用于构建 AI agent 与工作流的开源框架。
Browser Use 是用于让 AI agent 执行浏览器操作的开源开发工具。
Dust 是面向团队知识与工作流程的 AI 助手平台。
Flowise 是用于搭建 LLM、agent 与自动化流程的开源可视化工具。
Guardrails AI 是用于校验与约束 LLM 输入输出的开源开发框架。
Langflow 是用于可视化构建 AI 应用流程的开源开发工具。
Langroid 是面向语言模型应用与多智能体协作的开源 Python 框架。
marimo 是以 Python 文件为基础的响应式开源笔记本工具。
Microsoft Presidio 是用于识别与处理文本中敏感信息的开源工具。
MindsDB 是用于连接数据源、模型与应用工作流的开源平台。
OpenHands 是面向软件开发任务的开源 AI agent 平台。
Private AI 是面向文本敏感信息识别与处理的隐私保护平台。
Qdrant 是面向向量相似度检索与过滤的开源数据库。
Traceloop 是用于追踪和观测 LLM 应用执行过程的工具。
Unstructured 是用于将非结构化文件转换为可供下游处理的数据的工具与平台。
Weaviate 是面向向量检索与 AI 应用数据访问的数据库平台。
AgentOps 是面向团队的 Agent 可观测性 产品。
Airbyte 是面向团队的 数据集成与同步 产品。
AutoGen 是用于构建可协作 agent 与多 agent 工作流的开源框架。
Axolotl 是用于语言模型后训练与微调的开源工具。
BentoML 是用于将 AI 模型封装为可部署服务的开源 Python 框架与工具链。
Cal.com 提供面向日程、预约与平台嵌入场景的 API、OAuth 和调度工作流。
Captions 是面向创作者的 AI 视频生成与编辑产品。
Clay 是面向营收与销售团队的数据、研究和工作流编排产品。
Composio 为 AI Agent 提供应用连接与工具集成能力。
CrewAI 是用于组织 AI agent、任务与工作流的开源框架。
Dagster 是用于数据资产与工作流编排的产品。
dbt 是用于数据转换与分析工程的产品或开源项目。
Descript 是用于音视频编辑与转写的 AI 创作产品。
DSPy 是将语言模型任务写成模块与签名,并以优化器改进提示和权重选择的开源框架。
Evidently 是用于评估、测试和监控 AI 与数据系统的开源工具。
fal 是用于生成式媒体模型推理的产品。
Gamma 是用于生成演示、文档和网页内容的 AI 创作产品。
Granola 是一款以本地音频为入口、用于整理会议笔记的 AI 记事产品。
Haystack 是用于构建检索增强生成、管道和 agent 应用的开源框架。
Higgsfield 是面向创作者的 AI 视觉内容生成产品。
Hightouch 是面向企业数据激活与业务工作流的产品。
Hume AI 提供面向语音与表达交互的 AI 开发平台与 API。
Inspect AI 是用于构建、运行和分析 AI 模型评测任务的开源框架。
Instructor 是将大语言模型输出接入类型、校验与重试工作流的多语言开源库。
Khanmigo 是 Khan Academy 面向学习者和教育者提供的 AI 辅助产品。
LangGraph 是用于Agent 与状态化工作流开发的产品或开源项目。
LiteLLM 是将多家模型接口统一到代理与 SDK 层的开源项目。
llama.cpp 是以 C/C++ 实现的开源 LLM 推理项目,面向本地和异构硬件上的模型推理与服务。
Lovable 是面向团队的 AI 应用构建 产品。
LTX Studio 是面向影视与广告创作流程的 AI 视频生产平台。
Luma AI 的 Dream Machine 是面向创作者的图像和视频生成产品。
Mastra 是用于AI Agent 应用开发的产品。
MCP Inspector 是用于测试和调试 Model Context Protocol 服务器的开源开发者工具。
Mem0 是用于为 AI 应用管理和检索记忆信息的开发工具。
MLflow 是用于机器学习实验与模型生命周期管理的产品或开源项目。
n8n 是用于连接应用、服务与 AI 能力的工作流自动化平台。
Ollama 是面向本地运行和调用语言模型的开源工具与服务接口。
Open WebUI 是面向本地与外部模型服务的可自托管聊天界面。
OpenAPI Specification 是描述 HTTP API 的开放规范。
OpenPipe 是用于AI 应用微调与评测的产品。
OpenRouter 提供面向多家模型的统一 API 与路由服务。
OpenTelemetry 是用于生成、收集和导出遥测数据的开源可观测性框架与规范。
Phoenix 是用于 LLM 应用追踪、评测与实验分析的开源可观测性工具。
Pika 是面向创作者的 AI 视频与创意实验产品。
Portkey 是面向团队的 AI 网关与可观测性 产品。
PostHog 是用于产品分析与实验的产品。
Prefect 是面向团队的 数据工作流编排 产品。
Pydantic Logfire 是面向 AI 应用与常规服务的可观测性平台,以 OpenTelemetry 为基础汇集追踪、指标和日志。
PydanticAI 是 Pydantic 团队维护的开源 Python Agent 框架。
Replit 是浏览器内的开发与 AI 应用构建平台,官方文档将其工作流描述为从想法、提示到构建、发布和分享。
Roo Code 是面向 IDE 的开源编码 Agent。
Spline 是用于交互式三维创作的产品或开源项目。
Suki 是面向临床文档工作流的环境式 AI 产品与 API。
Tactiq 是用于在线会议转写与会议记录的 AI 产品。
Tavily 是面向 AI 应用与 Agent 的网页搜索和研究 API。
Temporal 是用于持久化工作流编排的产品或开源项目。
Trigger.dev 是用于后台任务与工作流开发的产品。
Unsloth 是用于本地运行和微调语言模型的开源工具项目。
W&B Weave 是用于 AI 应用追踪与评测的开发平台。
Agent Skills 是为 AI agents 交付可发现能力和专业知识的标准化格式。
AGENTS.md 是为代码代理提供项目级说明的开放文件约定,可把构建、测试和代码库约束放在可预测的位置。
Ambience Healthcare 是面向临床文档和编码流程的医疗 AI 平台,服务对象包括临床、信息学与业务团队。
Anthropic 面向科研人员的可定制 AI 工作台,整合常用工具、软件包和计算资源。
Cline 是一个可在 IDE 和终端中运行的开源编码 Agent,并提供 SDK。
DeepEval 是用于构建、运行和管理 LLM 评测的框架与平台。
DeepSeek 在 API 中于 2025 年末部署的 V3.2 模型版本,分为非思考与思考模式,并已被 V4 系列替代。
Freed 是面向临床记录的 ambient AI scribe 和临床助手,官网列出笔记、摘要、编码和信件等输出。
garak 是用于探测大语言模型与对话系统脆弱性的开源命令行扫描工具。
Google 在 Gemini API 中提供的 Gemini 3 系列 Pro 预览模型,面向复杂推理、代码和多模态理解任务。
Google 通过 Interactions API 提供的研究 Agent,可异步规划、搜索、阅读并输出带引用的长报告。
Z.ai 开源的多模态模型系列,覆盖文本、图像、视频和文件输入,并加入原生函数调用能力。
Z.ai 面向编程 Agent、工具使用和复杂推理更新的开放权重模型,可通过 API 或本地推理框架使用。
Krea 是面向创作者的 AI 图像、视频和 3D 创作套件,提供实时生成与编辑入口。
Legora 是面向法律专业人士的协作式 AI 平台,官网列出研究、起草、审阅和工作流等产品能力。
MCP Apps 是 Model Context Protocol 的扩展方向,用于让 MCP server 提供可在 host 内渲染的交互式界面。
MCP Registry 是 Model Context Protocol 生态用于发布和发现 MCP server 元数据的官方注册表项目。
Mistral 面向企业构建基于专有知识的定制前沿模型的服务。
Mistral 的文档理解模型,输出文本、位置框、区块类别和置信度,面向企业检索与文档自动化。
Mistral 开源的生产搜索管线框架,将数据摄取、检索和评测放在统一接口下。
Mistral 发布的开放模型,将推理、多模态理解和 Agent 编程能力合并到同一 Small 系列模型中。
Nabla 是面向临床文档工作流的环境式 AI 助手,并提供生成临床笔记的 API。
NVIDIA NeMo Guardrails 是为 LLM 应用添加可编程 guardrails 的开源 Python 库。
OpenAI 用于构建、部署和优化 agents 的工具组合,其中部分产品已宣布停止。
OpenAI 面向企业构建、部署和管理 AI agents 的平台。
OpenAI 面向企业语音和聊天 agents 的部署与持续改进产品。
OpenInference 是构建在 OpenTelemetry 之上的 AI 应用可观测性语义约定与配套开源实现。
Promptfoo 是用于评测、红队测试和比较 LLM 应用输出的开源工具与商业平台。
Qwen 团队开源的终端 AI 编码 Agent,支持交互、脚本、IDE、SDK 与实验性 daemon 模式。
Mistral 面向具身导航的 8B 模型,以单个 RGB 摄像头和自然语言指令驱动机器人移动。
面向医疗机构的临床对话 AI 平台,把医患对话转成可审阅的临床记录草稿,并接入 EHR 工作流。
Agent Communication Protocol,面向 AI agents、应用和人类协作的开放通信协议,目标是让不同框架和平台里的 agent 能用标准接口互操作。
Agent-User Interaction Protocol,面向 AI agents 与用户界面的开放、轻量、事件式连接协议,解决 agent 后端和前端 UI 的实时协作问题。
运行在终端里的开源 AI 结对编程工具,围绕本地 Git 仓库、代码库地图、自动提交和多模型接入组织开发流程。
围绕 Ray 生态构建的 AI 计算平台,服务分布式训练、批量推理、模型服务、LLM 与生成式 AI 工作负载。
面向 AI 工程师和领域专家的开源数据协作工具,用于构建、整理和迭代高质量训练与评测数据集;当前主仓库已进入成熟维护状态,不再规划新增功能。
面向生产级 AI 推理的平台,围绕 Truss、Baseten Inference Stack 和 Chains 提供自定义模型部署、扩缩容、低延迟和 compound AI 工作流能力。
StackBlitz 推出的浏览器内 AI 全栈应用构建工具,用户可以通过提示生成、运行、编辑和部署 web 应用。
AI observability 与 evals 平台,用于追踪生产 agent、运行系统化评测、捕捉质量回归,并把 prompt、数据集、scorers 和实验流程连接起来。
围绕 wafer-scale AI 芯片构建训练与推理基础设施的公司,核心卖点是用超大芯片和云服务提供低延迟、高吞吐的 AI 计算。
面向消费者的 AI 角色聊天和互动娱乐平台,用户可以和社区创建的 AI Characters 聊天、角色扮演、讲故事,并围绕青少年安全持续加护栏。
Anthropic Opus 档位的新一代模型,定位为日常可用的高能力模型,强调 coding、agent、knowledge work、computer use 和更高的成本效率。
Anthropic 在 2026 年 6 月发布的 Claude Sonnet 系列新模型,定位于兼顾前沿能力、成本和速度,重点覆盖代码、agent、长任务与企业工作流。
开源 AI 编程 agent,提供 VS Code、JetBrains 和 CLI 入口,强调自定义模型、上下文和团队可共享配置;官网显示项目已加入 Cursor。
面向 AI 训练、推理和应用开发的专用云平台,核心优势是围绕 GPU/加速计算构建的基础设施和托管服务。
面向联络中心的 AI 平台,把 AI Agent、Agent Assist、Conversation Intelligence 和 coaching 放在同一套客户对话系统里。
面向企业客户体验的 AI concierge / support agent 平台,强调用 Agent Operating Procedures 管理 agent 行为,并覆盖聊天、语音、邮件、短信等客服渠道。
DeepSeek 在 V3 之后发布的混合推理模型版本,同时支持 thinking 与 non-thinking 模式,并强化工具调用和多步 agent 任务。
DeepSeek V4 系列中的 Pro 档模型,官方资料披露 1.6T 总参数、49B 激活参数、1M 上下文,并通过 API 与开源仓库分发。
Google DeepMind 在 2026 年 7 月发布的 Flash-tier Gemini 模型,定位为高效率 workhorse model,强调 coding、knowledge work、多模态和 token efficiency。
Google DeepMind 发布的新一代 Gemma 开放模型家族,面向高级推理、agentic workflows、本地部署和多模态能力。
面向 AI agent 和 LLM 应用的评测、测试与 red teaming 平台,包含企业 Hub 和开源 Python library。
OpenAI 在 2026 年 7 月发布的 GPT-5 系列增强模型,主打更强推理、代码、长上下文与 agentic tool use,并通过 API 与 ChatGPT 入口提供。
OpenAI 发布的开放权重推理模型之一,gpt-oss-120b 面向复杂推理、agentic tasks 和本地/自托管部署,并以 Apache 2.0 许可开放。
OpenAI gpt-oss 系列中的较小开放权重推理模型,官方资料强调可在 16GB 内存内运行,适合本地、边缘和快速迭代场景。
SpaceXAI / xAI 的新一代 Grok 模型,定位为面向 coding、agentic tasks 和 knowledge work 的 frontier model,并进入 API、Grok Build、Web、移动端和 X。
围绕自研 LPU 推理芯片和 GroqCloud 提供高速、低成本 LLM 推理服务,主打 public、private 和 co-cloud 部署形态。
面向金融和高风险专业服务场景的 AI 平台,核心产品 Matrix 用多 agent / 文档分析方式处理大量材料,并强调引用、可追踪和适合金融格式的输出。
Stanford CRFM 推出的语言模型整体评测项目,强调用多场景、多指标和透明报告评估模型能力、局限与风险;GitHub 仓库显示其已于 2026-06-01 进入维护模式。
AI 视频生成与翻译平台,覆盖 avatar generation、voice cloning、captions、translation、企业本地化和开发者 API。
开放 ML 生态的核心平台,托管模型、数据集和 Spaces,并通过 Inference Providers、Hub 客户端和企业能力连接研究、开源与生产部署。
Moonshot AI 的 Kimi K2 / K2.x 模型线,主打长上下文、代码、工具调用和 agentic 任务,并同时提供 API 与开放权重入口。
Moonshot AI 的 Kimi K2.6 模型,官方强调编码、长程执行、agent swarm、多模态输入和 256K 上下文,是 Kimi 工作流能力的核心模型之一。
Moonshot AI 发布的开放权重原生多模态 agentic 模型,官方模型卡标注 2.8T 参数、1M-token 上下文,并面向长周期代码、知识工作与推理任务。
已被 Check Point 收购并整合进其 AI Security 体系的生成式 AI 安全平台,重点防护 prompt injection、jailbreak、数据泄露和 agent 运行时风险。
面向 AI 训练和推理的 GPU 云与专用集群服务,核心卖点是把 NVIDIA GPU 算力以实例、集群和更大规模基础设施形式交付给模型团队。
围绕 LLM 应用和 agent 构建的开发生态,包含开源 LangChain / LangGraph,以及 LangSmith 等平台工具。
开源 AI engineering / LLM observability 平台,把 traces、monitoring、datasets、experiments、evals 和 prompt 管理连接成一个持续改进循环。
Meta 发布的开放权重基础模型系列,Llama 4 引入原生多模态和 MoE 架构,形成了全球最重要的开源权重模型生态之一。
从开源 RAG / 数据框架扩展到 LlamaParse、LlamaCloud 和 Workflows 的文档智能与 agent 应用开发平台。
Google DeepMind 的音乐生成模型,Lyria 3.5 可从文本生成高质量音乐音频和歌词,并在 Google Flow Music 中分发。
Meta 面向普通用户的 AI 助手入口,覆盖问答、图片生成、任务辅助,并与 Meta 的社交应用和 AI 研究生态相连。
MiniMax 在 2026 年 6 月发布的 M 系列模型,官方资料强调 coding、agentic tasks、1M context、原生多模态和 MSA 架构,并提供 API 与开放模型相关入口。
法国 AI 公司,提供开源权重与商业模型、Le Chat、La Plateforme,以及面向企业的 AI agents、应用开发和部署能力。
Mistral AI 发布的 128B dense 开放权重旗舰模型,统一覆盖 instruction-following、reasoning、coding、multimodal 和 agentic use cases。
面向企业员工的 AI Assistant 平台,帮助员工跨业务系统搜索答案、自动执行任务,并通过 Agent Studio 扩展企业 AI agents。
OpenAPI 本身不是 LLM 协议,但其机器可读的 HTTP API 描述能力,正在成为让 AI agents 理解和调用 REST API 的重要基础格式。
面向医疗专业人士的 AI 临床决策支持和医学搜索平台,强调引用医学证据、医学期刊与指南来源,并仅供经过验证的医疗专业人士使用。
AI 评测与安全平台出身的公司,当前官网叙事转向 simulation research and infrastructure,同时仍保留评测、guardrails 和 agent 评估相关公开材料。
Microsoft Phi 系列的小语言模型之一,Phi-4 以 14B 参数规模强调复杂推理、数学、代码和低成本/低延迟场景。
Inflection AI 推出的个人 AI / 情绪智能助手,主打自然、支持式对话、灵感启发和轻量决策陪伴。
Qwen 团队发布的开放权重代码模型,面向 coding agents 和本地开发,在 Qwen3-Next 架构基础上做 agentic coding 训练。
面向 LLM 应用的开源评测与测试框架,重点覆盖 RAG、agent、指标设计、测试集生成和持续评测循环。
面向开发者的云端模型运行平台,用户可以通过 API 运行社区模型、官方模型,或部署自己的自定义模型。
老牌 AI 陪伴应用,主打可定制虚拟伴侣、文字/语音/视频对话、记忆和订阅功能。
Replit 内置的 AI app-building agent,把自然语言需求、在线开发环境、运行、协作和部署放在同一个浏览器工作流里。
面向企业知识、学习和工作自动化的 AI 平台,包含 Sana Learn 和 Sana Agents,并已成为 Workday 体系的一部分。
ByteDance Seed 团队发布的 36B 开放权重模型系列中的指令版本,强调长上下文、推理、agent 能力和开发者友好部署。
面向大语言模型和多模态模型的开源高性能推理服务框架,强调低延迟、高吞吐、OpenAI 兼容接口和从单 GPU 到分布式集群的部署。
面向企业客户体验的 AI agent 平台,帮助企业构建可跨聊天、短信、WhatsApp、邮件、语音和 ChatGPT 等渠道运行的客户服务 agent。
OpenAI 的旗舰视频与音频生成模型,和新的 Sora 应用一起发布,重点从单次视频生成扩展到角色、社交创作和安全治理。
面向大型代码库的代码理解、搜索、监督和演进平台,正在把自身定位为人类开发者和 AI coding agents 的共享代码上下文层。
面向音乐生成的 AI 创作平台,可从文本或音频想法生成歌曲,并通过免费、Pro 和 Premier 等订阅层提供不同额度和商业使用权。
面向企业的视频生成平台,用户可以用文本、AI avatars 和多语言 voiceovers 创建培训、内部沟通、销售和知识传递视频。
主打隐私、安全和企业可控部署的 AI 编程助手,覆盖代码补全、聊天、生成与团队治理场景。
AI 角色聊天和创作社区,用户可以与 AI characters 对话、创建个性化角色,并围绕角色互动和多模态内容进行娱乐创作。
Google DeepMind 的高效率视频生成模型,基于 Veo 3,可从文本或图像生成带音频的高质量高分辨率视频,并通过 Gemini API、AI Studio、Vertex AI 和 Flow 分发。
Mistral AI 发布的 4B 参数文本转语音模型,支持 9 种语言、低延迟 streaming、zero-shot voice cloning,并面向企业 voice agent 工作流。
W3C Web Machine Learning 方向的 Web Neural Network API,目标是在浏览器中提供硬件无关的神经网络推理抽象层,让 Web 应用更高效地运行本地 ML/AI。
AI 开发者平台,覆盖模型实验追踪、LLM 应用观测、评测和监控;2025 年被 CoreWeave 收购。
面向企业的生成式 AI 与 agent 平台,围绕 Palmyra LLM、Graph RAG、AI Studio、AI HQ 和治理能力,帮助企业构建可控的 AI 工作流。
Anthropic 推出的 agentic 编程工具,可在终端、IDE、桌面和云端理解代码库、修改文件、运行命令与测试,并通过 Skills、MCP、hooks 和子代理扩展工作流。
面向创作者、开发者和企业的生成式音频平台,覆盖文本转语音、语音克隆、语音转文字、配音、音乐与音效,以及可部署的语音和聊天 agent。
SpaceXAI/xAI 推出的通用 AI 模型与助手产品,覆盖网页和移动端对话、X 与网页检索、开发者 API,以及图像、视频和语音能力。
LangChain 推出的 AI 应用与 agent 工程平台,覆盖运行链路追踪、离线和在线评测、提示词管理,以及云端、混合和自托管部署。
面向开发者和企业的 AI 基础设施平台,围绕开放权重模型提供 Serverless 与专属推理、微调和训练、GPU 集群、评测及代码沙箱等能力。
OpenAI API 中用于让模型选择外部工具并生成结构化调用参数的接口机制,也是 Responses API 与 Agents SDK 工具体系的基础组成。
由 Quora 推出的多模型 AI 平台,兼具统一聊天入口、开发者 API、AI 应用创建与分发,以及按使用收费的创作者机制。
面向律所、企业法务及专业服务机构的法律 AI 平台,覆盖研究、起草、文档分析和多步骤 Agent 工作流。
面向 AI 与数据团队的代码优先 Serverless 计算平台,覆盖 GPU 推理、训练、批处理、Notebook 与 Agent Sandbox。
以自研视频与世界模型为基础,向创作者、企业和开发者提供生成式媒体 SaaS、API 与机器人模拟平台。
由 Codeium 演变而来的 AI 编程产品,现作为 Devin Desktop,将完整 IDE、本地编码 Agent、云端 Devin 与多 Agent 管理整合到同一工作台。
A2A 是 Google 发起、现由 Linux Foundation 托管的 Agent-to-Agent 开放协议,用于让不同框架和厂商的 AI agents 发现彼此、委托任务并交换结果。
以自研生成模型为核心的视觉创作平台,提供图像生成、参考图控制、网页编辑与图生视频功能。
GitHub Copilot 是 GitHub/Microsoft 面向开发者的 AI 编程助手,已从编辑器代码补全扩展到 IDE、CLI、GitHub PR/Issue、代码审查与云端 coding agent 工作流。
嵌入 Notion 工作空间的企业 AI 产品,覆盖知识搜索、研究、会议记录与工作流 Agent。
Ray 是面向 AI 与 Python 工作负载的开源分布式计算框架,Anyscale 是围绕 Ray 做生产化、托管化和企业化的平台公司。
Scale AI 是一家 AI 数据、模型评测与企业/政府 AI 应用基础设施公司,核心能力是用人类专家数据与评测流程帮助模型训练、后训练和部署。
面向开发者与工程团队的 AI 编程 Agent 产品,覆盖编辑器、CLI、云端 Agent、自动化与代码审查。
面向开发者和企业的开放权重模型推理、后训练与部署平台,提供共享 API、专属 GPU 部署及客户云账户内的集群方案。
Glean 是面向企业的 Work AI 平台,把企业搜索、AI 助手、Agent 构建与治理放在同一套权限感知的上下文层上。
LMSYS Chatbot Arena 是由 UC Berkeley / LMSYS 研究者发起、后来独立为 Arena 的真人偏好评测平台,用匿名模型对战和用户投票来生成 AI 模型排行榜。
vLLM 是一个开源的大模型推理与服务引擎,核心用途是让开发者更高效地部署和服务 LLM / 多模态模型。
以开源节点式工作流核心为基础,同时提供官方 Cloud、API 与 Enterprise 服务的视觉 AI 创作与生产引擎。
面向个人、团队与企业的 AI Agent 工作空间和应用开发产品族,覆盖项目协作、应用构建、发布及 Agent 评测观测。
中国基础模型公司,提供网页与 App 对话、开发者 API,以及可下载并本地部署的模型权重;当前公开旗舰模型为 DeepSeek-V4-Pro 与 DeepSeek-V4-Flash。
面向开发者和团队的可视化 AI 应用与 Agent 工作流平台,覆盖多模型接入、知识库、应用发布、运行监控与自托管部署。
字节跳动体系内面向创作者与普通用户的云端 AI 视觉创作产品,提供图像生成、视频生成与画布编辑等功能。
快手推出的云端多模态视频创作平台,提供视频、图像、声音生成与编辑,以及开发者 API。
MiniMax 是一家以自研多模态基础模型为底座,同时经营开发者 API、Agent、视频、音频与角色互动产品的中国 AI 公司。
阿里旗下的消费者 AI 助手,基于 Qwen 模型能力连接购物、支付、旅行等服务,尝试把对话需求推进为可执行任务。
OpenAI 面向个人与组织提供的通用 AI 助手产品,覆盖对话、文件与项目协作、外部应用连接,以及部分可执行多步骤任务的 Agent 能力。
Anthropic 面向个人、开发者与组织提供的 AI 工作产品体系,覆盖 Claude 对话、Claude Code、Claude Cowork、连接器、Skills 与企业治理能力。
面向消费者的多模态 AI 助手,覆盖对话、语音、创作与部分任务执行,并与 Seed 系列模型及豆包手机助手形成关联产品层。
Google 面向个人用户的 AI 助手,结合 Gemini 模型、Google 服务连接、研究与多步骤任务能力。
一个把通用任务执行、跨应用连接、浏览器操作和 Web 应用生成放进同一云端产品面的 AI Agent。
腾讯旗下的消费者 AI 助手,接入混元与 DeepSeek 等模型,并连接腾讯内容、工具和社交场景。
Nous Research 基于 ByteDance Seed-OSS-36B-Base 后训练的 36B 开放权重文本模型,提供可切换推理、函数调用和本地部署入口,并作为 Psyche 去中心化后训练的公开案例。
用于让 AI 应用以统一客户端—服务器协议连接外部工具、数据与工作流的开放协议。
以联网检索、带引用回答和 Spaces 项目空间为核心的 AI 答案引擎,同时提供企业订阅与开发者 API。
Google 推出的云端 AI 研究与知识工作工具,围绕用户选定或发现的资料进行问答、分析和多格式内容生成。
一个可自托管的个人 AI Agent:用常驻 Gateway 连接聊天渠道、模型、工具与扩展。