AI结果云

生产、分发、运行、进化硅基员工

智能体商店 -百汇

AgentStore
链接供需双方
供给方

企业、个人开发者和百融

快速上架

AgentStore

开箱即用、可复制、可泛化的硅基员工

能力可用、逻辑不可见的产权保护机制

可计量、可计费,支持收益分配

需求方

企业、个人用户和百融

一键上岗
对结果负责

任务导向

为完成明确目标负责,适合短期任务场景
(信审报告、客服质检)

记件记时

岗位导向

成为岗位专职员工,适合长期固定岗位
(客服员工、法务专员)

岗位工资

业绩导向

与客户目标一致,基于实际达成的业务成果分成
(营销专家、招聘专员)

价值分成

旗舰硅基员工

汇集覆盖营销、客服、运营、售后、行研、招聘、风控等客户体验与员工体验场景的标准化“硅基员工” 企业可在此按岗位一键选用、开通与编排Agent,在统一平台中运营和进化,让智能体真正对业务结果负责

探索百汇智能体商店

智能营销

百盈 - 合规高效提升销售业绩

基于Android ROM定制专用手机操作系统,打破系统底层权限、集合规管控、数据保护于一身的企业级软硬一体化智能终端 ,用于规范员工行为、管理销售过程、并保护企业资产,提升销售效率与业绩

智能营销

智能客服

百服 - 咨询即办升级服务

集智能交互、业务办理与主动关怀于一体,精准识别用户意图,通过生态工具的无缝集成,打造 “咨询即办理” 的服务体验,革新企业客户服务体系,实现从被动应答到主动服务的全面升级

智能客服

智能招聘服务

百才 - 多源智能人才体系,为 HR 与企业提效赋能

凭借多源数据协同透视、全流程自驱运转(含IM智联、AI面试等),搭配智能体自我演进与全局战略中枢,构建 “寻源-推进- 决策” 全链路智能体系,既为HR减负提效,更助力企业构建科学人才战略,抢占人才先机

智能招聘服务

法商财税专业服务

百鉴 - AI 驱动去中心化服务网络,赋能企业跨境出海

AI 驱动去中心化全球专业服务网络,建立全球专业知识库,以 AI 技术赋能专业人士高效协同,助力企业出海,提升跨境服务质效、降低成本,同步覆盖本土化专业服务延伸

探索百鉴
法商财税专业服务

智能办公助手

百智 - 为高知人群打造智能知识管理生产体系,软硬一体、多智能体协同,高效沉淀复用专业知识

为高知识密度人群打造全智能知识管理与生产体系,轻量隐形、随摘随录,集“能听、能记、能写”于一体。依托软硬一体与Multi-Agent协同,构建知识生产引擎,让每一次「对话」转化为可复用知识资产,成为专业人士专属“第二大脑”

探索百智
智能办公助手

智能营销

百盈 - 合规高效提升销售业绩

智能客服

百服 - 咨询即办升级服务

智能招聘服务

百才 - 多源智能人才体系,为 HR 与企业提效赋能

法商财税专业服务

百鉴 - AI 驱动去中心化服务网络,赋能企业跨境出海

智能办公助手

百智 - 为高知人群打造智能知识管理生产体系,软硬一体、多智能体协同,高效沉淀复用专业知识

智能营销

基于Android ROM定制专用手机操作系统,打破系统底层权限、集合规管控、数据保护于一身的企业级软硬一体化智能终端 ,用于规范员工行为、管理销售过程、并保护企业资产,提升销售效率与业绩

智能营销

智能客服

集智能交互、业务办理与主动关怀于一体,精准识别用户意图,通过生态工具的无缝集成,打造 “咨询即办理” 的服务体验,革新企业客户服务体系,实现从被动应答到主动服务的全面升级

智能客服

智能招聘服务

凭借多源数据协同透视、全流程自驱运转(含IM智联、AI面试等),搭配智能体自我演进与全局战略中枢,构建 “寻源-推进- 决策” 全链路智能体系,既为HR减负提效,更助力企业构建科学人才战略,抢占人才先机

智能招聘服务

法商财税专业服务

AI 驱动去中心化全球专业服务网络,建立全球专业知识库,以 AI 技术赋能专业人士高效协同,助力企业出海,提升跨境服务质效、降低成本,同步覆盖本土化专业服务延伸

探索百鉴
法商财税专业服务

智能办公助手

为高知识密度人群打造全智能知识管理与生产体系,轻量隐形、随摘随录,集“能听、能记、能写”于一体。依托软硬一体与Multi-Agent协同,构建知识生产引擎,让每一次「对话」转化为可复用知识资产,成为专业人士专属“第二大脑”

探索百智
智能办公助手

智能体平台 -百工

为交付结果而生

LLM Ops

兼容通用与领域大模型
基于场景智能推荐最优模型
LLM结果可观测、可计量

Agent Builder

低代码可视化编排
企业级知识库/专业语音套件
插件/MCP/沙箱
智能体评测、优化、一键发布

Agent Runtime

稳定运行时封装
效果可视可衡量
智能体在线自迭代
内置计价与分成功能

VoiceAgent

一站式高易用VoiceAgent工作台,赋能企业自由构建低时延、智能化的呼入/呼出任务,实现无缝人机协作

极致低时延,流畅自然

对话快过人类感官极限,无论任务多复杂,人机交互始终顺畅自然

真正智能的AI Agent

AI与RPA完美结合,像真人一样工作,而非简单语音问答机器人

开箱即用的行业专家

降低80%调优成本,让业务人员也能轻松维护和优化

DevOps

具备“自我进化”能力的智能体生态,为智能体应用提供从全链路追踪、多维评测、线上观测到自动优化的全生命周期支持

全链路追踪

可视化呈现用户提问、意图识别、插件调用、RAG 检索与大模型生成的完整思维链路,精确记录每个节点的耗时、Token 消耗及模型参数,快速定位性能瓶颈与逻辑断点

多维效果评测

自定义 AI 评估器自动评分,一站式管理评测任务,支持批量对比 Output 与参考答案,生成详细打分报告,用数据衡量智慧

线上智能观测

7x24h 自动化监控智能体健康,实时打分 Trace 数据,及时发现质量波动,保障服务稳定可靠

自动优化

提示词智能迭代、经验库积累与 QA 知识补全三大策略,实现 AI Agent 自我进化,持续提升理解力与答题准确性

AI基础设施 -百基

BR领域模型

不同垂直场景 Know-How 与行业合规+不同参数模型灵活适配算力与成本+不同场景知识共享与复制

首推旗舰模型

语言大模型

BR-LLM-Proactive

主动对话大模型

营销客服场景专属主动对话大模型,深度学习百万级金牌销售话术,日均支持1亿呼叫规模,多场景实测效果领先通用大模型

BR-LLM

垂直领域基础大模型

垂直领域优化基础大语言模型,适配私有化部署与业务定制调优

语音交互模型

BR-Voice

端到端语音大模型

全双工情感语音大模型,端到端响应可达500ms;支持性别/年龄/情绪等副语言识别,ASR字错误率低至2.30%

BR-Voice-Pro

端到端语音大模型

专业级端到端语音大模型,适配高并发客服与营销业务场景

BR-Voice-Turbo

端到端语音大模型

极速版语音大模型,主打超低时延与高吞吐能力

BR-TTS-Zh

语音合成(TTS)

中文文本转语音模型,300ms首包时延,支持多音色与情感表现力控制;字错误率0.75%,音色相似度0.81,声音质量UTMOS 4.2分

BR-TTS-Multilingual

语音合成(TTS)

多语种文本转语音模型,覆盖日语、粤语、阿拉伯语等语种,金融术语识别准确率97.2%

BR-ASR-V1

语音识别(ASR)

高精度语音识别模型,适配金融等垂直场景的语音转写需求,金融术语识别准确率97.2%

BR-Smart-Turn(TurnSense)

语音交互组件

SOTA级语义轮次判别模型,支持完整/不完整/无效语义三分类,47M轻量参数,适配CPU与边缘部署,公开评测集上准确率96.4%

VAD模型

语音交互组件

语音端点检测模型,精准识别语音起止状态

情感识别模型

语音交互组件

语音情感识别模型,支持7类情绪识别,公开评测集准确率90.29%

BR-Hung-Up

语音交互组件

通话挂机检测模型,精准判定通话结束状态

BR-Link-Word-Zh

语音交互组件

口水词模型,优化语音对话中的口语填充词处理,改善语音对话延迟体验

视觉多模态模型

BR-Vision-Doc

文档理解大模型

全域多模态文档大模型,累计1.2亿页真实业务文档训练;扫描件解析准确率99.86%,支撑Agentic RAG推理检索

BR-Vision-FinDoc

文档理解大模型

金融领域专用文档模型,支持200+场景自动分类,平均精度95%+

BR-Vision-FinDoc

文档理解大模型

轻量金融文档模型,适配低资源环境下的轻量化部署

BR-Vision-OCR

OCR识别系列

通用高精度OCR模型,覆盖保险/医疗/金融票据、27+类标准卡证全场景

BR-Vision-OCR-Lite

OCR识别系列

轻量版OCR模型,适配CPU端与边缘设备部署

BR-Vision-OCR-Multilingual

OCR识别系列

多语种OCR模型,支持中、英、阿、泰、日等多语种识别

BA-Vision-OCR-Mutlingual

OCR识别系列

百融小语种文档解析模型,面向多语种文档场景,支持书籍、网页截图等场景的文字识别;覆盖德语、英语、西班牙语、法语、意大利语、日语、韩语、荷兰语、中文、葡萄牙语等多语种

能力增强组件

BR-Securities-AB

对话分析类

营销意向判定模型,通过分析用户对话数据,精准识别用户营销意向

BR-Query-Rewrite

文本增强类

查询语义改写模型,优化用户意图理解准确率

BR Vortex

智能体时代推理系统的复杂度被彻底重写

多级缓存P99延迟10x ↓
  • HBM. DRAM. SSD
  • 多模态预处理、前缀缓存
  • 动态卸载技术
DRAM

Dynamic Random Access Memory,动态随机存取存储器

HBM

High Bandwidth Memory,高带宽存储器

SSD

Solid State Drive,固态硬盘

多元算力优化利用率30% ↑
  • GPU:英伟达、沐曦、平头哥、海光
  • DSA: 昇腾、昆仑芯、寒武纪
  • 资源统管:可管理、可切分、可池化
DSA

Domain-Specific Architecture/Accelerator, 领域专用架构 / 加速器

混合调度吞吐3x ↑
  • 任务类型:视觉、语音、文本生成
  • 性能要求:吞吐、时延、并发
  • 混合负载:静态shape、动态shape、流式输入
  • 调度策略:动态批处理、连续批处理、投机采样
AI Infra Architecture

API应用层

多样化接口协议

  • OpenAI、Anthropic、TEI
  • 协议代理与转换

分布式限流、鉴权

  • 业务级限流request/token/并发
  • RBAC访问控制

流量拆分、服务治理

  • 离在线分离,批量API
  • 多版本灰度发布、上下文长度分桶

服务监控与故障恢复

  • 集群、网关、服务层全链路性能
  • 高性能权重存储、快速拉起

vortex推理引擎

多模态支持

  • TTS:CosyVoice2, Index-TTS2
  • E2E MultiModal LLM:ParrotAudio, Qwen3 Omni

分布式编排调度

  • 多种批处理策略融合
  • P/D. E/P/DA
  • 模态、模块分离式部署
  • Target-Draft分离式部署
  • 请求负载均衡
  • 动态重调度
  • PD混布
  • 并行优化

自定义插件

  • 文本前处理
  • 音频处理
  • vlm后端,sglang后端插件
  • 混合精度推理插件

多后端支持

  • vllm. sglang
  • onnxruntime
  • TensorRT
  • MindlE

多种量化策略

  • 权重量化:AWQ、GPTQ
  • 激活量化:W8A8-FP8、W4A8-FP8
  • KV Cachef1k:FP8、W4A8KV4
  • Attention#1k, Sparse Attention: Q4K4V8

多级缓存优化

  • 多模态encoder缓存
  • 前缀缓存
  • 多级KV Cache

vortex算子层

高性能手写算子

cuda/cann/flash infer

AI编译

triton/tilelang

通信访存算子

uccl/nccl

调度层

虚拟化/池化

容器编排

服务扩缩容

分布式存储

监控告警

硬件层

Ascend NPU
Hygon DCU
沐曦 GPU
Nvidia GPU
SmartNIC
RoCE/InfiniBand
DRAM
SSD NVMe