临场智能 · In-the-Moment Intelligence

别的 AI 服务你打字的时刻。
Cortex 服务你开口的时刻。

谈判桌、面试间、聚光灯下——决定结果的那 40 分钟,是单位时间价值最高、AI 渗透率却最低的场景。Cortex 是你的 AI 军师:场边给提示,赛后带复盘,把每一场硬仗都变成只属于你的资产。

Cortex 硬件概念图:充电盒内放置夹耳式开放耳机与矩阵麦徽章

概念图 · 第一版硬件形态设计中

痛点 · The 40 Minutes

你人生最贵的 40 分钟,
AI 渗透率是零。

过去三年,AI 学会了写作、画画、编程。但你最贵的那些时刻——谈判桌上、面试间里、台上——它到今天都进不去。

人在重要对话里失手,不是因为不够聪明,而是因为真实对话把时间、记忆、情绪、压力,全压进了同一个不能暂停的瞬间。

01

时间不能暂停

对方话音刚落,你只有几秒钟决定怎么接。没有草稿,没有重来。

02

记忆调不出来

该引用的那份资料、那句承诺,偏偏在最需要它的一刻想不起来。

03

判断被压力扭曲

越是高赌注,越容易无偿让步、答非所问、错过该出手的时机。

类别 · The Category

临场智能:
服务不能暂停的时刻。

ChatGPT 服务你能暂停、能重来的时刻;Cortex 服务你不能暂停的时刻。

这不是一个新功能,是一个新类别。一场谈判的每一分钟,都直接写进合同金额——单位时间价值最高、AI 渗透率最低,是一整块尚未被服务的空白市场。

单位时间价值 AI 渗透率 打字的时刻 写作 · 编程 · 检索 开口的时刻 谈判 · 面试 · 演讲 空白市场
高价值 × 零渗透 = 临场智能的立足点

产品 · AI 军师

助理帮你做事,
军师帮你赢。

助理帮你订机票、写周报——那是执行。军师在赌注最高的时刻替你出主意,仗打完带你复盘——那是判断。Cortex 三端一云,加一枚随身徽章,把军师放进你的口袋。

实时进行中 商务谈判 · 复盘视角
  1. 对方

    预算如果提前,我们能拿到什么?

  2. 对方

    但我们得先确认这个季度能落地。

  3. 先把落地风险和价格分开谈。

场边提示

对话进行时,只在时机成立的那一刻给一句短提示——该问什么、该回避什么、什么时候闭嘴。

赛后复盘

整场对话回看,指着第 X 分钟告诉你哪一步丢了主动权,把这一仗的教训变成下一仗的准备。

知识环

你读过的、说过的、听过的,不是存起来落灰,而是在你需要开口的那一刻自己浮现。

载体 · 生态拼图

听清整个房间,
只在你耳边说话。

硬件不是本体,是这套闭环生态的采集端。今天手机在桌上就能用;第一版硬件形态正在设计——三件套各司其职:徽章负责听,耳机负责说,盒子负责“这一场从现在开始”。

徽章 · 矩阵麦

听清整个房间

阵列拾音带来声源方位——谁在说、说完了没有,这是判断“此刻该不该开口”的前提。设计目标 5–6 米,覆盖整张谈判桌,而不只是你面前那一小块。

夹耳开放耳机

不入耳,是刻意的

耳道敞开,你照常自然地听对方说话;提示只在该出现的那一秒到你耳边。入耳式会把你和真实对话隔开——那对这个产品是致命的。

充电盒

开盒即开场

显式启动,不是常开监听。合盖即结束——这一场从哪一刻开始,由你的手决定,而不是由一个后台进程决定。

Cortex 矩阵麦徽章概念图
概念图 · 第一版硬件形态设计中,非在售产品

终局 · 规划中

最后,它该跑在你自己的机器上。

这条线的终点是一台本地私人服务器:模型与知识库落回你自己的硬件。对话资产的采集端和存放地,两头都握在你手里——这才是“私人知识库”这四个字的完整形态。

该方向仍在规划中,尚未实现;当前为云端服务。

证据 · 工程纵深

知道什么时候闭嘴,
是最难也最值钱的能力。

在一场真实商务对话的录音回放里,系统三次开火,全部落在情绪对抗的时刻;平稳推进的段落,零打扰。

什么时候该说话、谁在说、说完了没、提示过没过期——临场不是一个 prompt,是一整套感知栈。

架构 · SAGA

流式注意力门控架构Streaming Attention-Gating Architecture

大模型是回合制的:等你说完、给出回答、然后遗忘。但旁听者不能这样——发言权不属于它,它得自己回答三个问题:什么时候思考、记住什么,以及最难的那个——什么时候不说话。SAGA 就是给无状态的智能补上这三样人类才有的东西。

音频流 ASR 流式转写
持续注意力 确定性扫描 · 全时
工作记忆 滚动对话状态
分寸感 语义门 · 场景预算
沉默绝大多数时刻
观察继续跟踪
介入唤醒大模型
一次介入的完整旅程——毫秒级过滤全时运转,门控通过才唤醒大模型;其余时刻,输出是沉默。
  1. L1

    持续注意力

    确定性信号层

    逐段扫描关键词、问句形态、说话人归因、停顿探针。单条约 1.7 毫秒,全时开启,且不产生任何模型调用费用。

  2. L2

    工作记忆

    滚动对话状态

    把无界的音频流压成有界结构:当前阶段、双方立场、未决问题、已给出的承诺、风险点、以及已经提过的话。

  3. L3

    分寸感

    语义门与预算

    场景化预算(次数、间隔、高价值保留位、静默规则)决定要不要惊动大模型;模型只做三态裁决:沉默 / 观察 / 介入。

这比“让大模型逐字持续思考”更接近真人听会的方式——顺带把旁听成本压下来:相比把整场音频持续喂给大模型,成本低两个数量级。

自研临场决策模型

蒸馏自自有对话数据,已在生产运行。判断何时开火,是这套系统的核心难点。

数据飞轮

每一场真实对话都在产出别处不存在的标注:“此刻该不该说话”。

时机的价值

模型能力会贬值,时机判断的数据只会升值——这是我们押注的地方。

三端一云
手机 · 桌面 · 徽章 + 后端
软硬件全栈
感知 · 决策 · 器件一体
50+ 次
生产级部署
1400+
后端自动化测试

壁垒 · 对话资产

这个语料,
爬虫爬不到,大厂买不到。

知识产品停在“知”,效率产品停在“行”。Cortex 把两者连成一个环:读过的内容 → 会前自动浮现 → 临场 → 复盘 → 回流。

外环这个知行环每转一圈,内环的数据环就跟着转一圈——每一场真实对话,都在生成别处不存在的私有语料。这是越用越深、别人越难追上的护城河。

知行环 × 数据环:转一圈,沉淀一圈私有对话资产
Why Now · 全双工浪潮

延迟窗口刚打开,
感知栈还是无人区。

流式 ASR 和 flash 级大模型的延迟,直到最近一年才降到临场可用的量级。这个窗口,去年才真正打开。

GPT-Live、全双工语音这些浪潮,正把“交互时机”第一次带成前沿课题——大厂在做能被你打断的语音助手,我们做旁听你对话、替你出主意的军师。端到端把感知栈做进真实对话的,现在还没有人。

  • 延迟流式 ASR + flash 模型,刚够临场
  • 浪潮全双工语音把“时机”推成前沿
  • 无人区端到端感知栈,尚无人占位

Cortex · 临场智能公司

AI 军师陪你上场,把你人生最贵的时刻打赢;
每一仗,都变成只属于你的资产。

临场智能 · In-the-Moment Intelligence