用语音审问 AI 嫌疑人破案这种体验确实比打字有冲击力多了
直接用 WebRTC 跑 OpenAI 的 gpt-realtime-2.1,这种语音到语音的实时响应速度确实能让沉浸感拉满。这个项目的核心逻辑很有意思,它把大模型的 Tool Call 用在了“指控”环节。当你尝试指控某个嫌疑人时,AI 会调用一个工具,把你的指控对象以及你提供的具体证据清单记录下来。
因为 gpt-realtime-2.1 的 Token 消耗非常惊人,作者在部署时特意加了一个 30 分钟的定时器,防止有人挂机把余额跑光。这种把 LLM 角色扮演和逻辑判定结合的工作流,其实给很多 AI 游戏开发提供了思路:不要只依赖一个模型的对话,而是用一个模型负责扮演,另一个模型负责判定事实,这样才能避免 AI 过于“宽容”而导致游戏失去挑战性。
最硬核的地方在于它引入了一个“法官”角色(用的是 gpt-4o-mini),专门负责审核你的证据。如果你只是在那儿瞎猜或者用模糊的词汇套话,法官是不认账的。你必须准确地陈述出案件中的关键事实,哪怕是改写后的表述也可以,但必须得有实质性的证据支撑才能结案。
从技术栈来看,这套实操方案挺典型的:
- 前端/框架: Next.js
- 数据库: MongoDB
- 身份验证: Clerk(因为 Realtime API 实在太贵,必须通过用户 ID 限制额度)
- 通信协议: WebRTC(保证低延迟语音传输)
因为 gpt-realtime-2.1 的 Token 消耗非常惊人,作者在部署时特意加了一个 30 分钟的定时器,防止有人挂机把余额跑光。这种把 LLM 角色扮演和逻辑判定结合的工作流,其实给很多 AI 游戏开发提供了思路:不要只依赖一个模型的对话,而是用一个模型负责扮演,另一个模型负责判定事实,这样才能避免 AI 过于“宽容”而导致游戏失去挑战性。
事件追踪 · 相关报道
把 AI 实验室的权力推到和政府相当的程度
12小时前
拿了菲尔兹奖还预警 AI 会导致人类灭绝
1天前
直接让 ChatGPT 模仿某个具体作家的文风现在开始变难了
1天前
OpenAI 居然因为安全问题给 Astra 踩刹车了
1天前
如果游戏世界在玩家下线后依然自主运转会发生什么
1天前
OpenAI 竟然用黑客在讨论区商量怎么攻击的聊天记录来训练模型
1天前