logo

击壤而歌

首页 标签 归档 关于

GPT-Live 技术原理:实时语音如何驱动后台任务

对着电脑说“把这个页面的按钮放大一点”,AI 开始修改代码;接着问“改到哪了”,它能汇报进度;再补充“只改首页”,任务继续调整。这种体验需要同时处理两件事:及时接住人的话,以及持续执行需要时间的工作。 GPT-Live 的关键设计,可以从
2026-09-09 LLM , OpenAI , 语音交互

OpenAI Realtime API 详解:端到端语音对话的原理、能力与接入

OpenAI 面向开发者的端到端语音对话入口是 Realtime API:应用建立持续连接,向模型传入声音,再接收模型生成的声音与控制事件。它适合能够接话、被打断、查询信息并执行工具的语音助手。 截至 2026 年 9 月 9 日,官方语音
2026-09-09 LLM , OpenAI , 语音交互 , Realtime API

常见的认知决策模型:从问题拆解到行动闭环

面对复杂问题时,人们往往会在信息不足、目标冲突和时间压力下做出判断。认知决策模型的作用,不是替代判断,而是为判断提供一组可重复的提问方式:问题发生在什么环境中,真正需要解决的是什么,当前行动是否仍然值得继续,以及下一步应该如何安排。 本文介
2026-08-31 认知科学 , 决策 , 思维模型 , 战略 , 产品管理

Wukong: 一种推荐系统的 Scaling Law 方案

原文: Wukong: Towards a Scaling Law for Large-Scale Recommendation 网络结构 参考 LLM 领域 Transformer 的结构设计, 对推荐场景进行了适配。 网络结构如下:
2025-02-12 推荐系统 , ScalingLaw

Cerebras Systems:颠覆AI芯片规则的“晶圆级革命者”

一、公司图谱:硅谷硬核派的“晶圆狂想”Cerebras Systems成立于2015年,由硅谷半导体行业资深团队创立,致力于突破传统芯片设计的物理极限。其核心理念是“以整片晶圆为画布”,将传统切割成数百个小芯片的12英寸晶圆直接制成单一巨芯
2025-02-11 AI , Cerebras , GPU

大语言模型推理加速之 KV Cache

大模型推理过程大模型的推理可以分为两个阶段: Prefill: 基于全部Prompt进行前向推理, 得到第一个token。计算密集。 Decoding: 通过自回归方式, 递归输出新的token。内存密集。 由于 Prefill与Dec
2025-02-09 LLM , KVCache

大语言模型原理之 DPO 算法

2023年5月, 由Standford在论文 Direct Preference Optimization: Your Language Model is Secretly a Reward Model 中提出。 作为Reinforceme
2025-02-07 DPO , RLHF , LLM , Direct Preference Optimization

Anthropic CEO 谈DeepSeek和出口管制

关于 DeepSeek 和出口管制作者: Dario Amodei翻译: Claude 3.5 Sonnet 几周前,我提出了加强美国对华芯片出口管制的理由。此后,中国人工智能公司 DeepSeek 以更低的成本在某些方面接近了美国前沿 A
2025-01-29 DeepSeek , Anthropic , Dario Amodei , Claude , Export Control

Box CEO:DeepSeek突破将如何重塑AI产业经济格局

DeepSeek在理解人工智能时代软件经济学未来方面取得了非常重要的突破。几年来,尤其是在公开市场投资者中,一直存在一个悬而未决的问题,即随着时间的推移,更多价值是否会流向人工智能模型本身,还是流向人工智能的应用层。饼图的具体细节并不重要,
2025-01-28 DeepSeek , AI , Aaron Levie

DeepSeek引爆AI圈:各界大咖如何看待这个突破性时刻

Sam AltmanCEO of OpenAIdeepseek’s r1 is an impressive model, particularly around what they’re able to deliver for the pr
2025-01-28 DeepSeek , AI
下一页
Powered by Hexo Theme