AI 如何持续改进自己:递归自我改进论文解读
从代码助手的具体例子出发,解释递归自我改进的五个自主层级、HCI 指标与初步实验,理解系统如何保留经验,以及如何验证“改进方法本身也在进步”。
从代码助手的具体例子出发,解释递归自我改进的五个自主层级、HCI 指标与初步实验,理解系统如何保留经验,以及如何验证“改进方法本身也在进步”。
Craig Perry 的 OAATI 目标管理模型完整中英对照,介绍如何定义结果、拆解行动、找到瓶颈、建立 SOP,并通过短反馈循环持续迭代。
从语音模型与任务模型的分工出发,解释 GPT-Live 的实时交互,以及流式音频、接话判断、打断处理和上下文同步的工程原理。
基于 OpenAI 当前官方文档,解释原生语音对话、轮次检测、打断与工具调用,梳理 GPT-Realtime-2.1 的限制和计费,并提供可下载的 WebRTC 接入示例。
介绍 SWOT、OODA Loop、艾森豪威尔矩阵、零基思考、波特五力和 Jobs-to-be-Done 六种常见的认知决策模型。
原文: Wukong: Towards a Scaling Law for Large-Scale Recommendation 网络结构 参考 LLM 领域 Transformer 的结构设计, 对推荐场景进行了适配。 网络结构…
一、公司图谱:硅谷硬核派的“晶圆狂想” Cerebras Systems成立于2015年,由硅谷半导体行业资深团队创立,致力于突破传统芯片设计的物理极限。其核心理念是“以整片晶圆为画布”,将传统切割成数百个小芯片的12英寸晶圆直接…
大模型推理过程 大模型的推理可以分为两个阶段: Prefill: 基于全部Prompt进行前向推理, 得到第一个token。计算密集。 Decoding: 通过自回归方式, 递归输出新的token。内存密集。 由于 Prefill…
大语言模型原理之 DPO 算法
关于 DeepSeek 和出口管制 作者 : Dario Amodei 翻译 : Claude 3.5 Sonnet 几周前,我提出了加强美国对华芯片出口管制的理由。此后,中国人工智能公司 DeepSeek 以更低的成本在某些方面…