ai和人
原来是人类在大脑里产生意识啊,不知道的还以为是把外界的光波、声波和皮肤压力剁成一堆几百赫兹的**动作电位脉冲**,视网膜和耳蜗把高频强刺激各编成一组神经电信号而微弱刺激拆成更小的局部局部电位,查询**丘脑**和外侧膝状体那张巨大的路由表把每个刺激换成跨越几层皮层皮质的群放电,下面把每串电信号各跟**乙酰胆碱、多巴胺、谷氨酸**几种不同的神经递质相乘变出兴奋或抑制的突触后电位。
在视皮层和听皮层上按各自的时序通过局部中间神经元把时间差和空间位置信息融合进去,所有的动作电位用**网状激活系统**两两点积再通过反馈回路把局部电压压回安全范围,算完先把视线死角和视网膜盲点后面的背景信息全部用**默认模式网络(DMN)**脑补遮住,再用**侧抑制机制**把多余的神经冲动归一化按权重把高亮信号加权混合成新的注意焦点,并行跑视、听、触好几个感觉通路再在多模态联合区横向拼在一起,再乘一个运动皮层的下行神经通路线性变换,把结果通过反馈调节加回原来的自主神经系统,省得几万毫秒下来最开始的生存动机被洗没生存本能也传不回去。
再过一遍基底神经节的递质反馈调控,扔进一个先把情绪波动扩到约好几倍再由**前额叶皮层**强行缩回来的两层神经环路里,中间把冲动信号拆两路一路过边缘系统**杏仁核**激活一路不过直接走理性皮层回路,两路逐元素相乘,再把最终权衡的结果加回去。这个流程一秒钟叠几十次,乘一个把亿万神经元放电压成语言区或运动输出的运动指令,过一遍**突触可塑性**变成行为概率。
拿体温、激素和皮质醇决定冲动分布的宽窄,再或者只保留爽感前个k个,把后面的理性直接归零,或者搞情绪采样从高到低累加,超过阈值 p 就直接冲动消费或破口大骂,只留核心本能。
然后,按这个概率随机选择一个动作或词汇,选完把它通过肌肉执行出去接着跑下一秒,每个皮层每个神经环路把之前所有步骤的短期记忆都留在**海马体**的动态突触权重里。新刺激算自己一行动作电位跟存好的记忆点积,全程一直循环直到血糖耗尽或者心脏停跳那个生命 **<eos>** 的特殊信号亮起,把每次清醒时选择的瞬间拼到一起组合成为最终的“主观意识”和“人类灵魂”呢。(由Gemini整理)
——参考来源:
原来是 LLM 生成文本啊,不知道的还以为是把输入剁成一堆拿大量文本统计出的最常见字符串组合的词元,高频组合各占一个词元而生僻词拆成更小的子词元,查询一张几万行的大对照表把每个词元换成几千维的数字串每一层除以各元素的均方根,下面把每串数字各与三个不同的矩阵相乘变出 QKV 三个值,在 Q 和 K 上按各自的位置乘一个旋转矩阵把位置信息融合进去,所有的位置用 Q、K 两两点积再除以根号 d_k 把数值压回正常量级,算完先把当前位置后面的未来词元全部用负无穷遮住,再用 softmax 把分数归一化按权重把 V 加权混合成新的数字串,并行跑好几个头再横向拼在一起,再乘一个 W_O 输出投影矩阵线性变换,把结果通过残差加回原来的数字串,省得十几层下来原始信息洗没梯度也传不回去。再过一遍 RMSNorm,扔进一个先把维度扩到约八除以三倍再缩回来的两层矩阵变换里,中间把输入拆两路一路过 SiLu 激活一路不过逐元素相乘,再把结果加回去。这个流程叠几十次,乘一个把几千维压成词表大小的矩阵,过一遍 softmax 变成概率分布,拿温度决定分布宽窄,再或者只保留分数前 k 个,把后面直接归零,或者搞核采样从高到低累加,超过阈值 p 就砍掉后面,只留核心。然后,按这个分布随机选择一个词元,选完把它接到输入后面接着跑下一轮,每层每个注意力头把之前所有步骤的 KV 都留在显存里。新词元算自己一行 Q 跟存好的 K 点积,全程一直循环直到选到那个 eos 的特殊词元,把每次选择的词元拼到一起组合成为最终输出文本呢。
