使用 C++ 实现神经网络:从基础到高级优化

引言

在现代机器学习中,神经网络已经成为最重要的工具之一。虽然 Python 提供了诸如 TensorFlow、PyTorch 等强大的机器学习库,但如果你想深入理解神经网络的实现原理,或者出于某些性能、资源限制的考虑,使用 C++ 来实现神经网络会是一个非常好的选择。

本文将从基础开始,逐步构建一个简单的神经网络框架,并在过程中展示如何通过 C++ 的高级特性(如面向对象设计、现代 C++ 特性等)优化神经网络的实现。最终,我们将构建一个灵活且高效的神经网络框架。

1. C++ 神经网络的基础设计

1.1 神经网络的基本结构

神经网络由多个层(Layer)组成,每一层包含多个神经元。神经网络通过前向传播(Forward Propagation)将输入数据传递给每一层,在每一层中,数据通过加权和加偏置后通过激活函数处理。最后,输出结果通过反向传播(Backpropagation)进行更新,逐步调整网络的参数(权重和偏置)。

1.2 简单的实现:单隐层神经网络

首先,我们实现一个简单的单隐层神经网络。网络包含一个输入层、一个隐藏层和一个输出层。我们将使用 Sigmoid 激活函数。

#include <iostream>
#include <vector>
#include <cmath>
#include <cassert>

// Tensor 类,用于表示矩阵或张量
class Tensor {
public:
    Tensor(int rows, int cols) : rows_(rows), cols_(cols) {
        data_ = std::vector<std::vector<float>>(rows, std::vector<float>(cols, 0.0f));
    }

    float& at(int row, int col) { return data_[row][col]; }
    float at(int row, int col) const { return data_[row][col]; }
    
    int getRows() const { return rows_; }
    int getCols() const { return cols_; }

    void randomize() {
        for (int i = 0; i < rows_; ++i) {
            for (int j = 0; j < cols_; ++j) {
                data_[i][j] = (rand() % 100) / 100.0f;  // Random float between 0 and 1
            }
        }
    }

private:
    int rows_, cols_;
    std::vector<std::vector<float>> data_;
};

// 矩阵乘法
Tensor matmul(const Tensor& A, const Tensor& B) {
    assert(A.getCols() == B.getRows());
    Tensor result(A.getRows(), B.getCols());
    for (int i = 0; i < A.getRows(); ++i) {
        for (int j = 0; j < B.getCols(); ++j) {
            float sum = 0.0f;
            for (int k = 0; k < A.getCols(); ++k) {
                sum += A.at(i, k) * B.at(k, j);
            }
            result.at(i, j) = sum;
        }
    }
    return result;
}

// 激活函数:Sigmoid
float sigmoid(float x) {
    return 1.0f / (1.0f + exp(-x));
}

// Sigmoid 的导数
float sigmoid_derivative(float x) {
    return x * (1.0f - x);
}

// 神经网络类
class NeuralNetwork {
public:
    NeuralNetwork(int input_size, int hidden_size, int output_size) {
        // 初始化权重和偏置
        weights_input_hidden = Tensor(input_size, hidden_size);
        weights_input_hidden.randomize();
        bias_hidden = Tensor(1, hidden_size);
        bias_hidden.randomize();

        weights_hidden_output = Tensor(hidden_size, output_size);
        weights_hidden_output.randomize();
        bias_output = Tensor(1, output_size);
        bias_output.randomize();
    }

    Tensor forward(const Tensor& input) {
        // 输入层到隐藏层
        Tensor hidden = matmul(input, weights_input_hidden);
        add_bias(hidden, bias_hidden);
        apply_sigmoid(hidden);

        // 隐藏层到输出层
        Tensor output = matmul(hidden, weights_hidden_output);
        add_bias(output, bias_output);
        apply_sigmoid(output);

        return output;
    }

    void backward(const Tensor& input, const Tensor& target, float learning_rate) {
        Tensor output = forward(input);
        Tensor output_error = compute_error(output, target);

        // 计算隐藏层误差
        Tensor hidden_error = matmul(output_error, transpose(weights_hidden_output));
        for (int i = 0; i < hidden_error.getRows(); ++i) {
            for (int j = 0; j < hidden_error.getCols(); ++j) {
                hidden_error.at(i, j) *= sigmoid_derivative(output.at(i, j));  // Sigmoid 导数
            }
        }

        // 更新权重和偏置
        update_weights(weights_hidden_output, output_error, learning_rate);
        update_bias(bias_output, output_error, learning_rate);

        update_weights(weights_input_hidden, hidden_error, learning_rate);
        update_bias(bias_hidden, hidden_error, learning_rate);
    }

private:
    Tensor weights_input_hidden, weights_hidden_output;
    Tensor bias_hidden, bias_output;

    // 辅助函数:应用 Sigmoid 激活函数
    void apply_sigmoid(Tensor& tensor) {
        for (int i = 0; i < tensor.getRows(); ++i) {
            for (int j = 0; j < tensor.getCols(); ++j) {
                tensor.at(i, j) = sigmoid(tensor.at(i, j));
            }
        }
    }

    // 辅助函数:添加偏置
    void add_bias(Tensor& tensor, const Tensor& bias) {
        for (int i = 0; i < tensor.getRows(); ++i) {
            for (int j = 0; j < tensor.getCols(); ++j) {
                tensor.at(i, j) += bias.at(0, j);
            }
        }
    }

    // 计算误差
    Tensor compute_error(const Tensor& output, const Tensor& target) {
        Tensor error(output.getRows(), output.getCols());
        for (int i = 0; i < output.getRows(); ++i) {
            for (int j = 0; j < output.getCols(); ++j) {
                error.at(i, j) = output.at(i, j) - target.at(i, j);  // MSE
            }
        }
        return error;
    }

    // 转置矩阵
    Tensor transpose(const Tensor& tensor) {
        Tensor transposed(tensor.getCols(), tensor.getRows());
        for (int i = 0; i < tensor.getRows(); ++i) {
            for (int j = 0; j < tensor.getCols(); ++j) {
                transposed.at(j, i) = tensor.at(i, j);
            }
        }
        return transposed;
    }

    // 更新权重
    void update_weights(Tensor& weights, const Tensor& error, float learning_rate) {
        for (int i = 0; i < weights.getRows(); ++i) {
            for (int j = 0; j < weights.getCols(); ++j) {
                weights.at(i, j) -= learning_rate * error.at(i, j);
            }
        }
    }

    // 更新偏置
    void update_bias(Tensor& bias, const Tensor& error, float learning_rate) {
        for (int i = 0; i < bias.getCols(); ++i) {
            bias.at(0, i) -= learning_rate * error.at(0, i);
        }
    }
};

1.3 训练神经网络

神经网络的训练过程包括多个步骤:

  1. 前向传播:输入数据经过每一层的计算,最终得出网络输出。
  2. 反向传播:计算输出误差,利用链式法则反向计算各层的梯度。
  3. 更新权重和偏置:根据计算出来的梯度调整网络中的参数。
int main() {
    NeuralNetwork nn(2, 3, 1);  // 输入层2个节点,隐藏层3个节点,输出层1个节点

    // 训练数据:XOR 问题
    Tensor inputs(4, 2);
    inputs.at(0, 0) = 0.0f; inputs.at(0, 1) = 0.0f;
    inputs.at(1, 0) = 0.0f; inputs.at(1, 1) = 1.0f;
    inputs.at(2, 0) = 1.0f; inputs.at(2, 1) = 0.0f;
    inputs.at(3, 0) = 1.0f; inputs.at(3, 1) = 1.0f;

    Tensor targets(4, 1);
    targets.at(0, 0) = 0.0f;
    targets.at(1, 0) = 1.0f;
    targets.at(2, 0) = 1.0f;
    targets.at(3, 0) = 0.0f;

    // 训练神经网络并打印误差
    for (int epoch = 0; epoch < 10000; ++epoch) {
        nn.backward(inputs, targets, 0.1f);
        
        if (epoch % 1000 == 0) {
            Tensor result = nn.forward(inputs);
            float error = 0.0f;
            for (int i = 0; i < result.getRows(); ++i) {
                error += fabs(result.at(i, 0) - targets.at(i, 0));
            }
            std::cout << "Epoch " << epoch << " - Error: " << error << std::endl;
        }
    }

    // 测试结果
    std::cout << "\nPredictions after training:" << std::endl;
    Tensor result = nn.forward(inputs);
    for (int i = 0; i < result.getRows(); ++i) {
        std::cout << "Input: (" << inputs.at(i, 0) << ", " << inputs.at(i, 1) << ") -> Predicted Output: "
                  << result.at(i, 0) << " (Expected: " << targets.at(i, 0) << ")" << std::endl;
    }

    return 0;
}

训练过程示例输出:

Epoch 0 - Error: 3.14223
Epoch 1000 - Error: 1.20052
Epoch 2000 - Error: 0.92576
Epoch 3000 - Error: 0.74195
Epoch 4000 - Error: 0.62143
Epoch 5000 - Error: 0.53142
Epoch 6000 - Error: 0.46065
Epoch 7000 - Error: 0.40239
Epoch 8000 - Error: 0.35162
Epoch 9000 - Error: 0.30650

Predictions after training:
Input: (0, 0) -> Predicted Output: 0.0243746 (Expected: 0)
Input: (0, 1) -> Predicted Output: 0.983215 (Expected: 1)
Input: (1, 0) -> Predicted Output: 0.984261 (Expected: 1)
Input: (1, 1) -> Predicted Output: 0.0229365 (Expected: 0)

解释:

  • 误差:误差随着训练进行逐渐减小,表示网络在学习过程中逐渐适应了数据。
  • 预测结果:经过训练后,网络能够较为准确地预测 XOR 数据的输出(0、1、1、0)。即使预测值与期望值之间可能有轻微差距,但在训练过程中,网络会继续优化,误差会变得越来越小。

2. 使用现代 C++ 特性优化

2.1 使用智能指针

在实际应用中,使用原始指针管理内存可能会带来内存泄漏等问题。通过使用 C++11 引入的 std::unique_ptrstd::shared_ptr,可以更加安全地管理内存。

#include <memory>

class NeuralNetwork {
public:
    NeuralNetwork() {
        layers.push_back(std::make_unique<SigmoidLayer>(2, 3));
        layers.push_back(std::make_unique<SigmoidLayer>(3, 1));
    }

    Tensor forward(const Tensor& input) {
        Tensor output = input;
        for (const auto& layer : layers) {
            output = layer->forward(output);
        }
        return output;
    }

    void backward(const Tensor& input, const Tensor& target) {
        Tensor output = forward(input);
        Tensor error = output;
        for (int i = 0; i < error.getRows(); ++i) {
            for (int j = 0; j < error.getCols(); ++j) {
                error.at(i, j) -= target.at(i, j);  // MSE
            }
        }

        for (int i = layers.size() - 1; i >= 0; --i) {
            layers[i]->backward(input, error);
            error = layers[i]->error;
        }
    }

    void update_weights(float learning_rate) {
        for (const auto& layer : layers) {
            layer->update_weights(learning_rate);
        }
    }

private:
    std::vector<std::unique_ptr<Layer>> layers;
};

2.2 并行化计算

对于大规模神经网络,计算量可能非常庞大,利用 C++ 的并行计算库(如 OpenMP)可以大幅提高计算效率。

#include <omp.h>

void matmul_parallel(const Tensor& A, const Tensor& B, Tensor& result) {
    int rows = A.getRows();
    int cols = B.getCols();
    
    #pragma omp parallel for
    for (int i = 0; i < rows; ++i) {
        for (int j = 0; j < cols; ++j) {
            result.at(i, j) = 0;
            for (int k = 0; k < A.getCols(); ++k) {
                result.at(i, j) += A.at(i, k) * B.at(k, j);
            }
        }
    }
}

3. 总结

本文介绍了如何使用 C++ 构建神经网络。通过从基础的神经网络构建、训练过程、优化策略,再到如何利用现代 C++ 特性进行性能优化,我们创建了一个简单但有效的神经网络实现。无论是出于学习目的还是性能需求,C++ 都是一种非常适合实现神经网络的编程语言,尤其是在需要高效计算和资源控制的应用中。

希望本文能帮助你更好地理解如何在 C++ 中实现神经网络,并掌握如何通过现代编程技术优化神经网络的性能。

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:/a/951377.html

如若内容造成侵权/违法违规/事实不符,请联系我们进行投诉反馈qq邮箱809451989@qq.com,一经查实,立即删除!

相关文章

音视频入门基础:MPEG2-PS专题(6)——FFmpeg源码中,获取PS流的视频信息的实现

音视频入门基础&#xff1a;MPEG2-PS专题系列文章&#xff1a; 音视频入门基础&#xff1a;MPEG2-PS专题&#xff08;1&#xff09;——MPEG2-PS官方文档下载 音视频入门基础&#xff1a;MPEG2-PS专题&#xff08;2&#xff09;——使用FFmpeg命令生成ps文件 音视频入门基础…

【Arthas命令实践】heapdump实现原理

&#x1f3ae; 作者主页&#xff1a;点击 &#x1f381; 完整专栏和代码&#xff1a;点击 &#x1f3e1; 博客主页&#xff1a;点击 文章目录 使用原理 使用 dump java heap, 类似 jmap 命令的 heap dump 功能。 【dump 到指定文件】 heapdump arthas-output/dump.hprof【只 …

【JavaEE】—— SpringBoot项目集成百度千帆AI大模型(对话Chat V2)

本篇文章在SpringBoot项目中集成百度千帆提供的大模型接口实现Chat问答效果&#xff1a; 一、百度智能云 百度千帆大模型平台是百度智能云推出的一个企业级一站式大模型与AI原生应用开发及服务平台。 注册地址&#xff1a;https://qianfan.cloud.baidu.com/ 注册成功后&…

【我的 PWN 学习手札】IO_FILE 之 FSOP

FSOP&#xff1a;File Stream Oriented Programming 通过劫持 _IO_list_all 指向伪造的 _IO_FILE_plus&#xff0c;进而调用fake IO_FILE 结构体对象中被伪造的vtable指向的恶意函数。 目录 前言 一、glibc-exit函数浅析 二、FSOP 三、Largebin attack FSOP &#xff08;…

语音技术与人工智能:智能语音交互的多场景应用探索

引言 近年来&#xff0c;智能语音技术取得了飞速发展&#xff0c;逐渐渗透到日常生活和各行各业中。从语音助手到智能家居控制&#xff0c;再到企业客服和教育辅导&#xff0c;语音交互正以前所未有的速度改变着人机沟通的方式。这一变革背后&#xff0c;人工智能技术无疑是关键…

三、Angular 路由

一、简介 Angular 的路由服务是一个可选的服务&#xff0c;它用来呈现指定的 URL 所对应的视图。它并不是Angular 核心库的一部分&#xff0c;而是位于 angular/router 包中。像其他 Angular 包一样&#xff0c;路由服务在用户需要时才从此包中导入。 [1]. 创建路由模块 默认…

NFS 组件容器化部署实战指南

文章目录 前言部署NFS服务器K8S部署NFS问题记录 前言 使用nfs-client-provisioner这个应用&#xff0c;利用nfs server给kubernets提供作为持久化后端&#xff0c;并且动态提供pv。所有节点需要安装nfs-utils组件&#xff0c;并且nfs服务器与kubernets worker节点都能网络连通…

uc/os-II 原理及应用(八) 系统裁减以及移植到51单片机上

两个习题 先了解下CPU上函数调用的过程: 一个程序取得函数地址&#xff0c;先保护现场将局部变量及参数压栈&#xff0c;再将调用函数的参数压栈&#xff0c;然后跳转到函数位置&#xff0c;将参数出栈&#xff0c;执行代码&#xff0c;结束后返回到调用位置&#xff0c;再怖复…

el-table自定义按钮控制扩展expand

需求&#xff1a;自定义按钮实现表格扩展内容的展开和收起&#xff0c;实现如下&#xff1a; 将type“expand”的表格列的宽度设置为width"1"&#xff0c;让该操作列不展示出来&#xff0c;然后通过ref动态调用组件的内部方法toggleRowExpansion(row, row.expanded)控…

NLP中常见的分词算法(BPE、WordPiece、Unigram、SentencePiece)

文章目录 一、基本概念二、传统分词方法2.1 古典分词方法2.2 拆分为单个字符 三、基于子词的分词方法&#xff08;Subword Tokenization&#xff09;3.1 主要思想3.2 主流的 Subword 算法3.3 Subword 与 传统分词方法的比较 四、Byte Pair Encoding (BPE)4.1 主要思想4.2 算法过…

MTK平台-- 无线AP隔离功能

前言: 无线AP上大都有一个选项:启用该功能后,连接到同一AP的无线终端之间不能互相通信,但该功能并不限制无线终端和有线终端之间的通信。 Hostapd参数ap_isolate,用于控制AP隔离,但hostapd本身并不实现这一功能,只是将该参数通过nl80211传递给mac80211,由mac80211来实…

redis:安装部署、升级以及失败回退

安装部署 一、准备工作 1. 检查系统要求 确保你的服务器满足 Redis 的基本要求: 操作系统:支持的 Linux 发行版(如 Ubuntu, CentOS)内存:至少 4GB(根据实际应用需求调整)CPU:单核或多核 CPU磁盘空间:足够的磁盘空间用于数据存储和日志记录2. 更新系统软件包 在开始…

模型 断裂点理论(风险控制)

系列文章 分享模型&#xff0c;了解更多&#x1f449; 模型_思维模型目录。设置小损失&#xff0c;防止大风险。 1 断裂点理论的应用 1.1 电路系统中的保险丝应用 背景介绍&#xff1a; 在工程学中&#xff0c;电路系统是现代科技中不可或缺的一部分&#xff0c;广泛应用于各…

通义灵码在跨领域应用拓展之物联网篇

目录 一.引言 二.通义灵码简介 三.通义灵码在物联网领域的设备端应用 1.传感器数据采集 (1).不同类型传感器的数据读取 (2).数据转换与预处理 2.设备控制指令接收和执行 (1).指令解析与处理 (2).设备动作执行 四.通义灵码在物联网领域的云端平台应用 1.数据存储和管…

Win32汇编学习笔记09.SEH和反调试

Win32汇编学习笔记09.SEH和反调试-C/C基础-断点社区-专业的老牌游戏安全技术交流社区 - BpSend.net SEH - structed exception handler 结构化异常处理 跟筛选一样都是用来处理异常的,但不同的是 筛选器是整个进程最终处理异常的函数,但无法做到比较精细的去处理异常(例如处理…

详细数据库MySQL查询语句

查询语句 &#xff08;SELECT [ALL|DISTINCT] <目标列表达式> [,<目标列表达式>] FROM <表名或视图名> [,<表名或视图名>]|(<SELECT 语句>) [AS] <别名> [WHERE <条件表达式>] [GROUP BY <列名1> [HAVING <条件表达式…

解决anaconda prompt找不到的情况

由于打开某个文件夹导致系统卡死了&#xff0c;鼠标使用不了&#xff0c;只能使用快捷键ctrlaltdelete打开&#xff0c;点任务管理器也没什么用&#xff0c;就点了注销选项。 注销&#xff1a;清空缓存空间和注册表信息&#xff0c;向系统发出清除现在登陆的用户的请求。 导致…

计算机网络 (31)运输层协议概念

一、概述 从通信和信息处理的角度看&#xff0c;运输层向它上面的应用层提供通信服务&#xff0c;它属于面向通信部分的最高层&#xff0c;同时也是用户功能中的最低层。运输层的一个核心功能是提供从源端主机到目的端主机的可靠的、与实际使用的网络无关的信息传输。它向高层用…

【C++经典例题】求1+2+3+...+n,要求不能使用乘除法、for、while、if、else、switch、case等关键字及条件判断语句

&#x1f493; 博客主页&#xff1a;倔强的石头的CSDN主页 &#x1f4dd;Gitee主页&#xff1a;倔强的石头的gitee主页 ⏩ 文章专栏&#xff1a; 期待您的关注 题目描述&#xff1a; 原题链接&#xff1a; 求123...n_牛客题霸_牛客网 (nowcoder.com) 解题思路&#xff1a; …

开关不一定是开关灯用 - 命令模式(Command Pattern)

命令模式&#xff08;Command Pattern&#xff09; 命令模式&#xff08;Command Pattern&#xff09;命令设计模式命令设计模式结构图命令设计模式涉及的角色 talk is cheap&#xff0c; show you my code总结 命令模式&#xff08;Command Pattern&#xff09; 命令模式&…