【学习笔记】【DeepSeek AI 医生】2-3 项目架构及技术选型详细讲解

AI 时代程序员必备技能

Codex、Claude Code、Cursor、Hermes Agent、OpenClaw等工程化实战专栏 ,讲透 AI 如何接管脏活累活

在这里插入图片描述

关键词介绍

一、mysql 与 Mybatis

MySQL与MyBatis的关系主要体现在数据库访问和操作层面。以下是关于MySQL和MyBatis的详细介绍及它们之间的协同工作方式:

1.1、MySQL

  • 关系型数据库管理系统(RDBMS)
  • 由瑞典MySQL AB公司开发,目前属于Oracle旗下产品。是目前最流行的关系数据库管理系统之一,尤其在Web应用方面表现出色。它采用SQL(结构化查询语言)来管理和操作数据,将数据保存在不同的表中,通过外键建立表与表之间的关联,从而提高了数据存取的速度和操作的灵活性。
  • 支持多种存储引擎,如InnoDB、MyISAM等,InnoDB 存储引擎提供了事务支持和行级锁定,适用于对数据完整性和并发性要求较高的应用;而MyISAM存储引擎则在查询性能方面表现出色,适用于以读为主的应用

1.2、MyBatis

  • 一个基于Java的持久层框架,它通过XML描述符或注解将对象与存储过程或SQL语句进行映射,实现了对关系数据库的操作。MyBatis的前身是iBATIS,由Clinton Begin在2002年首次发布。2010年,iBATIS项目更名为MyBatis,并推出了MyBatis 3,引入了Mapper接口和注解等新的配置方式,使得代码更加简洁明了。

  • MyBatis的主要优点包括

  1. 简单易学:MyBatis设计简洁,没有复杂的第三方依赖,易于学习和使用。
  2. 灵活性强:MyBatis不会对应用程序或数据库的现有设计强加任何影响,开发人员可以使用熟悉的SQL语句、存储过程和数据库触发器等。
  3. SQL可控性强:MyBatis允许开发人员自定义SQL语句,对于复杂查询和多表关联查询提供了更好的支持。
  4. 解除SQL与程序代码的耦合:MyBatis通过提供DAO层(数据访问对象),将业务逻辑和数据访问逻辑分离,提高了系统的可维护性和可扩展性。

MySQL与MyBatis的协同工作

  1. 数据源配置:在使用MyBatis访问MySQL数据库时,首先需要在MyBatis的配置文件中配置数据源(DataSource),包括数据库URL、用户名、密码等信息。这样,MyBatis才能与MySQL数据库建立连接。
  2. SQL映射:MyBatis允许开发人员在XML文件或注解中定义SQL查询、插入、更新和删除语句。这些SQL语句与Java对象之间的映射关系由MyBatis管理。当执行数据库操作时,MyBatis会根据映射关系自动将Java对象转换为SQL语句的参数,或者将数据库查询结果映射到Java对象中。
  3. 会话管理:MyBatis通过SqlSession(会话)对象来管理数据库操作。开发人员可以通过SqlSession对象执行预定义的SQL语句,并处理结果集。SqlSession对象由SqlSessionFactory创建,而SqlSessionFactory则通过加载MyBatis的配置文件来初始化。
  4. 自动映射:MyBatis可以自动将数据库查询结果映射到Java对象中,简化了数据转换的过程。同时,MyBatis还支持对象关系映射(ORM),使得开发人员可以更方便地处理对象与数据库表之间的映射关系。

MySQL与MyBatis是构建Java Web应用时常用的数据库和持久层框架组合。MySQL负责存储和管理数据,而MyBatis则提供了便捷的方式来访问和操作这些数据。通过合理的配置和使用,MySQL与MyBatis可以协同工作,提高开发效率,降低维护成本

二、Ollama

  • 一个开源框架,专为在本地机器上便捷部署和运行大型语言模型(LLMs)而设计

2.1、Ollama 的核心特点

  1. 简化部署:Ollama通过类似Docker的容器化技术,简化了在本地环境中部署和管理大型语言模型的过程。用户无需复杂的配置,即可快速启动和运行模型。
  2. 轻量级与可扩展:Ollama作为轻量级框架,资源占用较小,同时具备良好的可扩展性。用户可以根据需要调整配置,以适应不同规模的项目和硬件条件。
  3. API支持:Ollama提供了一个简洁的API,使得开发者能够轻松创建、运行和管理大型语言模型实例。这降低了与模型交互的技术门槛,使得更多用户能够利用大型语言模型进行自然语言处理任务。
  4. 预构建模型库:Ollama包含一系列预先训练好的大型语言模型,用户可以直接选用这些模型应用于自己的应用程序,无需从头训练或自行寻找模型源。
  5. 自定义选项:Ollama支持用户自定义模型配置,包括从特定平台导入已有的大型语言模型,以及兼容PyTorch或Safetensors等深度学习框架,允许用户将基于这些框架训练的模型集成到Ollama中。

2.2、Ollama的使用场景

  1. 学术研究:研究人员可以利用Ollama在本地环境中高效运行大型语言模型,进行自然语言处理领域的学术研究。
  2. 开发测试:开发者可以使用Ollama在本地测试和优化大型语言模型,提高开发效率。
  3. 隐私保护:由于所有与模型的交互都在本地进行,Ollama有助于保护用户数据的隐私和安全。

2.3、Ollama的安装与使用

Ollama支持多种操作系统,包括macOS、Windows(预览版)、Linux以及Docker。用户可以在Ollama的官方网站或GitHub页面上找到详细的安装指南和使用说明。

2.4、注意事项

  1. 安全风险:Ollama的默认设置可能存在一定的安全风险,如未授权访问漏洞。用户需要采取适当的防护措施,如限制API访问范围、使用防火墙等,以确保设备的安全。
  2. 资源占用:运行大型语言模型需要消耗较多的计算资源。用户在使用Ollama时,需要确保本地机器具备足够的性能来支持模型的运行。

简而言之,Ollama是一个功能强大的开源框架,为开发者和研究人员在本地环境中高效利用大型语言模型提供了便捷的工具和平台。

三、DeepSeek-R1 和 DeepSeek-V3

DeepSeek-R1和DeepSeek-V3是由中国AI初创公司深度求索(DeepSeek)研发的两款大型语言模型,它们在定位、功能、性能和应用场景等方面各有侧重。以下是关于这两款模型的详细比较:

3.1、定位与功能

  1. DeepSeek-R1

    • 定位:主打推理任务,专攻解决复杂问题,适合深度逻辑分析。
    • 功能:重点训练思维链推理,擅长数学、代码和自然语言推理等复杂任务。
  2. DeepSeek-V3

    • 定位:多功能大型语言模型,注重可扩展性和高效率,适合各种语言处理任务。
    • 功能:在数学、多语言和编码任务中表现出色,支持多种语言应用,具有广泛的适用性。

3.2、性能参数

  1. DeepSeek-R1

    • 架构:采用强化学习进行后训练,提升推理能力。
    • 参数规模:有不同规模的版本,参数在15亿到700亿之间。
    • 测试表现:在需逻辑思维的测试中表现抢眼,如DROP任务F1分数92.2%,AIME 2024通过率79.8%。
  2. DeepSeek-V3

    • 架构:采用MoE(混合专家)架构,实现高效计算。
    • 参数规模:总参数高达6710亿,每个token激活370亿参数。
    • 训练特点:使用FP8混合精度训练,训练过程包括高质量训练、扩展序列长度、SFT和知识蒸馏三个阶段。
    • 测试表现:在Cmath得分90.7%,Human Eval编码通过率65.2%,表现出色。

3.3、应用场景

  1. DeepSeek-R1

    • 适用场景:适合学术研究、问题解决应用、决策支持等需要深度推理的场景,也可做教育工具。
    • 实例应用:已在百度搜索、快影等平台上线,为用户提供深度推理服务。
  2. DeepSeek-V3

    • 适用场景:适用于大型语言任务,如对话式AI、多语言翻译、内容生成等,助力企业高效解决各种问题。
    • 实例应用:已在多个云平台上线,支持公有云在线部署和私有化实例部署,广泛应用于各个领域。

3.4、其他特点

  1. DeepSeek-R1

    • 开源性:完全开源,采用MIT许可协议,降低了AI应用门槛。
    • 易用性:经过工程化打磨,更适合非技术用户直接使用。
  2. DeepSeek-V3

    • 高效性:生成速度相比上一代模型实现了显著提升。
    • 可扩展性:具有良好的可扩展性,能够支持大规模应用场景。

3.5、总结

DeepSeek-R1和DeepSeek-V3各有千秋,用户可以根据实际需求选择适合的模型。如果需要解决复杂推理问,DeepSeek-R1是更好的选择;如果需要处理多种语言任务,或者需要高效生成内容,DeepSeek-V3则更具优势。同时,由于DeepSeek-R1完全开源,对于希望深入研究模型的用户来说,也是一个不错的选择。

四、硅基流动

硅基流动(SiliconFlow)是一家专注于AI基础设施(AI Infra)领域的初创公司,成立于2023年8月,总部位于北京市海淀区。以下是对硅基流动的详细介绍:

4.1、公司背景与愿景

硅基流动由连续创业者袁进辉创立,其核心成员拥有丰富的IT行业经验和深厚的技术积累。公司致力于打造一个规模化、标准化、高效能的生成式AI计算基础设施平台,通过算法、系统与硬件的协同创新,降低AI应用的开发和使用门槛,助力企业和个人用户高效、低成本地部署AI模型。

4.2、主要产品与服务

硅基流动提供以下主要产品和服务:

  1. SiliconCloud模型云服务平台:该平台为开发者提供多种开源大模型API,包括满血版DeepSeek-R1 & V3、Qwen、FLUX.1、CosyVoice等在内的上百款主流模型。同时,平台还提供模型训练、微调、托管到部署的全链路支持,通过软硬件联合优化与加速,大幅降低推理部署成本,为用户提供极致高性能体验。
  2. SiliconLLM大语言模型推理引擎:这是硅基流动自研的推理加速引擎套件的一部分,专门为大语言模型提供高效的推理能力
  3. OneDiff高性能文生图/视频加速库:该加速库专为图像和视频生成任务设计,通过优化算法和硬件加速,提升生成速度和效率。

4.3、融资与合作伙伴

硅基流动在成立后的短时间内获得了多轮融资,包括天使轮和Pre-A轮融资。其中,Pre-A轮融资由华创资本领投,普华资本跟投,老股东耀途资本继续超额跟投,融资金额达到亿元人民币级别。此外,硅基流动还引入了美团作为战略股东,进一步增强了公司的资金实力和市场影响力。

在合作伙伴方面,硅基流动与华为、亚马逊云科技、英伟达等业内顶级云厂商、芯片厂商、大模型公司及应用公司建立了紧密的合作关系。这些合作伙伴为硅基流动提供了强大的技术支持和市场资源,共同推动AI基础设施的发展和应用。

4.4、市场反响与影响

硅基流动凭借其优秀的产品和服务,在市场上获得了广泛的认可和好评。特别是在DeepSeek-R1和V3模型发布后,硅基流动成为了国内首家提供DeepSeek-R1 API云服务的公司,吸引了大量开发者和企业的关注和使用。公司的用户数量和日均调用量均实现了爆发式增长,进一步巩固了硅基流动在AI基础设施领域的领先地位。

4.5、未来展望

硅基流动将继续深耕AI基础设施领域,不断推出更多优秀的产品和服务,满足企业和个人用户对AI模型高效、低成本部署的需求。同时,公司还将积极拓展国内外市场,与更多合作伙伴建立合作关系,共同推动AI技术的普及和应用。

总结来看,硅基流动是一家在AI基础设施领域具有强大实力和潜力的初创公司。其凭借优秀的产品和服务、强大的融资能力和合作伙伴关系,正逐步成为AI基础设施领域的佼佼者。

AI 时代程序员必备技能

Codex、Claude Code、Cursor、Hermes Agent、OpenClaw等工程化实战专栏 ,讲透 AI 如何接管脏活累活

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

ladymorgana

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值