本书是关于如何从零开始构建大模型的指南,由畅销书作家塞巴斯蒂安·拉施卡撰写,通过清晰的文字、图表和实例,逐步指导读者创建自己的大模型。在本书中,读者将学习如何规划和编写大模型的各个组成部分、为大模型训练准备适当的数据集、进行通用语料库的预训练,以及定制特定任务的微调。此外,本书还将探讨如何利用人工反馈确保
软件测试作为软件开发生命周期中至关重要的一环,其重要性不言而喻。本书旨在为各层次的测试人员提供一个较全面的知识体系。本书共5章。第1章人行必读:职业发展路线,详细介绍软件测试初、中、高级工程师以及测试经理职业发展路线。第2章初人职场:初级工程师两步走,详细介绍如何融入团队以及如何有效执行任务。第3章小试牛刀:中级工程师
本书构建源网荷储协同优化模型,核算新能源高渗透率电力系统的综合成本效能特征;考虑风电和光伏长期投建边界的不确定性,构建“双碳”目标约束下“风光+储”长期投建规划模型,从电能供给安全的角度出发,模拟测算短时间尺度内精细化运行与可靠性评估优化问题;基于灵活性调节储能资源新业态和各主体间交互特征的综合能源系统,构建“上层投建
本书内容包括模拟自然界中生物和动物的觅食行为、寻偶行为、交配行为、迁徙策略、狩猎策略等过程中蕴含的优化机制和群体智能行为,原创的106种群智能优化算法。这些生物和动物有分布在广袤土地上蚂蚁、蜜蜂、萤火虫、蝴蝶、蜻蜓、蜘蛛、天牛、瓢虫等多种昆虫,有浩瀚海洋中的麟虾、被囊群、水母、口孵鱼、海豚、鲸鱼等多种鱼类,有茂密森林草
本书通过30个应用机器学习模型和算法的实际案例,为读者提供较为详细的实战方案,以便进行深度学习。在编排方式上,全书侧重对创新项目的过程进行介绍,分别从整体设计、系统流程、实现模块等角度论述数据处理、模型训练和模型应用,并剖析模块的功能、使用及程序代码。为便于读者高效学习、快速掌握人工智能程序开发方法,本书配套提供项目设
本书分为4篇,共12章。第1篇(第1、2章)准备篇,主要介绍Hadoop和Spark的基本概念,以及如何快速搭建Hadoop和Spark的学习环境。第2篇(第3-6章)入门篇,涵盖Hadoop的高级特性、Spark的基础知识与高级特性,以及大数据安全。第3篇(第7-10章)进阶篇,深入讲解数据采集与清洗、数据存储与管理
本书揭示了从最早的文明到现在科学崛起的主要阶段和转折点:科学是如何被“发现”的,为什么它消失了几次,它是什么时候变得“现代”的等内容,书中还探讨了当前科学中的指数级增长、好奇心驱动型研究与目标导向型研究、大科学和小科学、对科学的支持、科学与社会的关系,以及科学的利与弊等。
本书共分为4章:Part01对航天器的定义、作用、分类、未来趋势等基础问题进行了解答。Part02对与航天器结构、制造相关的问题进行了解答。Part03对与航天器发射相关的问题进行了解答。Part04对与航天器在轨运行、地面控制、回收着陆、航天员操作相关的问题进行了解答。为了帮助读者理解复杂的航天知识,同时也为了增强图
本书作者以自身经历为证:从日本庆应义塾大学医学部尖子生,到以全球前1%高分通过美国医生执照考试,他揭秘了科学验证的高效学习策略。书中直击四大学习误区——反复阅读、抄写笔记、划重点、依赖“学习风格”,并给出四大利器:主动回忆:用“白纸默写法”替代被动输入,激活长期记忆;分散学习:间隔重复破解遗忘曲线,让知识牢固扎根;交叉
开源软件供应链是指开源软件在开发和运行过程中涉及的所有开源软件的上游社区、源码包、二进制包、第三方组件分发市场、应用软件分发市场,以及开发者和维护者、社区、基金会等,按照依赖、组合等形成的供应关系网络。相较于传统软件供应链,开源软件供应链随着供应层级不断加深,其规模不断扩大,导致针对上游的攻击将更难被发现、影响范围更广