首页 > 传媒 > 关键词  > 人工智能最新资讯  > 正文

对话aiXcoder总裁刘德欣:智能化软件开发2.0时代,企业如何落地领域化大模型

2024-08-16 10:39 · 稿源: 站长之家用户

科技日新月异的今天,以大模型、Agent等为代表的人工智能技术正引领各行各业的深刻变革。软件开发领域,一场由AI驱动的产业智能化升级快速演变,进入智能化软件开发2.0时代。

近日,我们采访了硅心科技(以下简称:aiXcoder)总裁刘德欣,主要围绕企业如何落地领域化大模型,如何更好地拥抱智能化软件开发2.0时代等话题进行深入探讨。以下内容根据采访实录整理。

请刘总简单介绍下智能化软件开发1.0时代及其发展现状?

智能化软件开发1.0时代可以说是通过引入大模型技术,集中实现了软件开发的一些初级自动化场景,包括代码生成、代码补全、单元测试生成和缺陷检测等。系统也支持简单的需求捕获和拆分等任务。但是,这些功能通常是以独立的方式执行,不能深入理解和应用企业特定的业务逻辑。

目前国内外的玩家主要有GitHub的Cop ilot、Amazon的CodeWhisperer、百度的comate 、阿里的通义灵码、甚至包括我们aiXcoder的上一代产品等。各家产品在功能和能力上差异并不大,缺乏明显的差异化。尽管产品在宣传中,强调了具有更强的上下文理解能力和更大的参数量,甚至与GPT-3.5等模型进行比较占据优势,但实际上并没有真正解决大模型与企业领域知识融合这一核心问题,使得它们无法满足企业基于自身的业务落地大模型的需求,简单来讲,觉得大模型学不会自己企业的领域知识,幻觉和生成结果不确定性严重;而这种孤立性和对业务逻辑的理解不足,也导致了其产品对软件开发复杂需求的处理浮于表面,实际上代码输出的准确性和实用性往往会大打折扣,限制了其在实际企业业务环境中的应用效果和用户的信任度。

您认为智能化软件开发1.0时代具体存在的问题有哪些?

智能化软件开发1.0存在的问题主要问题是不进行有效个性化训练而直接落地大模型,这会直接产生两大缺陷:应用模式缺陷和技术缺陷。

首先,从应用模式来看,主要缺陷表现在两个方面。

首先,在训练层面,缺乏对业务原始需求与设计的考量。1.0时代的产品往往只关注代码本身的语法和结构,忽略了代码必须服务于具体的业务需求和逻辑,所以并没有将需求分析和设计文档等企业背景知识融合进模型的训练中,导致生成/补全的代码往往缺乏业务逻辑,从而使产品的准确性和可用性不足。

第二,在测试层面,无法形成需求到测试的闭环。测试自动化在1.0时代通常只基于现有代码进行,忽略了测试的本质是验证需求的完整性和正确性,没能深入到需求层面,而是仅依赖于代码级的表面生成,没有实现对原始需求的全面交互和验证。

其次,从技术缺陷来看,主要表现在三个方面。

一是环境依赖信息的缺失,现在的大模型训练主要是在开源代码及企业代码上的训练,这种脱离企业背景知识,仅对代码训练的方式,依然缺乏足够的项目上下文支持,这导致生成的代码虽然在语法上正确,但经常与项目的实际业务需求不符。虽然各大模型厂商都在上下文长度上努力,但并不会从根源上解决这一技术缺陷。

二是当前的智能化开发辅助主要依赖于大模型的语言能力,通过模式匹配和简单的Prompt指令生成代码。然而,这种方法仅停留在表层语言模型的使用上,无法深入理解复杂的业务逻辑和编程规范,导致大模型在实际应用中的表现不尽如人意,影响了结果的有效性和可靠性,尤其是生成内容的可靠性仍然存在较大问题。

三是微调方法的局限性,尽管在1.0时代我们采用了全参微调(Fine Tuning)、以及LoRa、Adapter、Prompt等PEFT有效参数微调(部分参数微调)方式,甚至尝试使用RAG和MoE等方法让大模型学习特定领域知识,但这些常规微调技术和方法仍存在局限性。尽管它们在某些特定任务中表现出一定的效果,但由于没有充分训练企业领域的专有数据和背景知识,这些方法在真实业务应用中的表现往往难以达到预期,无法完全满足实际业务的需求。

从客户角度来看,我们发现很多大模型在通用的场景或者主流的测评集上表现都不错,声称也能达到30%到50%的准确率。但是一旦拿到企业中去应用,通常发现准确率下降到了10%以下。即使用各种方式做微调,效果也不尽如人意。对于企业而言,技术团队和商务团队尽力引入并上线了智能软件开发产品,也进行了相应的微调,但如果最终结果无法达到预期,可能会引发内部大量用户和软件开发人员的投诉,带来巨大的风险。综合来看,真实企业软件开发场景是非常复杂的,具有很强的业务逻辑、拥有明确的编码规范和独特的代码风格,在多阶段的复杂开发流程中更是涉及多角色、多工具、多团队的共同协作参与。尽管智能化软件开发1.0时代提供了一定的软件自动化支持,但其并没有真正解决企业领域知识问题,也没有充分考虑真实开发场景的复杂需求。所以基于这样一个背景,aiXcoder率先提出了软件开发2.0时代的概念,并已成功在多家大型企业中落地实施。通过这一模式,企业才能真正抓住并充分利用大模型所带来的技术红利。

aiXcoder如何定义智能化软件开发2.0时代的?

智能化软件开发2.0时代:首先通过严格的数据治理和链式管理,对企业的特定领域知识进行全面的结构化处理,确保从需求定义、设计、编码到最终代码提交的每个环节都得到准确记录和系统关联。在此基础上,进行低成本、高度个性化的模型训练,构建基于领域的软件工程大模型。通过多智能体协同自动化、传统软件开发方法和理想实践的有机结合,全面保障了开发流程的有效性与结果的准确性,使大模型从单一的代码生成工具转变为与企业开发过程深度协同的智能体集合,显著提升了开发效率和产品质量。

我们所定义的智能化软件开发2.0时代,其核心概念并不复杂。可以用一个公式来概括:智能化软件开发2.0= 专业软工领域大模型 + 多Agent协同 + 传统软件工程方法。

首先,本阶段的智能软件开发强调对软件研发流程的高度数据治理。整个开发全过程,从需求分析、概要设计、详细设计、编码实现、测试,直到最终产品上线,每一个环节都通过结构化的数据治理和全面的数据链管理进行链式数据追踪,确保软件开发的原始需求被比较准确记录并与系统紧密关联。这种全链条的协同工作方式,不仅使得大模型能够较大程度地理解企业特定的业务逻辑,还能够在开发的每一个阶段中准确反映这些逻辑。同时,基于经过治理的领域化数据集,对模型进行个性化训练,使大模型能够深入学习并应用企业的领域知识,从而构建一个低成本、高度个性化的企业领域化大模型,这将是最关键的一步。此外,在实现领域个性化的基础上,通过多Agent方式处理软件开发流程中的各类任务,并结合传统的软件开发方法、工具和理想实践,确保了领域大模型输出的准确性和可靠性。

这种结合了专业软工领域大模型、多Agent协同,以及传统软件工程方法、工具与理想实践的协同自动化方式,正是我们所定义的智能化软件开发2.0时代。

根据智能化软件开发2.0时代的定义和特性,刘总,您认为企业在迈入2.0时代时,应该重点关注哪些关键行动或策略?有哪些具体的准备工作是企业需要优先考虑的?

结合多年来我们团队对软件工程领域的深刻理解,以及aiXcoder在企业领域化大模型落地方面的丰富经验。我们总结了以下4个核心策略,帮助企业更好的拥抱智能软件开2.0时代。

首先是面向领域的开发数据治理,这一点非常关键。简而言之,企业需要对最原始的需求文档进行深入治理,将自然语言表达的“大白话”需求逐步转化为比较准确的开发语言描述,从需求分析、设计,到开发、测试及运维等环节的数据、知识都进行整合并进行全链条数据治理,并确保数据质量、规模与多样性,以服务于领域大模型的构建与优化。值得一提的是,这种数据管理框架和方法能够有效复用,日后大模型产生的海量数据都是基于该框架治理,从而可持续用于训练,这有助于提高企业在应对市场变化时的灵活性和响应速度。

第二是基于领域数据的个性化模型构建。通过利用治理好的领域知识数据集,并充分考虑企业算力资源、代码量等因素,对大模型进行灵活的个性化训练及参数调优,确保大模型能够准确捕捉并反映企业业务需求,使其逐步掌握企业特定的业务流程与逻辑、专业术语和编码规范。进一步地,通过应用PEFT、MoE、RAG和AI Agent等技术和方法,确保个性化训练能够根据企业具体业务需求进行灵活调整和优化。这样的策略不仅增强了模型的业务适应性,还提升了模型训练效率和输出的准确性。

第三点是将大模型的先进能力与传统软件工程的方法和工具相结合。许多企业在引入大模型后,往往倾向于完全依赖大模型,忽视了原本效果优异的软件开发工具。这种做法实际上并不合理,因为大模型虽然具有强大的能力,但其生成结果并非总是准确无误。为了确保大模型输出结果的准确性与可靠性,企业应继续结合和利用传统的软件工程工具与方法,使其与大模型协同工作,从而保障开发流程的时效性和结果的高质量。

最后一点是面向各场景的智能协同。通过引入Agent技术,将其与企业特有的软件开发流程和现有的软件开发工具相结合,以提升开发流程的透明度和效率。同时,确保所有自动化过程的合规性和可追踪性,实现需求分析、设计、编码、测试和部署等各个开发场景的深度协同。通过系统化的数据共享和流程整合,开发团队能够在各个阶段实现无缝衔接,从而更加有效地应对复杂的项目需求和快速变化的市场环境。

aiXcoder如何帮助企业落地智能软件开发2.0时代?

在与很多大型企业交流的过程中,我们发现目前企业普遍面临着搞不懂、训不转、学不会三大挑战,展开来讲,就是企业缺乏优秀人才,现有的技术人员搞不懂模型应该如何训练。有些企业技术积累较好,试图通过开源模型+各种微调的方式,尝试让大模型的能力更贴近企业的真实开发环境要求,最终还是发现大模型学不会企业的领域知识,效果不尽如人意。

为此,我们发布了一个大模型落地框架LLM Adoption Framework(LAF),旨在帮助企业了解如何将大模型与领域知识相结合,并利用我们的经验,帮助来自各个领域和行业的企业有效地部署和落地领域大模型。具体来说,该框架是一种咨询的方法论,分为以下三个阶段:首先个阶段,评估阶段。我们首先会根据企业的商业目标进行全面评估,深入了解企业已开展的工作,以及为何未能实现大模型落地的预定业绩目标,并分析导致这些差距的原因。第二阶段,模型构建及训练阶段。基于这些差距企业应该怎么选择模型,怎么准备和处理数据,如何训练模型,可以通过哪些数据治理的方法来达到预期的状态。此阶段旨在比较准确构建并优化大模型,确保模型深度融合并体现企业特有的领域知识。在这一阶段,不仅进行模型架构的设计与搭建,还包括针对企业独特业务逻辑和领域特定数据的深入治理及训练过程。第三阶段,上线及产品化阶段。这一阶段主要涉及产品化的过程。我们将帮助企业将领域大模型与其内部多个平台通过API进行集成,并确保模型能力能够有效输出到业务端,所有这些都需要根据企业的实际需求进行定制化实现。

总而言之,aiXcoder的LAF并非特定于任何一个开源/闭源大模型提供商,而是大量利用aiXcoder提供的大模型训练、领域经验和软件工程理想实践为企业提供更具体的深度咨询和指导。同时,aiXcoder的LAF不限制于aiXcoder模型使用,企业可以选择任何闭源和开源模型,它是完全可以通用的,并非aiXcoder“独门秘籍”,可以根据企业“领域知识”量身定制大模型落地实施及行动计划。

最后,总结一下我们的观点:

● 无论是开源还是闭源,选择专业的软件工程大模型,而不是通用大模型。

● 不关注大模型厂商宣传支持了多少功能和HumanEval、MBPP、MultiPL-E等常规的“打榜”评测集评测结果,要关注大模型实际生成内容是否真的理解企业的业务。

● 务必要结合领域知识治理并训练,再做进一步微调。直接使用常规的全参微调、有效微调、RAG等方式帮助不大。

● 大模型落地要高度自治、解耦,企业业务的复杂程度和连续性,更不允许绑定某个大模型厂商。

● 一定要做个性化训练,不能直接落地代码大模型,同时培养自己的技术人员,有效规避直接部署模型的高风险。

关于aiXcoder简介:aiXcoder孵化自北京大学软件工程研究所,创始团队均来自北京大学,是全球最早将深度学习技术应用于代码生成与代码理解领域的团队,也是最早将深度学习应用在编程产品的团队。公司专注于AIGC for Code领域,致力于将前沿人工智能技术应用于软件工程,为企业提供完备的智能化软件开发解决方案,包括私有化部署、领域化大模型落地及定制化开发等服务,现已在金融、军工、航空航天、通信、高科技等行业头部企业部署实施。目前已服务智能编程社区版产品用户80万+,获得广泛行业及众多C端开发者们的认可。

推广

特别声明:以上内容(如有图片或视频亦包括在内)均为站长传媒平台用户上传并发布,本平台仅提供信息存储服务,对本页面内容所引致的错误、不确或遗漏,概不负任何法律责任,相关信息仅供参考。站长之家将尽力确保所提供信息的准确性及可靠性,但不保证有关资料的准确性及可靠性,读者在使用前请进一步核实,并对任何自主决定的行为负责。任何单位或个人认为本页面内容可能涉嫌侵犯其知识产权或存在不实内容时,可及时向站长之家提出书面权利通知或不实情况说明,并提供身份证明、权属证明及详细侵权或不实情况证明(点击查看反馈联系地址)。本网站在收到上述法律文件后,将会依法依规核实信息,沟通删除相关内容或断开相关链接。

  • 相关推荐
  • 智能体时代,还得看豆包大模型

    火山引擎,又有大动作了。 2025年6月11日,火山引擎Force原动力大会发布豆包大模型1.6、视频生成模型Seedance1.0pro等重磅新模型,以及迭代了一站式AI云原生全栈服务。 对此,字节跳动CEO梁汝波表示:“做好火山引擎对字节跳动成为一家优秀的科技公司、保持技术竞争力很重要。未来,字节跳动会坚定长期投入,追求智能突破,服务产业应用。通过火山引擎,持续把新模型、新�

  • 深耕垂直物联场景,萤石蓝海大模型2.0 升级引领行业再跃迁

    萤石网络发布蓝海大模型2.0,聚焦智能家居垂直领域。该模型具备三大核心能力升级:1)感知能力实现1200种目标识别,支持动物种类精细分类;2)理解能力支持多模态分析,包括视频、听觉及混合理解;3)记忆能力构建目标/设备/用户三维画像体系。作为行业首个家居专用大模型,已落地65款产品,服务调用量半年增长400%。同时推出EZVIZ HomePlay OS系统,开放软硬件能力,构建混合算力中心等基础设施,推动智能家居场景创新。在开发者大会上,萤石还展示了养老看护等碎片化场景解决方案,通过垂直领域深度优化实现低成本高效应用。

  • @开发者们:百度文心大模型4.5系列模型开源,国内首发平台GitCode现已开放下载!

    6月30日,百度文心大模型4.5系列正式开源并在国内领先的开源平台GitCode首发上线。该系列包含10款模型,涵盖47B和3B参数的混合专家(MoE)模型及0.3B的稠密参数模型,采用创新的多模态异架构结构实现跨模态知识融合。模型基于飞桨框架开发,训练效率达47% MFU,在文本和多模态基准测试中达到SOTA水平。所有模型按Apache2.0协议开源,配套产业级开发套件支持多种芯片部署。GitCode平台已汇聚620万用户,为AI开发者提供代码托管、协同开发等全流程支持。此次开源将推动中国AI生态创新,加速大模型技术产业化应用。

  • 阳光新能源iSolarSim 2.0仿真软件:搭载AI智能体,开启对话式仿真!

    阳光新能源在2025SNEC展会上发布iSolarSim光伏发电仿真软件2.0版本,该软件搭载AI技术实现三大突破:1)首创"实景仿真双引擎",通过"精准实景+深度实景"双模式,将仿真精度提升2.5%;2)集成行业首个AI智能体,支持对话式仿真操作,计算效率提升90%;3)实现万级方案秒级寻优,3分钟完成万组设计方案仿真,效率提升千倍。软件覆盖地面电站、工商业及家庭光伏全场景,特别针对中国家庭光伏市场开发了人字坡/双面发电仿真等特色功能,其中双面仿真精度提升超2%。该解决方案有效解决了传统仿真软件精度不足、评估偏差大等行业痛点。

  • AI日报:通义千问3大模型全球爆火;即梦图片3.0智能参考全量上线;智谱AI企业级超级助手Agent CoCo上线

    【AI日报】今日AI领域重要动态:1.通义千问3大模型全球下载量超1250万,衍生模型13万+;2.即梦图片3.0上线,AI设计进入"零门槛"时代;3.智谱AI发布企业级超级助手Agent CoCo;4.百度推出金融行业大模型"千帆慧金";5.小红书开源首个大模型dots.llm1,含1420亿参数;6.Hugging Face开源LeRobot项目,降低机器人研发门槛;7.ChatGPT语音功能升级,支持更自然对话翻译;8.Google Gemini应用下载量超ChatGPT但活跃度不足;9.轻量级文档解析模型MonkeyOCR表现优异;10.Google Veo3推出高速视频生成模式;11.Google调整AI Studio政策,限制Gemini2.5Pro免费访问。

  • 预测大模型的工业生存法则,华为博士告诉你什么才是B端最需要的大模型!

    华为开发者大会2025期间,AI专家李良基与华为团队围绕预测大模型展开深度对话。华为提出"数据原子级表征体系"理念,旨在通过统一数据编码解决跨场景迁移难题。预测大模型已在钢铁行业成功应用,温度预测准确率远超传统方案。专家指出,AGI发展的核心在于构建知识迁移能力,未来将聚焦To B场景落地,通过统一架构实现跨领域泛化应用。华为云首创Triplet Transformer

  • 车企智能化竞速赛,福瑞泰克打出“智享全民版”王牌!

    全球智能驾驶行业快速发展,福瑞泰克凭借技术创新在城市场景率先发力。近期与某自主品牌达成合作,推出"智享全民版"方案,支持L2.9级智能驾驶功能,实现高速到城区的端到端辅助通行。该方案基于自研ODIN3.0平台,以亲民价格推广智能驾驶技术。2025年上海车展上,福瑞泰克发布多项辅助驾驶新技术,其中ADC25-J方案尤为亮眼,将NOA功能从高速扩展至城市通勤场景。中阶辅助驾驶市场正成为新蓝海,福瑞泰克凭借成熟技术和工程化能力占据优势,其城市智驾方案成为开拓新市场的重要筹码。

  • AI日报:腾讯混元3D 2.1大模型开源;字节跳动AI Lab负责人李航卸任;OpenAI Codex 全新升级

    本文介绍了AI领域最新动态:1)腾讯开源混元3D2.1大模型,提升3D生成质量;2)OpenAI Codex升级,优化代码生成功能;3)字节跳动AI Lab负责人李航卸任;4)微软发布700个AI应用案例;5)微软推出Code Researcher工具,解决58%系统崩溃问题;6)Observer AI实现屏幕操作自动化;7)Genspark发布AI浏览器;8)麻省理工用AI技术3.5小时修复15世纪名画;9)蚂蚁集团推出开源多模态GPT-4o模型Ming-Omni;10)MagicTryOn视频换衣框架;11)字节跳动发布实时互动AI视频生成模型Seaweed APT2;12)ChatGPT搜索功能升级;13)字节跳动与老凤祥合作开发AI智能眼镜。

  • 秦淮数据吴华鹏:未来智算中心将呈现离网供电、高弹性和智能化三大趋势

    2025年6月11-12日,火山引擎春季FORCE原动力大会在北京举行,聚焦AI时代算力基础设施发展。秦川数据&BDC CEO吴华鹏指出,AI爆发式发展带来能源和功耗密度挑战,未来智算中心需具备三大能力:离网能源供给、模块化高弹性部署和业务深度智能化。国际能源署预测,到2030年全球数据中心用电量将翻倍。为此,超大规模智算中心需要独立能源解决方案,采用模块化设计提升资产利用效能,并通过AI技术实现全周期智能化运维。秦川数据正打造高弹性智算中心解决方案,探索新型供电模式,持续推动技术创新。

  • 水滴信用惊艳亮相火山引擎原动力大会,展示企业大数据大模型成果

    6月11日,2025火山引擎春季FORCE原动力大会在北京国家会议中心举行。大会聚焦大模型与AI云原生等前沿技术,汇聚行业精英探讨AI转型机遇与创新产品落地路径。水滴信用作为合作伙伴惊艳亮相,展示其企业大数据MCP成果。火山引擎智能算法负责人吴迪发表主题演讲,介绍其MCP服务通过搭建三座桥梁连接开发者生态、大模型工具和云服务,助力构建复杂Agent系统。水滴信用凭借多年企业数据服务积累,整合全国超3.7亿市场主体信用信息,推出企业大数据MCP解决方案,实现企业信用信息一站式智能分析。此次合作不仅展示技术实力,更为企业信用信息服务行业智能化升级树立新标杆,推动行业迈向"数据驱动、智能决策"新时代。