高级搜索

留言板

尊敬的读者、作者、审稿人, 关于本刊的投稿、审稿、编辑和出版的任何问题, 您可以本页添加留言。我们将尽快给您答复。谢谢您的支持!

姓名
邮箱
手机号码
标题
留言内容
验证码

V-Agent:RISC-V自定义算术IP集成的协议驱动多智能体框架

李拓 王长红 程超 李国庆 李南君

李拓, 王长红, 程超, 李国庆, 李南君. V-Agent:RISC-V自定义算术IP集成的协议驱动多智能体框架[J]. 电子与信息学报. doi: 10.11999/JEIT260073
引用本文: 李拓, 王长红, 程超, 李国庆, 李南君. V-Agent:RISC-V自定义算术IP集成的协议驱动多智能体框架[J]. 电子与信息学报. doi: 10.11999/JEIT260073
LI Tuo, WANG Changhong, CHENG Chao, LI Guoqing, LI Nanjun. V-Agent: A Protocol-Driven Multi-Agent Framework for RISC-V Custom Arithmetic IP Integration[J]. Journal of Electronics & Information Technology. doi: 10.11999/JEIT260073
Citation: LI Tuo, WANG Changhong, CHENG Chao, LI Guoqing, LI Nanjun. V-Agent: A Protocol-Driven Multi-Agent Framework for RISC-V Custom Arithmetic IP Integration[J]. Journal of Electronics & Information Technology. doi: 10.11999/JEIT260073

V-Agent:RISC-V自定义算术IP集成的协议驱动多智能体框架

doi: 10.11999/JEIT260073 cstr: 32379.14.JEIT260073
详细信息
    作者简介:

    李拓:男,硕士,研究方向为芯片设计与系统架构。 lituo@inspur.com

    王长红:男,博士,研究方向为计算机体系结构与数字信号处理。 wangchh01@inspur.com

    程超:男,博士,研究方向为密码算法硬件加速、安全协处理器与AI芯片

    李国庆:男,博士,研究方向为人工智能加速器与边缘AI芯片

    李南君:男,博士,研究方向为人工智能算法设计与可重构硬件实现

    通讯作者:

    王长红 wangchh01@inspur.com

  • 中图分类号: TN79

V-Agent: A Protocol-Driven Multi-Agent Framework for RISC-V Custom Arithmetic IP Integration

  • 摘要: 针对大语言模型生成多模块寄存器传输级(Register Transfer Level, RTL)代码时,端口名称、方向和位宽不一致易导致集成失败的问题,提出V-Agent协议驱动多智能体框架。框架由架构、控制单元、数据通路和验证4类智能体组成,以JSON接口契约显式描述模块边界,并通过Verilog抽象语法树(Abstract Syntax Tree, AST)比对、编译/仿真诊断和受限重试形成“生成—检查—反馈—修复”闭环。在RISC-V单周期内核集成32位有符号组合乘法器IP的任务上,对6种大语言模型后端进行评测。纯自动化模式下,DeepSeek-V3和Claude-4.5生成的设计均实现8/8个模块编译通过并通过70/78条自动测试;人工在环修复后,6个设计均通过统一的78条测试,平均行级代码变动率为4.37%。结果表明,接口契约能够将跨智能体的隐式接口假设转化为可检查对象,并利用工具诊断定位局部生成错误,为RISC-V自定义算术IP的部分自动化集成提供了可执行的工作流。
  • 图  1  RISC-V核与CIM算术加速路径的逻辑集成架构

    图  2  V-Agent协议驱动多智能体架构及自动化/HITL反馈流程

    图  3  V-Agent的生成、静态检查、Verilator仿真与错误反馈闭环

    图  4  六个LLM后端及人工基准的FCR与自动测试通过率

    图  5  CIM算术执行单元原型的操作数选择、乘法执行与结果回写路径

    表  1  基于LLM的硬件设计方法比较

    方法 M-A Verif. S-C Custom Op.
    RTLCoder $ \times $ $ \times $ $ \times $ $ \times $
    ChipGPT $ \times $ Manual $ \times $ $ \times $
    VeriOpt $ \mathrm{\checkmark } $ PPA $ \mathrm{\checkmark } $ $ \times $
    REvolution $ \times $ Evol. $ \times $ $ \times $
    ChipSeek-R1 $ \times $ RL $ \mathrm{\checkmark } $ $ \times $
    V-Agent $ \mathrm{\checkmark } $ Contract $ \mathrm{\checkmark } $ $ \mathrm{\checkmark } $
    M-A: Multi-Agent; S-C: Self-Correction; Custom Op.: Experimental Custom Operation
    下载: 导出CSV

    表  2  实验原型中的自定义算术操作及集成行为

    名称操作码操作数来源集成行为
    MLOAD0001011数据存储器读取数据并写回寄存器
    PMUL0101011两个寄存器操作数调用32位有符号乘法器并写回
    PMAC0011011存储器数据与寄存器数据调用乘法器并接入回写路径
    下载: 导出CSV

    表  3  RISC-V自定义算术IP集成任务配置与复杂度指标

    属性数值说明
    设计配置
    体系结构单周期RISC-V单周期数据通路
    任务操作项总数52条标准指令 + 3个实验性自定义操作
    标准指令2ADDI, ADD
    实验性自定义操作3MLOAD、PMUL、PMAC
    设计复杂度
    RTL模块数8可综合模块
    接口信号数43模块间信号总数
    代码行数$ \sim $370生成的Verilog代码
    圈复杂度2.11–2.89控制流复杂度
    测试用例数78功能验证测试
    下载: 导出CSV

    表  6  RISC-V自定义算术IP集成任务(5个任务操作项)的跨模型原始计数

    模型通过的操作项语法错误模块编译自动测试人工修复后测试CQS
    DeepSeek-V35/508/870/7878/7865.7
    Claude-4.55/508/870/7878/7865.9
    Doubao-Pro5/5286/864/7878/7865.7
    Gemini-Flash4/5326/870/8178/7871.7
    Qwen3-235B5/5344/840/5078/7864.0
    GPT-5.14/5107/870/8178/7868.9
    注:“通过的操作项”按5个任务操作项统计;自动测试按各模型生成后可执行的测试样本统计,因此分母随生成结果变化;人工修复后统一使用78条测试。
    下载: 导出CSV

    表  4  单体式基线与V-Agent的首轮编译记录

    模型配置 (Model)生成代码输出量 (字符数)结构与接口状态首轮编译结果
    V-Agent Pipeline(最佳后端)按需动态分配多轮生成完成接口检查与系统级集成获得可编译系统样本
    claude-sonnet-4-5-20250929~21,993字符未通过(上下文与连线不一致)未通过
    gemini-1.5-flash~16,757字符未通过(语法错误或端口未定义)未通过
    deepseek-chat~7,925字符未通过(模块划分与接口不一致)未通过
    gpt-5.1~6,949字符未通过(数据通路连线缺失)未通过
    doubao-1.5-pro~4,849字符未通过(单次输出未完成状态逻辑)未通过
    下载: 导出CSV

    表  7  各智能体在接口检查与反馈重试中的职责和案例记录

    智能体检查与反馈职责案例中的反馈记录处理结果
    架构智能体生成模块接口契约完成接口字段定义契约用于后续模块生成
    控制单元智能体处理操作码译码与控制信号1次反馈重试完成译码逻辑修正
    数据通路智能体处理端口、数据通路与顶层连线2次反馈重试完成端口与连线修正
    验证智能体汇总AST、编译与测试诊断诊断信息回传对应智能体驱动编译与测试闭环
    下载: 导出CSV

    表  8  各模型生成代码经人工修复后的PPA结果(Nangate45, 45 nm, 500 MHz)

    模型面积(μm2)延迟(ns)功耗(mW)DFF状态
    Claude9,739.320.4680.002981022流程完成*
    DeepSeek10371.341.1740.005971022流程完成*
    Gemini10640.530.9630.006311022流程完成*
    GPT-5.19918.61N/AN/A1022STA未收敛*
    Doubao327.450.3740.0000730综合裁剪†
    Qwen897.480.6550.0002761综合裁剪†
    注:* Claude、DeepSeek和Gemini完成综合与时序分析;GPT-5.1完成门级映射,但组合环路导致STA未收敛。† Doubao和Qwen的DFF数量与面积异常偏低,综合日志显示存在大规模逻辑裁剪,因此两项结果用于分析代码结构与综合优化的交互。
    下载: 导出CSV

    表  5  V-Agent在不同任务操作项规模下的编译结果

    任务操作项规模要求支持的任务操作项编译结果任务特征
    LOW (轻量)ADD、SUB(2项)获得可编译样本基础算术
    MEDIUM (标准)ADD、SUB、AND、OR、XOR(5项)获得可编译样本多操作ALU
    CUSTOM_IPMLOAD、PMUL、PMAC(实验性操作)获得可编译样本算术IP集成
    HIGH (复杂)含SLT、BEQ、BNE等10项以上获得可编译样本分支与控制流
    下载: 导出CSV

    表  9  人工修复实验的行级代码变动统计

    模型 原始行数 修复后
    行数
    代码变动
    行数(增/删/改)
    行级代码
    变动率
    Claude-4.5 537 544 7 1.3%
    Qwen3-235B 422 440 40 9.5%
    DeepSeek-V3 488 488 40 8.2%
    Doubao-Pro 465 473 12 2.6%
    GPT-5.1 551 558 11 2.0%
    Gemini-1.5 665 674 17 2.6%
    注:变动行数为新增、删除和修改行数之和;行级代码变动率=变动行数/原始行数×100%,不等于修复后行数与原始行数之差。
    下载: 导出CSV

    表  10  生成与编译阶段的失败类型统计(N=126)

    模型 语义错误 位宽错误 级联失败 自定义操作语义
    DeepSeek 未归类 未归类 未归类 未归类
    Claude 未归类 未归类 未归类 未归类
    Gemini 10 6 4 2
    Doubao 12 8 6 2
    GPT-5.1 18 12 8 4
    Qwen 14 10 8 2
    下载: 导出CSV
  • [1] MIRHOSEINI A, GOLDIE A, YAZGAN M, et al. A graph placement methodology for fast chip design[J]. Nature, 2021, 594(7862): 207–212. doi: 10.1038/s41586-021-03544-w.
    [2] MOLESKY S, LIN Zin, PIGGOTT A Y, et al. Inverse design in nanophotonics[J]. Nature Photonics, 2018, 12(11): 659–670. doi: 10.1038/s41566-018-0246-9.
    [3] PATTERSON D A and HENNESSY J L. Computer Organization and Design RISC-V Edition: The Hardware Software Interface[M]. San Francisco: Morgan Kaufmann Publishers Inc. , 2017. (查阅网上资料, 未找到本条文献页码信息, 请补充).
    [4] BREUER M A, FRIEDMAN A D, and IOSUPOVICZ A. A survey of the state of the art of design automation[J]. Computer, 1981, 14(10): 58–75. doi: 10.1109/C-M.1981.220210.
    [5] XILINX. Vivado design suite user guide: High-level synthesis[R]. UG902 (v2020.1), 2021.
    [6] CHEN M, TWOREK J, JUN H, et al. Evaluating large language models trained on code[EB/OL]. https://arxiv.org/abs/2107.03374, 2021.
    [7] BROWN T B, MANN B, RYDER N, et al. Language models are few-shot learners[C]. Proceedings of the 34th International Conference on Neural Information Processing Systems, Vancouver, Canada, 2020: 159. doi: 10.5555/3495724.3495883.
    [8] THAKUR S, BLOCKLOVE J, PEARCE H, et al. AutoChip: Automating HDL generation using LLM feedback[EB/OL]. https://arxiv.org/abs/2311.04887, 2023.
    [9] BLOCKLOVE J, GARG S, KARRI R, et al. Chip-Chat: Challenges and opportunities in conversational hardware design[C]. Proceedings of the 2023 ACM/IEEE 5th Workshop on Machine Learning for CAD, Snowbird, USA, 2023: 1–6. doi: 10.1109/MLCAD58807.2023.10299874.
    [10] SANGIOVANNI-VINCENTELLI A, DAMM W, and PASSERONE R. Taming Dr. Frankenstein: Contract-based design for cyber-physical systems[J]. European Journal of Control, 2012, 18(3): 217–238. doi: 10.3166/ejc.18.217-238.
    [11] CANIS A, CHOI J, ALDHAM M, et al. LegUp: High-level synthesis for FPGA-based processor/accelerator systems[C]. Proceedings of the 19th ACM/SIGDA International Symposium on Field Programmable Gate Arrays, Monterey, USA, 2011: 33–36. doi: 10.1145/1950413.1950423.
    [12] SIEMENS EDA. Catapult high-level synthesis and verification[EB/OL]. https://eda.sw.siemens.com/en-US/eda-cloud-solutions/ic/catapult-high-level-synthesis/, 2026.
    [13] LIU Shang, FANG Wenji, LU Yao, et al. RTLCoder: Fully open-source and efficient LLM-assisted RTL code generation technique[J]. IEEE Transactions on Computer-Aided Design of Integrated Circuits and Systems, 2025, 44(4): 1448–1461. doi: 10.1109/TCAD.2024.3483089.
    [14] CHANG Kaiyan, WANG Ying, REN Haimeng, et al. ChipGPT: How far are we from natural language hardware design[EB/OL]. https://arxiv.org/abs/2305.14019, 2023.
    [15] THAKUR S, AHMAD B, PEARCE H, et al. VeriGen: A large language model for Verilog code generation[J]. ACM Transactions on Design Automation of Electronic Systems, 2024, 29(3): 46. doi: 10.1145/3643681.
    [16] QIAN Chen, LIU Wei, LIU Hongzhang, et al. ChatDev: Communicative agents for software development[C]. Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics, Bangkok, Thailand, 2024: 15174–15186. doi: 10.18653/v1/2024.acl-long.810.
    [17] HONG Sirui, ZHUGE Mingchen, CHEN J, et al. MetaGPT: Meta programming for a multi-agent collaborative framework[C]. Proceedings of the 12th International Conference on Learning Representations, Vienna, Austria, 2024.
    [18] RICHARDS T. AutoGPT: An autonomous GPT-4 experiment[EB/OL]. https://github.com/Significant-Gravitas/AutoGPT, 2026.
    [19] QIN Haiyan, FENG Jiahao, FENG Xiaotong, et al. Towards optimal circuit generation: Multi-agent collaboration meets collective intelligence[EB/OL]. https://arxiv.org/abs/2504.14625, 2025.
    [20] QIN Haiyan, KOU Jing, ZHANG Liang, et al. Multi-agent yield analysis for circuit design[C]. Proceedings of the 62nd ACM/IEEE Design Automation Conference, San Francisco, USA, 2025: 1–7. doi: 10.1109/DAC63849.2025.11133334.
    [21] TASNIA K, GARCIA A, FARHEEN T, et al. VeriOpt: PPA-aware high-quality Verilog generation via multi-role LLMs[C]. Proceedings of the 2025 IEEE/ACM International Conference on Computer Aided Design, Munich, Germany, 2025: 1–9. doi: 10.1109/ICCAD66269.2025.11240771.
    [22] 陈溪源, 姜宇轩, 夏莹杰, 等. VCodePPA: 面向集成电路物理约束优化的Verilog代码数据集[J]. 电子与信息学报, 2025, 47(11): 4606–4619. doi: 10.11999/JEIT250449.

    CHEN Xiyuan, JIANG Yuxuan, XIA Yingjie, et al. VCodePPA: A large-scale Verilog dataset with PPA annotations[J]. Journal of Electronics & Information Technology, 2025, 47(11): 4606–4619. doi: 10.11999/JEIT250449.
    [23] MIN K, CHO K, JANG J, et al. REvolution: An evolutionary framework for RTL generation driven by large language models[C]. Proceedings of the 2026 31st Asia and South Pacific Design Automation Conference, Lantau, China, 2026: 282–288. doi: 10.1109/ASP-DAC66049.2026.11420420.
    [24] LIU Mingjie, PINCKNEY N R, KHAILANY B, et al. Invited paper: VerilogEval: Evaluating large language models for Verilog code generation[C]. Proceedings of the 2023 IEEE/ACM International Conference on Computer Aided Design, San Francisco, USA, 2023: 1–8. doi: 10.1109/ICCAD57390.2023.10323812.
    [25] CHEN Zhirong, CHANG Kaiyan, LI Zhuolin, et al. ChipSeek-R1: Generating human-surpassing RTL with LLM via hierarchical reward-driven reinforcement learning[EB/OL]. https://arxiv.org/html/2507.04736v1, 2025.
    [26] WANG Yiting, YE Wanghao, GUO Ping, et al. SymRTLO: Enhancing RTL code optimization with LLMs and neuron-inspired symbolic reasoning[C]. Proceedings of the 39th Conference on Neural Information Processing Systems, San Diego, USA, 2025: 55809–55834. doi: 10.52202/085713-1670.
    [27] TSAI Y, LIU Mingjie, and REN Haoxing. RTLFixer: Automatically fixing RTL syntax errors with large language models[C]. Proceedings of the 61st ACM/IEEE Design Automation Conference, San Francisco, USA, 2024: 53. doi: 10.1145/3649329.3657353.
    [28] 于斌, 闵玉新, 张自豪, 等. 基于RISC-V指令扩展的双线性对协处理器设计[J]. 电子与信息学报, 2025, 47(9): 3137–3145. doi: 10.11999/JEIT250367.

    YU Bin, MIN Yuxin, ZHANG Zihao, et al. Design of a bilinear pairing coprocessor based on RISC-V instruction extension[J]. Journal of Electronics & Information Technology, 2025, 47(9): 3137–3145. doi: 10.11999/JEIT250367.
    [29] 唐时博, 朱嘉诚, 慕德俊, 等. RISC-V处理器权限正确性验证与提权漏洞自动挖掘方法[J]. 电子与信息学报, 2025, 47(9): 3081–3092. doi: 10.11999/JEIT250362.

    TANG Shibo, ZHU Jiacheng, MU Dejun, et al. Verification of privilege correctness and automated exploitation of privilege escalation vulnerabilities in RISC-V processors[J]. Journal of Electronics & Information Technology, 2025, 47(9): 3081–3092. doi: 10.11999/JEIT250362.
    [30] WOLF C. Yosys open SYnthesis suite[EB/OL]. https://yosyshq.net/yosys/, 2026.
  • 加载中
图(5) / 表(10)
计量
  • 文章访问数:  8
  • HTML全文浏览量:  1
  • PDF下载量:  0
  • 被引次数: 0
出版历程
  • 修回日期:  2026-09-17
  • 录用日期:  2026-09-17
  • 网络出版日期:  2026-09-24

目录

    /

    返回文章
    返回