大模型计量

  • BFS首发LLM网络安全能力评测结果

    随着大语言模型(LLM)在全球范围内的爆发式增长,关于大模型通用能力、逻辑推理、代码编写等维度的评测体系已经较为成熟,其安全能力评估大多集中在内容合规性或生成安全(如大模型越狱,输…

    2026年7月21日
    61