国产大模型真实实力评估:文心、通义、智谱、DeepSeek
2026年了,国产大模型到底到什么水平了?跟GPT-4o和Claude 3.5的差距还有多大?
我测试过的感受:
- DeepSeek在数学和代码上确实强
- 通义千问中文理解不错
- 文心一言搜索整合有特色
- 智谱GLM在Agent方面有布局
但整体来看,通用能力跟头部还有差距。各位有没有做过系统对比?
12
评论 12