暂无通知
勃勃OC
o3-mini是专门在代码问题上微调的。r1同时在代码和数学题上微调。这个例子显示,r1的代码能力并不如o3-mini。DeepSeek并没有“魔法”,技术上也未超越OAI。数据决定模型,RL也是。
0/200
暂无更多评论