花叔专栏 / AI工具实测
马斯克的xAI Grok3跑分公布!数值离谱!
在数学和代码类的benchmark方面大幅领先DeepSeek V3、GPT-4o、Claude 3.5 Sonnet。
不过发现他们玩了个小把戏,明明是推理模型,但是没跟OpenAI o3、DeepSeek R1对比
这篇读完了,下次实践再见。
花叔 Alchain
AI Native Coder · 独立开发者 · 作者
《一本书玩转DeepSeek》作者,小猫补光灯、女娲Skill生态创作者。不会写代码,用AI做产品,分享独立开发、AI工具与内容创作的实践。
本文收录自微信公众号。在原平台阅读 ↗