花叔专栏 / AI工具实测

马斯克的xAI Grok3跑分公布!数值离谱!

在数学和代码类的benchmark方面大幅领先DeepSeek V3、GPT-4o、Claude 3.5 Sonnet。

不过发现他们玩了个小把戏,明明是推理模型,但是没跟OpenAI o3、DeepSeek R1对比

这篇读完了,下次实践再见。

花叔的插画头像

AI Native Coder · 独立开发者 · 作者

《一本书玩转DeepSeek》作者,小猫补光灯、女娲Skill生态创作者。不会写代码,用AI做产品,分享独立开发、AI工具与内容创作的实践。

本文收录自微信公众号。在原平台阅读 ↗

返回花叔专栏