马斯克表示 Grok 4.7 还需几天打磨。他认为强化学习可能过度惩罚回复长度,导致模型在本可完成的难题上过早放弃,且对自身结果的校验仍不够严谨。

核心要点速览 (Key Takeaways)

  • ✓马斯克表示 Grok 4.7 还需几天打磨。他认为强化学习可能过度惩罚回复长度,导致模型在本可完成的难题上过早放弃,且对自身结果的校验仍不够严谨。
🧭

阅读完核心要点?进一步了解模型实力与实际开销

7 大权威镜像天梯跑分与 29+ 款主流编程套餐横向比价测算