设为首页
收藏本站
开启辅助访问
全部
问与答
创意
技术
酷工作
生活
交易
资源
节点
飞墙
Follow
明白贴
报酬
登录
注册
飞社-令人惊奇的创意工作者社区-
›
首页
›
程序员
›
kimi K2 Thinking 都这样的玩的话,如何作为参考依据呢 ...
FSHEX=FIND+SHARE+EXPRESS
飞社-令人惊奇的创意工作者社区- 是一个关于发现分享表达的地方
现在登录
没有账号?
立即注册
推荐主题
›
求职半个月,感觉快撑不住了,想听听大家的
›
共事了 7 年的同事今天 last day,还是会有
›
你能接受女朋友不要彩礼,但是和你谈之前经
›
国内 TOP 大厂快满 3 年了,想裸辞自由几个
›
F站怎么有这么多人以 PC 为荣?
今日热议主题
在 2libra 发现一个很有意思的项目, Github
ChatGPT: 我爱说实话。
Paddle 不再支持转出到 paypal 了
iPhone14 还是出厂的 ios16 如何能升级到指
大家网站开通 CDN 付费流量后有被恶意刷过
送给有孩子的父母、准备结婚的男女、以及其
TINKER - 开源桌面工具箱
代充 GPT plus 一个月 140,质保售后
出 macbook air m4 16g
最近对小米的产品比较排斥
显示全部
|
最新评论
17 条回复
·
1877 次点击
11#
Leoking222
初学
2025-11-10 14:00:38
国内:跑分没输过,实战没赢过
12#
Leoking222
初学
2025-11-10 14:01:24
@jasonjie2015 国产所有的模型都在对比 Claude ,但其实他们都只达到了 Claude sonnet 3.7 的水平 🤣
13#
maolon
小成
2025-11-10 14:39:57
首先所有榜单都只能是参考,每个人的用法天差地别,其次这些榜单每一个都是有侧重点的 另外还有一个很简单的判断方法,什么时候 claude 和 openai 开始对标国产模型了,那他们就真超越了。 谁对标谁就用被对标的那个, simple as that
14#
fbu11
初学
2025-11-10 15:00:23
跟国内还是国外没关系,GPT5 也一样,每个大模型的跑分榜单模式都是这样的,他们上榜说是吊打 XXX 模型,都是有特定条件的
15#
lance07
初学
2025-11-10 15:41:46
都这样,gpt 之前还测评作弊。差距有但不是在这里
16#
snw
小成
2025-11-10 15:44:17
试过用免费版的 K2 Thinking 模式找些数据,结果思维陷入死循环了: > 一会儿说我在网上找到了一个数据 a ,但很难找到其他数据,也许我应该去官方信源找数据。 > 过了十来分钟,又说我在网上找到了一个数据 a (和上面一样),但很难找到其他数据,也许我应该去官方报告找数据 > ...... 如此循环了将近十次,然后直接清空了前面所有思考过程,输出空白。旁边提示可以试试付费版投入更多算力😂
17#
snw
小成
2025-11-10 15:48:01
@snw 又看了下,是提示“深度研究额度已用尽”。 反正看试用版这表现我是不敢付费的,看起来额度被死循环耗尽了。
18#
zhangeric
小成
2025-11-10 16:11:45
楼主就是把外国人想的太好了啊.
1
2
/ 2 页
浏览过的版块
职场话题
Apple
返回顶部