设为首页
收藏本站
开启辅助访问
全部
问与答
创意
技术
酷工作
生活
交易
资源
节点
飞墙
Follow
明白贴
报酬
工算小助手
登录
注册
飞社-令人惊奇的创意工作者社区-
›
首页
›
程序员
›
kimi K2 Thinking 都这样的玩的话,如何作为参考依据呢 ...
FSHEX=FIND+SHARE+EXPRESS
飞社-令人惊奇的创意工作者社区- 是一个关于发现分享表达的地方
现在登录
没有账号?
立即注册
推荐主题
›
新加坡机场入境居然没有安检?
›
新手恋爱求后续指导
›
自从有了小孩后家庭矛盾越来越多,大家帮我
›
1 月 20 号失业, 2 月 1 号离婚,还有更快
›
如何制裁或者恶心一个人
今日热议主题
请教一个 http-flv 直播方面的问题
求问,如何看我有没有被降级啊,以及现在级
百度首页的 “日历”,有没有单独的应用或
在腾讯云上 自己用 dnsmasq 部署一个 dns
考虑到隐私,哪些笔记软件可以选择?
这段时间猛灌水的徕芬剃须刀到底咋样?
网站真实性确认求助: www.fakawang.org
最近对漫剧比较感兴趣,有些问题想请教请教
兄弟们看看我的这个 k3s 离线安装包
ios 26 强制充电到 85% 能让电池多活几天么
显示全部
|
最新评论
17 条回复
·
1889 次点击
11#
Leoking222
初学
2025-11-10 14:00:38
国内:跑分没输过,实战没赢过
12#
Leoking222
初学
2025-11-10 14:01:24
@jasonjie2015 国产所有的模型都在对比 Claude ,但其实他们都只达到了 Claude sonnet 3.7 的水平 🤣
13#
maolon
小成
2025-11-10 14:39:57
首先所有榜单都只能是参考,每个人的用法天差地别,其次这些榜单每一个都是有侧重点的 另外还有一个很简单的判断方法,什么时候 claude 和 openai 开始对标国产模型了,那他们就真超越了。 谁对标谁就用被对标的那个, simple as that
14#
fbu11
初学
2025-11-10 15:00:23
跟国内还是国外没关系,GPT5 也一样,每个大模型的跑分榜单模式都是这样的,他们上榜说是吊打 XXX 模型,都是有特定条件的
15#
lance07
初学
2025-11-10 15:41:46
都这样,gpt 之前还测评作弊。差距有但不是在这里
16#
snw
小成
2025-11-10 15:44:17
试过用免费版的 K2 Thinking 模式找些数据,结果思维陷入死循环了: > 一会儿说我在网上找到了一个数据 a ,但很难找到其他数据,也许我应该去官方信源找数据。 > 过了十来分钟,又说我在网上找到了一个数据 a (和上面一样),但很难找到其他数据,也许我应该去官方报告找数据 > ...... 如此循环了将近十次,然后直接清空了前面所有思考过程,输出空白。旁边提示可以试试付费版投入更多算力😂
17#
snw
小成
2025-11-10 15:48:01
@snw 又看了下,是提示“深度研究额度已用尽”。 反正看试用版这表现我是不敢付费的,看起来额度被死循环耗尽了。
18#
zhangeric
小成
2025-11-10 16:11:45
楼主就是把外国人想的太好了啊.
1
2
/ 2 页
浏览过的版块
Apple
返回顶部