设为首页
收藏本站
开启辅助访问
全部
问与答
创意
技术
酷工作
生活
交易
资源
节点
飞墙
Follow
明白贴
报酬
登录
注册
飞社-令人惊奇的创意工作者社区-
›
首页
›
程序员
›
kimi K2 Thinking 都这样的玩的话,如何作为参考依据呢 ...
FSHEX=FIND+SHARE+EXPRESS
飞社-令人惊奇的创意工作者社区- 是一个关于发现分享表达的地方
现在登录
没有账号?
立即注册
推荐主题
›
我的人生好像有点坏掉了,请大家给点建议
›
长话短说 大家觉得花三十万结婚,存款花完
›
关于在大城市留不下来这件事,大家都是怎样
›
域名不用了记得要及时注销备案
›
重度苹果用户投华做了两面派
今日热议主题
一通宵肝了个全网 AI 中转站比价工具
关于 clash dns 的问题
苦于 Xcode 不支持国内大模型,所以我做了
求个 M-team 的邀请,有其他站的数据
我把 AI 用到了爬虫上,做了一款工具
请教下各国海关数据如何拿到?
Vmware Workstation 使用 WHP,似乎无法睿
使用 Parallels Desktop 安装 Windows 的各
Seedance 1.5 Pro 上线了|国产视频模型,
收几台 SE2 SE3
显示全部
|
最新评论
17 条回复
·
1867 次点击
11#
Leoking222
初学
2025-11-10 14:00:38
国内:跑分没输过,实战没赢过
12#
Leoking222
初学
2025-11-10 14:01:24
@jasonjie2015 国产所有的模型都在对比 Claude ,但其实他们都只达到了 Claude sonnet 3.7 的水平 🤣
13#
maolon
小成
2025-11-10 14:39:57
首先所有榜单都只能是参考,每个人的用法天差地别,其次这些榜单每一个都是有侧重点的 另外还有一个很简单的判断方法,什么时候 claude 和 openai 开始对标国产模型了,那他们就真超越了。 谁对标谁就用被对标的那个, simple as that
14#
fbu11
初学
2025-11-10 15:00:23
跟国内还是国外没关系,GPT5 也一样,每个大模型的跑分榜单模式都是这样的,他们上榜说是吊打 XXX 模型,都是有特定条件的
15#
lance07
初学
2025-11-10 15:41:46
都这样,gpt 之前还测评作弊。差距有但不是在这里
16#
snw
小成
2025-11-10 15:44:17
试过用免费版的 K2 Thinking 模式找些数据,结果思维陷入死循环了: > 一会儿说我在网上找到了一个数据 a ,但很难找到其他数据,也许我应该去官方信源找数据。 > 过了十来分钟,又说我在网上找到了一个数据 a (和上面一样),但很难找到其他数据,也许我应该去官方报告找数据 > ...... 如此循环了将近十次,然后直接清空了前面所有思考过程,输出空白。旁边提示可以试试付费版投入更多算力😂
17#
snw
小成
2025-11-10 15:48:01
@snw 又看了下,是提示“深度研究额度已用尽”。 反正看试用版这表现我是不敢付费的,看起来额度被死循环耗尽了。
18#
zhangeric
小成
2025-11-10 16:11:45
楼主就是把外国人想的太好了啊.
1
2
/ 2 页
浏览过的版块
生活
iPhone
职场话题
分享创造
宽带症候群
分享发现
Windows
Apple
二手交易
返回顶部