伤不是随机的。测试方案里语义有效样本量指标很有效。”
“而且,加入策略判别器之后,留下来的候选解法更接近真正不同的思路,他们之间有时候甚至能形成隐形的互补。”
伊戈尔·巴布什金说:“好,我知道了。”
说完,他挂断了电话。
伊戈尔·巴布什金陷入了两难的境地。
如果做模型的正式训练,那么无论是算力的使用还是日志记录、数据流,都没办法瞒过DeepMind和背后的谷歌。
风险会大到爆炸。
最后只能老老实实上报给谷歌的董事会。
另外一条路就是找马斯克,用推特的卡来训练。
但这同样有问题,那就没办法待价而沽了,只能拿来和马斯克抬价了,自己回不去谷歌了。
谷歌还是推特?这是一个问题。