关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
AIGC 领域的最新工具、开源项目以及行业大事件
Seedance 2.5 正式发布
单次生成最长 30 秒
最多支持 50 个参考素材输入,角色、道具、风格等参考可以一次全塞进去
Seedance 2.5即将登陆 Higgsfield
先看看这段演示绝对的颠覆现有你对AI视频的认知,镜头运用、特效、人物的表现完全是电影级的
而且是一次生成出来的,没有分段拼接...
不可思议
AI探索 | Hermes/OpenClaw|优质资源|优质信息
单次生成最长 30 秒
最多支持 50 个参考素材输入,角色、道具、风格等参考可以一次全塞进去
Seedance 2.5即将登陆 Higgsfield
先看看这段演示绝对的颠覆现有你对AI视频的认知,镜头运用、特效、人物的表现完全是电影级的
而且是一次生成出来的,没有分段拼接...
不可思议
AI探索 | Hermes/OpenClaw|优质资源|优质信息
而成——很像 Agent 调用 Skills。
2. 仿真示范可以直接提示真实机器人
GEN-1.5 的预训练数据不包含仿真数据,但它可以把仿真环境中的动作轨迹当作 Prompt,在现实中完成相应任务。这不等于彻底解决 sim-to-real,但意味着仿真数据可能不仅能用来训练,还能在推理时直接定义任务。
3. 人类可以直接用手示范
在部分任务中,人类在机器人摄像头前用自己的手完成动作,机器人随后可以用机械手复现。这是在跨越 human-to-robot 的 embodiment gap。
4. 它开始从复制轨迹走向泛化“策略”
训练示范使用刷子把方块扫入碗中,模型面对新工具时会:用香蕉充当刷子;用簸箕铲起方块再倒入碗中;换手操作;移开障碍物;在物体卡住时用另一只手解围。
真正有价值的是,模型似乎学到了“把物体送入容器”这一目标,并能重新组合已有动作知识。
四、它是不是机器人领域的 GPT-3 时刻?
在能力范式上很像,但在成熟度上仍未达到相同阶段。
它像 GPT-3 的地方在于:随着预训练规模扩大,模型没有被显式训练,却涌现出 one-shot in-context learning。任务适配开始从“修改参数”转向“提供上下文”。
但必须看到四个限制:
•目前主要是简单、短时、原子级操作任务;
•one-shot平均成功率只有59%,远低于工业部署要求;
•评测仅覆盖10项任务,且由公司自行设计和披露;
•尚未公开足够完整的模型架构、训练数据、失败分布和独立第三方评测。
GEN-1.5 展示了机器人版 in-context learning 的规模化涌现迹象,但尚未证明它已经成为可稳定部署的通用机器人模型。
五、产业和投资含义
如果这条路线继续成立,具身智能价值链会发生三项变化。
第一,任务适配成本可能断崖式下降。
第二,物理数据引擎成为真正的Scaling基础。
第三,机器人也将出现Context与Harness层。
未来机器人系统可能由四层组成:
•基础具身模型;
•用户和场景的物理Context;
•可组合的Physical Skills库;
•负责安全、验证、记忆和技能调度的具身Agent Harness。
2026年6月,Generalist完成4亿美元融资,投后估值20亿美元,累计融资超过5亿美元。投资者包括Radical Ventures、8VC、USV、NVIDIA、Bezos Expeditions、Norwest,以及李飞飞、林斌等。
https://generalistai.com/blog/gen-1.5
@aigc1024
2. 仿真示范可以直接提示真实机器人
GEN-1.5 的预训练数据不包含仿真数据,但它可以把仿真环境中的动作轨迹当作 Prompt,在现实中完成相应任务。这不等于彻底解决 sim-to-real,但意味着仿真数据可能不仅能用来训练,还能在推理时直接定义任务。
3. 人类可以直接用手示范
在部分任务中,人类在机器人摄像头前用自己的手完成动作,机器人随后可以用机械手复现。这是在跨越 human-to-robot 的 embodiment gap。
4. 它开始从复制轨迹走向泛化“策略”
训练示范使用刷子把方块扫入碗中,模型面对新工具时会:用香蕉充当刷子;用簸箕铲起方块再倒入碗中;换手操作;移开障碍物;在物体卡住时用另一只手解围。
真正有价值的是,模型似乎学到了“把物体送入容器”这一目标,并能重新组合已有动作知识。
四、它是不是机器人领域的 GPT-3 时刻?
在能力范式上很像,但在成熟度上仍未达到相同阶段。
它像 GPT-3 的地方在于:随着预训练规模扩大,模型没有被显式训练,却涌现出 one-shot in-context learning。任务适配开始从“修改参数”转向“提供上下文”。
但必须看到四个限制:
•目前主要是简单、短时、原子级操作任务;
•one-shot平均成功率只有59%,远低于工业部署要求;
•评测仅覆盖10项任务,且由公司自行设计和披露;
•尚未公开足够完整的模型架构、训练数据、失败分布和独立第三方评测。
GEN-1.5 展示了机器人版 in-context learning 的规模化涌现迹象,但尚未证明它已经成为可稳定部署的通用机器人模型。
五、产业和投资含义
如果这条路线继续成立,具身智能价值链会发生三项变化。
第一,任务适配成本可能断崖式下降。
第二,物理数据引擎成为真正的Scaling基础。
第三,机器人也将出现Context与Harness层。
未来机器人系统可能由四层组成:
•基础具身模型;
•用户和场景的物理Context;
•可组合的Physical Skills库;
•负责安全、验证、记忆和技能调度的具身Agent Harness。
2026年6月,Generalist完成4亿美元融资,投后估值20亿美元,累计融资超过5亿美元。投资者包括Radical Ventures、8VC、USV、NVIDIA、Bezos Expeditions、Norwest,以及李飞飞、林斌等。
https://generalistai.com/blog/gen-1.5
@aigc1024
支持 Win / Mac / Linux,适合做本地聊天数据整理、记录查看和内容归档管理。
对于有聊天资料整理需求的人来说,实用性还不错。
工具地址:
https://github.com/hicccc77/WeFlow/releases
@meiriyishu
我很好奇,有没有人从各种体验和细节上比较一下腾讯元宝、字节豆包、阿里通义千问(手机chatbot app,不是Qwen LLM model本体)到底有什么体验上的区别?
字节豆包到底是如何逐渐拉开差距,领跑一个身位的?
AI探索 | Hermes/OpenClaw|优质资源|优质信息
字节豆包到底是如何逐渐拉开差距,领跑一个身位的?
AI探索 | Hermes/OpenClaw|优质资源|优质信息
《打动自己,知难而进》冯骥
1、首先打动自己。
无论何时,请把自己与团队当作最优先的目标用户。
这是公司成立至今的价值观,我总是翻来覆去说这句有点拗口的——
“必须做开发者自己作为用户也理解、认可、喜爱的游戏。”
这不单是情怀,也是理性的产品策略。
如果你对正在做的东西缺乏非功利的热诚,你的直觉就会开始迟钝。
时间一长,大概率输给那些比你更乐在其中的人。
2、再找外部交集。
打动自己,不意味着孤芳自赏。
市场数据、用户反馈和商业上的可持续都很重要。只有组织活下来,集体认知才有机会成长,团队能力才有时间变强。
呼应第一点,我想强调的是,对内容产品而言,先在外部找到与自己个性、趣味、喜好相近的人,通常比试图讨好所有人更高效。随着受众规模扩大,开发者与用户的相似度可能逐渐降低,但这个过程更类似从核心向外自然扩散,而不是一开始就在茫茫人海里碰运气。
世界很大,没有谁真的独一无二。能深深打动自己的东西,往往也能打动世界上的另一群人。
创作过程的每一处用心,都一定会被懂你的用户感受到。
3、发现亮点,先于消灭缺陷。
与其先想着如何征服不喜欢你的人,不如先尽力满足喜欢你的人。
伟大的游戏也绝非面面俱到,这个世界存在太多的不可能三角。资源永远有限,完成度永远不够,目标之间永远存在取舍与矛盾。比“还有什么地方不够好”更重要的问是:有没有什么体验,只有在我这里才能玩到?
再往大一点说,一家内容公司存在的意义,也许就是让一部分人觉得:幸好这个世界上,还有人做出了这样的玩意。
4、可体验的版本,胜过满纸雄文。
文档可以解释意图,数据可以辅助判断,会议可以统一认识,但游戏实际上更接近一种综合的、复杂的、甚至有些混沌的沉浸状态。
内部判断产品风险时,我始终更相信真正跑起来、打起来、死上几次之后的感受,以及观察同事们在作为玩家时的真实反应。然后才据此去敲定某些拿不准的设计,或者放弃之前看上去牛逼的创意。
具体到每一次对外发布的实机视频,希望传递给大家的也是同一件事——
“看到后,能轻易想象自己亲手玩起来的样子。”
5、好玩是目标,也是底线。
这一条就不展开了……总之如果内部版本不够好玩,那就再调查调查,反思反思,学习学习,迭代迭代,重构重构,再多玩玩其他游戏,嘻嘻。
6、美无定式。
没有一种风格永远高级,也没有一种信号永远刺激。
再惊人的美学符号,反复出现也会失去最初的力量。美,更像是一种认真创造的陌生感。
说到底,神经传导会适应,多巴胺奖励会消停,人会厌倦一再重复的事物,这是创作者永远逃不出的无间狱。
前几天,我和佳骐(声音负责人)扯到这个,顺手编了句打油诗来比喻:美无恒美,法无定法。多见易俗,少见易雅。他说,滚,两面都让你说了,狡猾。
嗯,那个,反正,我要表达的意思是,或许不必追求找到一套万用万灵的美学公式,而是应该不断探索还有什么好的表达方式,其中既有技艺,又有新意。
7、走投无路,提升密度。
大部分时间里,我们其实找不到什么更聪明、杠杆更大的办法,去提升产品的竞争力。
这个时候,在那些已经被验证的亮点上继续增加有效密度,通常不是一个坏选择。
比如更细腻的粒子,更茂密的植被,更丰富的动画,更精确的打击反馈,更多样的妖魔鬼怪,更大的显存(bushi)……不是说无脑堆参数与资源就一定好,前提是这些内容的确是被验证过的亮点,而且依然能让用户感知到差异。
想不到妙手是游戏开发的常态,不妨先把每一步本手下扎实。
8、起点看最高,终点当领跑。
对同领域的当家花旦们,最好如数家珍——哪里玩到昏迷,哪里气到爆炸,哪里不知所措,哪里眼睛哭花。
然后去搞清楚——它们各自采用了何种开发模式、设计方法、制作工艺与技术标准。
最后反复思考——什么能学,什么学不得,什么要虚心,什么要创新。
游戏并非必需品,深入体验与研究标杆的另一重价值,是让我们对这个品类三五年后的及格线会有多高,大致心里有数。
取法乎上,把对标杆的认知当成制作自家demo的起点,绝不是坏事,哪怕暂时高山仰止。
但是,如果长期目标是“做到和某某差不多”,有点危险。
尊重标杆,学习标杆,是为了最终建立自己的尺度。
想登顶,想一览众山,想创造前所未有的新标杆——这不是自不量力,是宝贵的冲劲与志气。
要敢想。
9、难能,可贵。
充分竞争的成熟市场,鲜有低垂的果实。任何容易解决的问与需求,要么不存在后来者的机会,要么很快会被竞争对手挤满。
这一点我有切身体会。刚创业时,以为小公司只要选一个自己理解的赛道,做得比大厂快一点,玩法、剧情、画面、声音什么的有点小特色就够了。但事后看,这种所谓高执行力+低成本创新带来的价值微薄而脆弱,用户也很容易闻出这种速成产品的敷衍味道。
一直做相对容易的事,反而惶惶不可终日。
所谓护城河的本质,便是拥有难以被轻易取代的价值。
当我们被某样事物深深打动时,它往往是稀缺的、非凡的、来之不易的,而人们似乎天生就会被“哇这是怎么做到的”的魅力所吸引。
2019年的公司年会,我用八个字总结游科前五年的状态:东搞西搞,投机取巧。
也是在那年,在公司原来价值观“打动自己”外,又加了四个字——
知难而进。
10、理念是廉价的,但贯彻理念的行动是可贵的。
知行合一不是什么新鲜道理,但我加一句暴论:很多时候,行是知的前提。
因为咱们脑中的理念很有可能是肤浅的、偏颇的、错误的,只有贯彻理念的行动与现实发生了真实的碰撞,才能看清:这个世界与我们原先想的到底哪里一样/不一样。
有时撞得太猛,世界太硬,把我们原先的理念撞成了一地碎片。
没关系,正好一片片捡回来,慢慢拼出新的模样。
然后,再撞一次。
@aigc1024
1、首先打动自己。
无论何时,请把自己与团队当作最优先的目标用户。
这是公司成立至今的价值观,我总是翻来覆去说这句有点拗口的——
“必须做开发者自己作为用户也理解、认可、喜爱的游戏。”
这不单是情怀,也是理性的产品策略。
如果你对正在做的东西缺乏非功利的热诚,你的直觉就会开始迟钝。
时间一长,大概率输给那些比你更乐在其中的人。
2、再找外部交集。
打动自己,不意味着孤芳自赏。
市场数据、用户反馈和商业上的可持续都很重要。只有组织活下来,集体认知才有机会成长,团队能力才有时间变强。
呼应第一点,我想强调的是,对内容产品而言,先在外部找到与自己个性、趣味、喜好相近的人,通常比试图讨好所有人更高效。随着受众规模扩大,开发者与用户的相似度可能逐渐降低,但这个过程更类似从核心向外自然扩散,而不是一开始就在茫茫人海里碰运气。
世界很大,没有谁真的独一无二。能深深打动自己的东西,往往也能打动世界上的另一群人。
创作过程的每一处用心,都一定会被懂你的用户感受到。
3、发现亮点,先于消灭缺陷。
与其先想着如何征服不喜欢你的人,不如先尽力满足喜欢你的人。
伟大的游戏也绝非面面俱到,这个世界存在太多的不可能三角。资源永远有限,完成度永远不够,目标之间永远存在取舍与矛盾。比“还有什么地方不够好”更重要的问是:有没有什么体验,只有在我这里才能玩到?
再往大一点说,一家内容公司存在的意义,也许就是让一部分人觉得:幸好这个世界上,还有人做出了这样的玩意。
4、可体验的版本,胜过满纸雄文。
文档可以解释意图,数据可以辅助判断,会议可以统一认识,但游戏实际上更接近一种综合的、复杂的、甚至有些混沌的沉浸状态。
内部判断产品风险时,我始终更相信真正跑起来、打起来、死上几次之后的感受,以及观察同事们在作为玩家时的真实反应。然后才据此去敲定某些拿不准的设计,或者放弃之前看上去牛逼的创意。
具体到每一次对外发布的实机视频,希望传递给大家的也是同一件事——
“看到后,能轻易想象自己亲手玩起来的样子。”
5、好玩是目标,也是底线。
这一条就不展开了……总之如果内部版本不够好玩,那就再调查调查,反思反思,学习学习,迭代迭代,重构重构,再多玩玩其他游戏,嘻嘻。
6、美无定式。
没有一种风格永远高级,也没有一种信号永远刺激。
再惊人的美学符号,反复出现也会失去最初的力量。美,更像是一种认真创造的陌生感。
说到底,神经传导会适应,多巴胺奖励会消停,人会厌倦一再重复的事物,这是创作者永远逃不出的无间狱。
前几天,我和佳骐(声音负责人)扯到这个,顺手编了句打油诗来比喻:美无恒美,法无定法。多见易俗,少见易雅。他说,滚,两面都让你说了,狡猾。
嗯,那个,反正,我要表达的意思是,或许不必追求找到一套万用万灵的美学公式,而是应该不断探索还有什么好的表达方式,其中既有技艺,又有新意。
7、走投无路,提升密度。
大部分时间里,我们其实找不到什么更聪明、杠杆更大的办法,去提升产品的竞争力。
这个时候,在那些已经被验证的亮点上继续增加有效密度,通常不是一个坏选择。
比如更细腻的粒子,更茂密的植被,更丰富的动画,更精确的打击反馈,更多样的妖魔鬼怪,更大的显存(bushi)……不是说无脑堆参数与资源就一定好,前提是这些内容的确是被验证过的亮点,而且依然能让用户感知到差异。
想不到妙手是游戏开发的常态,不妨先把每一步本手下扎实。
8、起点看最高,终点当领跑。
对同领域的当家花旦们,最好如数家珍——哪里玩到昏迷,哪里气到爆炸,哪里不知所措,哪里眼睛哭花。
然后去搞清楚——它们各自采用了何种开发模式、设计方法、制作工艺与技术标准。
最后反复思考——什么能学,什么学不得,什么要虚心,什么要创新。
游戏并非必需品,深入体验与研究标杆的另一重价值,是让我们对这个品类三五年后的及格线会有多高,大致心里有数。
取法乎上,把对标杆的认知当成制作自家demo的起点,绝不是坏事,哪怕暂时高山仰止。
但是,如果长期目标是“做到和某某差不多”,有点危险。
尊重标杆,学习标杆,是为了最终建立自己的尺度。
想登顶,想一览众山,想创造前所未有的新标杆——这不是自不量力,是宝贵的冲劲与志气。
要敢想。
9、难能,可贵。
充分竞争的成熟市场,鲜有低垂的果实。任何容易解决的问与需求,要么不存在后来者的机会,要么很快会被竞争对手挤满。
这一点我有切身体会。刚创业时,以为小公司只要选一个自己理解的赛道,做得比大厂快一点,玩法、剧情、画面、声音什么的有点小特色就够了。但事后看,这种所谓高执行力+低成本创新带来的价值微薄而脆弱,用户也很容易闻出这种速成产品的敷衍味道。
一直做相对容易的事,反而惶惶不可终日。
所谓护城河的本质,便是拥有难以被轻易取代的价值。
当我们被某样事物深深打动时,它往往是稀缺的、非凡的、来之不易的,而人们似乎天生就会被“哇这是怎么做到的”的魅力所吸引。
2019年的公司年会,我用八个字总结游科前五年的状态:东搞西搞,投机取巧。
也是在那年,在公司原来价值观“打动自己”外,又加了四个字——
知难而进。
10、理念是廉价的,但贯彻理念的行动是可贵的。
知行合一不是什么新鲜道理,但我加一句暴论:很多时候,行是知的前提。
因为咱们脑中的理念很有可能是肤浅的、偏颇的、错误的,只有贯彻理念的行动与现实发生了真实的碰撞,才能看清:这个世界与我们原先想的到底哪里一样/不一样。
有时撞得太猛,世界太硬,把我们原先的理念撞成了一地碎片。
没关系,正好一片片捡回来,慢慢拼出新的模样。
然后,再撞一次。
@aigc1024
2026世界杯官方指定投注平台
🌐182体育官网 1820036.com
TG玩家首选人民币台 不限ip 免实名免绑卡手机号码
🌐8K国际官网: 8k2793.com
TG玩家首选U台 U存U提出款稳,福利好反水无上限
1.PG电子赏金女王一举斩获830万并成功提现
2.PA真人豪赢644万一路长虹一天实现暴富
3.PG电子爆890万并以成功提现实现财富自由
4.大哥在PA真人百家乐累计盈利突破1000万
大额出款额外奖励8888-128888,双重日存彩金128888+4688每日送,周流水彩金68888每周送,双重签到彩金16888+3888送不停
【 182体育 全网独此一家】
公平、公正、公开、 信誉第一、服务第一
不限ip、 免实名、免绑卡、免绑手机号码
每日存款彩金每日送,每笔存款加赠1%
182体育频道: @vip182ty888
8K国际频道: @GW_8KGJ
专属客服: @vipkf_182ty8
体育推荐: @VIP182TYTJ
双向联系: @vipkf_182ty2_bot
吃瓜搞笑: @chiguagaoxiaoxinwen
拿到Grok4.6马上和GPT ,Claude在实际使用上对比,有点意外,这个Grok4.6 high 已经和GPT 5.6 sol max,Fable 5差不多了,
乖乖,老马真的厉害👍
AI探索 | Hermes/OpenClaw|优质资源|优质信息
乖乖,老马真的厉害👍
AI探索 | Hermes/OpenClaw|优质资源|优质信息
感觉具身智能现在虚得很呀
不过也看到了很多这几年可能容易跑出来的具身智能的项目。但是我想说,他们大部分都不是人形机器人,而是不像人的具身智能机器人。我觉得这种能跑出来并且做出成果的概率比人形机器人高太多了
那些纠结于是不是人形的,我觉得大概率会是做一个概念,可能就是用资本故事吧
@aigc1024
不过也看到了很多这几年可能容易跑出来的具身智能的项目。但是我想说,他们大部分都不是人形机器人,而是不像人的具身智能机器人。我觉得这种能跑出来并且做出成果的概率比人形机器人高太多了
那些纠结于是不是人形的,我觉得大概率会是做一个概念,可能就是用资本故事吧
@aigc1024
老品牌,值得信赖、相信品牌的力量
🌐球速体育官网: qs1736.cc
TG玩家首选人民币台 不限ip 免实名免绑卡手机号码
🌐N1国际官网: n10086.com
TG玩家首选U台 U存U提出款稳,福利好反水无上限
1.泰国大老板百家乐存50万出512万
2.斯里兰卡神秘大哥连续5天总提4000万+
3.实力盘总PA真人喜提990万一路爆红
4.pp电子糖果1000小注一拉爆出70万大奖
大额出款额外奖励8888-128888,双重日存彩金128888+4688每日送,周流水彩金68888每周送,双重签到彩金16888+3888送不停
【 球速体育 安全有保障】
老品牌值得信赖、安全第一、保障第一
不限ip、 免实名、免绑卡、免绑手机号码
每日存款彩金每日送,每笔存款加赠1%
球速体育频道: @qsty8999
N1国际频道: @N1GW8
体育推荐: @QSTY988
午夜剧场: @ziweifancha7
专属客服: @QSTY567
双向联系: @qsty168168_bot
整理了各种快速赚钱方法与新兴项目,书中不仅揭开了灰色产业链的内幕,也提醒读者防范骗局,避免被割韭菜。
🔗:https://pan.quark.cn/s/4df427340d5e
@meiriyishu
飞书cli 这种牛逼的东西,却因为飞书的技术架构,不得不让用户背负着巨大的理解成本,可以说这也是一种新旧时代交替的副作用了。
飞书的设计是经典的saas多租户的结构。要想使用飞书的api,就需要在飞书开发者后台创建一个新的应用,应用有两套权限,第一套是应用自己的,也就是应用跟员工平级,应用可以操作飞书里各种套件,比如文档啥的,操作的留痕就是应用。第二套是一种代理授权机制,也就是先让员工授权,把权限交给应用,应用去做事,但是留痕都是这个员工的。然后!这个应用有个机器人功能,可以让应用以一个机器人的面貌跟其他员工对,那这个机器人是啥权限呢,也是应用权限。
好,以上没有任何毛病,其实真研究明白了还挺清晰的。以前这里的复杂都是程序员来消化的,普通人难以得见,也不需要为此头疼。
但是有一天飞书cli发布了,这个团队极其的勤奋,144天狂发88个版本,平均1.5天发一版,功能的开放性也是超级炸裂,什么鸡儿都往里面加。之前飞书的功能开放全靠服务端api,这个api的更新是多久一回呢,基本上以季度来做节奏。当时官方飞书cli还没有发布时,我已经利用这批api做出了自己的飞书cli,当时就发现api开放性很差,很多细节都不提供api(比如文档发/回复评论)。完事官方的cli一发布,我做的cli立刻变成了小丑,因为官方cli里的api实在是太丰富了,远超之前的api体系。
于是,以上复杂的权限体系,庞大的功能,全部塞到这个cli里。按大的功能模块分组,官方提供了一堆skill来驱动Agent使用cli,牛逼也是真牛逼,但理解成本也真的很高。
首先是每个员工都要创建一个应用,每个员工!飞书已经对这个流程做了极致的简化,会引导你一键创建一个应用,但是,公司里创建应用首先是要审批的,创建了也不能立刻用上。再就是,很多小白员工发现一次居然不行,拿起小鞭子就让Agent反复创建应用,实际创建了一大堆!小白也不知道最终用的是哪个了!管理员你就审吧~
其次是权限,飞书的应用权限有 130 个,用户权限 139 个,你就配去吧,绝大多数人根本理解不了为什么权限会分为应用和用户,只能Agent说什么就做什么。然后还把两个权限的切换交给了cli,由Agent按需去用,实际最终的结果就是所有权限全打开了。那捏吗的还配置个der啊,直接默认全开不就好了吗?
再就是这个机器人,飞书cli的客服群里经常有人问,我都配置好了飞书cli了,为啥我的飞书机器人还是不回复我呢?对啊,为啥呢?说实这个问很难一句解释,因为经过一些骚操作,飞书cli确实也能让机器人跟员工对。但问在于,当你把这一大堆名词概念都推到小白前额叶的时候,大家都只能凭直觉去感受这耷拉着的AGI啊。
不过又说回来,这可能正是卖课的空间?由于这个架构的存在,这里的理解成本总是无法被消解的。也许精通AI的代价就是成为程序员的形状。
@aigc1024
飞书的设计是经典的saas多租户的结构。要想使用飞书的api,就需要在飞书开发者后台创建一个新的应用,应用有两套权限,第一套是应用自己的,也就是应用跟员工平级,应用可以操作飞书里各种套件,比如文档啥的,操作的留痕就是应用。第二套是一种代理授权机制,也就是先让员工授权,把权限交给应用,应用去做事,但是留痕都是这个员工的。然后!这个应用有个机器人功能,可以让应用以一个机器人的面貌跟其他员工对,那这个机器人是啥权限呢,也是应用权限。
好,以上没有任何毛病,其实真研究明白了还挺清晰的。以前这里的复杂都是程序员来消化的,普通人难以得见,也不需要为此头疼。
但是有一天飞书cli发布了,这个团队极其的勤奋,144天狂发88个版本,平均1.5天发一版,功能的开放性也是超级炸裂,什么鸡儿都往里面加。之前飞书的功能开放全靠服务端api,这个api的更新是多久一回呢,基本上以季度来做节奏。当时官方飞书cli还没有发布时,我已经利用这批api做出了自己的飞书cli,当时就发现api开放性很差,很多细节都不提供api(比如文档发/回复评论)。完事官方的cli一发布,我做的cli立刻变成了小丑,因为官方cli里的api实在是太丰富了,远超之前的api体系。
于是,以上复杂的权限体系,庞大的功能,全部塞到这个cli里。按大的功能模块分组,官方提供了一堆skill来驱动Agent使用cli,牛逼也是真牛逼,但理解成本也真的很高。
首先是每个员工都要创建一个应用,每个员工!飞书已经对这个流程做了极致的简化,会引导你一键创建一个应用,但是,公司里创建应用首先是要审批的,创建了也不能立刻用上。再就是,很多小白员工发现一次居然不行,拿起小鞭子就让Agent反复创建应用,实际创建了一大堆!小白也不知道最终用的是哪个了!管理员你就审吧~
其次是权限,飞书的应用权限有 130 个,用户权限 139 个,你就配去吧,绝大多数人根本理解不了为什么权限会分为应用和用户,只能Agent说什么就做什么。然后还把两个权限的切换交给了cli,由Agent按需去用,实际最终的结果就是所有权限全打开了。那捏吗的还配置个der啊,直接默认全开不就好了吗?
再就是这个机器人,飞书cli的客服群里经常有人问,我都配置好了飞书cli了,为啥我的飞书机器人还是不回复我呢?对啊,为啥呢?说实这个问很难一句解释,因为经过一些骚操作,飞书cli确实也能让机器人跟员工对。但问在于,当你把这一大堆名词概念都推到小白前额叶的时候,大家都只能凭直觉去感受这耷拉着的AGI啊。
不过又说回来,这可能正是卖课的空间?由于这个架构的存在,这里的理解成本总是无法被消解的。也许精通AI的代价就是成为程序员的形状。
@aigc1024
lash是31分,已经不太适用通用场景了,只能用在特定的细分领域。
比如它们都突出一个「快」字,主攻高速模型的品类,聪不聪明你别管,就问有没有秒回吧,在不追求解效果的工业化任务里是有价值的。
什么,你问22分的百度文心ERNIE 5.0是不是位于马里亚纳海沟?自从拉了这坨大的之后,百度就没有再把新发布的ERNIR5.1上传AA竞技场了,不参战就是没胜负,精髓。
@aigc1024
比如它们都突出一个「快」字,主攻高速模型的品类,聪不聪明你别管,就问有没有秒回吧,在不追求解效果的工业化任务里是有价值的。
什么,你问22分的百度文心ERNIE 5.0是不是位于马里亚纳海沟?自从拉了这坨大的之后,百度就没有再把新发布的ERNIR5.1上传AA竞技场了,不参战就是没胜负,精髓。
@aigc1024