老叶

老叶

丢失193个BTC的男人丨资深程序员丨AI爱好者丨喜欢打破垄断做免费软件,传统大厂恨的牙痒痒的男人。本账号推文信息不做为投资建议。

0Siguiendo
0seguidor

Feed

老叶1999.eth
老叶1999.eth
Antes DeepSeek la ignoraba, ¡pero ahora está fuera de tu alcance!
老叶1999.eth
老叶1999.eth
¡Grok 4.6 también está aquí! ¡Se lanzó casi simultáneamente con el DeepSeek-V4-Pro-0813! Para ser sincero, ver las especificaciones del Grok 4.6 me emocionó bastante. El Grok 4.5 ya es uno de mis modelos favoritos para el uso diario porque es muy rápido y no tiene demasiadas restricciones, lo que lo hace perfecto para el uso diario. Sin embargo, esta vez el Grok 4.6 se lleva directamente a parámetros muy cercanos a los dos modelos insignia de las dos principales marcas, y presume de velocidades superiores a ellas. ¡La grok de la vieja Mamá está realmente sobre la mesa esta vez! ¡Creo que realmente puede reemplazar a Gemini como el nuevo jugador de los 'Tres Grandes'!
老叶1999.eth
老叶1999.eth
¡Anunciado oficialmente! ¡DeepSeek-V4-Pro-0813 llegará pronto! Justo ahora, el documento oficial de la web de DeepSeek reveló el ID del modelo para la versión oficial de DeepSeek-V4-Pro. Según la fecha, la fecha de lanzamiento debería ser el 13 de agosto. Además, la versión oficial de V4-Pro comenzó a soportar la API Responses, permitiendo usarla directamente en códice sin ninguna conversión.
老叶1999.eth
老叶1999.eth
Explosion—OpenAI es realmente despiadado esta vez. El paquete Pro x20 acaba de reiniciar mi límite de crédito y me quedé completamente atónito La cuota semanal parece reducirse a solo un tercio de la cantidad anterior. No un corte pequeño, sino un corte directo en la carne. En los últimos dos días, las visitas a modelos de OpenAI han estado constantemente saturadas, con lag frecuente, límites de ancho de banda y colas. Así que ahora solo quedan dos posibilidades: o hay un error en la configuración de la cuota, O simplemente OpenAI no puede mantenerse y está ajustando proactivamente la cuota de usuarios de Pro. Si es lo segundo, entonces el paquete Pro x20 tiene que recalcular su relación coste-rendimiento. No estoy seguro de si es un caso aislado. Hermanos con X20, revisad vuestra cuota y comprobad si también la han recortado.
老叶1999.eth
老叶1999.eth
¡Tibo miente! Tras varias rondas de pruebas del paquete PRO x20, GPT-5.6 Luna solo ha reducido el precio de la suscripción en un 40%. El límite semanal para la cuenta PRO x20 que ejecuta solo el modelo Luna es la mitad que para ejecutar directamente el modelo SOL.
Tibo
Tibo
Al parecer, algunos buenos entendieron mal, pero la reducción del precio del GPT-5.6 Luna en un 80% no es una maniobra temporal, es permanente. Las ganancias de eficiencia no desaparecen. Por suerte.
老叶1999.eth
老叶1999.eth
Algunos internautas preguntaron, ¿por qué no usar directamente :model_provider = "OpenAI" De este modo, también puedes crear imágenes y buscar. Déjame explicar por qué, porque la mayoría de los traslados evitan model_providers. OpenAI utiliza principalmente compacto remoto porque es una solicitud síncrona, y muchos CF usados para relé tienen el riesgo de que los tiempos de espera superen los 100 segundos. Si estás usando tu propio proxy inverso y no usas CF, puedes seguir este método sin más revisión. Tras el procesamiento inverso, descubrí que además de detectar model_providers, también detecta la cabecera x-openai-actor-authorization. Por lo tanto, según mi plan, puedes evitar la compactación remota y aun así obtener imágenes y búsquedas en bruto. En segundo lugar, ¿por qué necesitamos revertirlo? Porque he visto que la versión de escritorio de Codex detecta la cabecera openai-actor-authorization, pero la versión de escritorio actualmente no es de código abierto.
老叶1999.eth
老叶1999.eth
¡Aparición repentina! El nuevo cliente Codex está "reduciendo secretamente el coeficiente intelectual" de las estaciones repetidoras de terceros. El 11 de julio descubrí que la nueva versión de Codex no podía generar imágenes, y publiqué inmediatamente la solución completa. Pensaba que esto era solo una limitación de la función de imagen en bruto, pero tras un análisis inverso más profundo, me di cuenta de que las cosas son mucho más complicadas. Una vez que el nuevo Codex detecta que estás usando un proveedor externo, restringe directamente dos capacidades clave: 1. Generación de imágenes 2、Búsqueda web Si las fotos en raw están restringidas, es fácil que la gente lo note. Pero el silencioso cierre de la Web Search es donde realmente importan las capacidades del modelo. Mucha gente puede no darse cuenta de lo importante que es la búsqueda web. Las bases de conocimiento internas de los grandes modelos tienen plazos; no saben lo que acaba de pasar hoy, ni pueden acceder a los últimos documentos, noticias y cambios tecnológicos de la nada. Por ello, los fabricantes de modelos ofrecen a los plugins de modelos capacidades de búsqueda en línea en tiempo real, que es la Búsqueda Web. Es equivalente a los "ojos" del modelo. Sin la búsqueda web, los modelos solo pueden confiar en conocimientos desactualizados para responder preguntas; Con la búsqueda web, puede consultar información en tiempo real por todo internet, verificar hechos y leer los documentos más recientes. Pero ahora, mientras uses una estación de retransmisión de terceros en el nuevo Codex, incluso si el backend está conectado al mismo modelo legítimo, el cliente puede bloquear directamente las capacidades de búsqueda web. El modelo no ha cambiado. La API no ha cambiado. Que el proveedor no sea oficial, el cliente elimina automáticamente la capacidad. Este es el verdadero significado de "reducción de inteligencia del lado del cliente". La buena noticia es que, tras un análisis inverso, he encontrado formas de saltarme restricciones, restaurar la reproducción de imágenes y usar la Búsqueda Web. Ya publiqué un tutorial detallado sobre modificaciones en mi tuit anterior: Si usas una estación de retransmisión de terceros Codex, se recomienda comprobarlo inmediatamente. Crees que estás usando el mismo modelo, pero en realidad, el cliente puede que ya lo haya recortado en secreto. Puedes echar un vistazo a la comparación antes y después de la modificación en la imagen adjunta:
老叶1999.eth
老叶1999.eth
Un día completo de experiencia profunda con GPT-5,6-sol. Mi actitud pasó por aproximadamente tres etapas: Emoción → cuestionamiento → comprensión y aceptación. Primero, hablemos de un punto que resulta fácilmente confuso: El nivel de inferencia más alto de GPT-5.6-sol es en realidad xhigh. Los Max y Ultra que aparecen en la interfaz se refieren más al modo de flujo de trabajo del cliente, no solo a hacer el modelo "más inteligente". El aspecto más criticado de Ultra hoy en día es que le gusta distribuir automáticamente grandes cantidades de subagentes. Incluso una tarea sencilla puede reunir instantáneamente a un montón de proxies y consumir una gran cantidad de tokens. Todo el proceso puede parecer grandioso, pero los beneficios reales pueden no igualar el coste. Cuando empecé a usarlo, era un poco escéptico: ¿Esto es solo trabajo o solo una exhibición de fichas? Más tarde, tras entender sus mecánicas, bajé mi nivel de razonamiento a Alto y volví a hacer algunas tareas reales, lo que en realidad mejoró mucho la experiencia. Es más rápido que GPT-5.5 xhigh, con capacidades y estabilidad significativamente más fuertes, y su consumo de tokens no está tan exagerado como el de Ultra. Al menos por mi experiencia de hoy: GPT-5.6-sol + Alto podría ser la combinación más adecuada para el uso diario ahora mismo. Para refactorización compleja, revisiones completas de proyectos y tareas importantes que requieren exploración paralela, también se puede considerar Ultra. No hace falta maximizar las tareas de desarrollo habituales de inmediato. Este modelo no es inutilizable, ni tiene que estar ajustado sin pensar a la marcha más alta. El verdadero problema es que mucha gente ni siquiera ha descubierto la diferencia entre niveles Max, Ultra y de inferencia antes de usar ya Ultra como modo por defecto. Si se usa correctamente, es definitivamente mucho mejor que el 5.5. Si lo usas mal, solo puedes ver cómo las fichas salen de golpe.
老叶1999.eth
老叶1999.eth
¡Aquí va un consejo para todos! Si quieres usar 5,6 sol. ¡Por favor, tirad los Superpoderes a la basura por ahora! Si no, verás al modelo librado horas de batallas entre hemisferios izquierdo y derecho. Con el tiempo, los problemas se acumulan y nunca terminan.
老叶1999.eth
老叶1999.eth
Perdón, fui muy descuidado, ¡por favor perdóname! Después de usarlo todo un día, sentí que 5,6 sol era demasiado lento y, en segundo lugar, demasiado contradictorio. Un problema pequeño, cuanto más lo arreglas, ¡más grande se vuelve el alcance! Lo siento, Ultraman, ¡esta vez no puedo presumir por ti! Después de tanto tiempo afilando, ¿es esto? Cuando descubrí que el 5.6 en realidad se desarrolló usando la base del 5.4, supe que estaba condenado.
老叶1999.eth
老叶1999.eth
Perdón, fui muy descuidado, ¡por favor perdóname! Después de usarlo todo un día, sentí que 5,6 sol era demasiado lento y, en segundo lugar, demasiado contradictorio. Un problema pequeño, cuanto más lo arreglas, ¡más grande se vuelve el alcance! Lo siento, Ultraman, ¡esta vez no puedo presumir por ti! Después de tanto tiempo afilando, ¿es esto? Cuando descubrí que el 5.6 en realidad se desarrolló usando la base del 5.4, supe que estaba condenado.
老叶1999.eth
老叶1999.eth
gpt-5.6-sol 还没用上的,真的赶紧去用。 我刚用 ultra 模式,把自己的中转站项目完整 review 了一遍。 耗时 1 小时 32 分钟,硬生生揪出了 19 个问题。 说实话,我人都看傻了。 我一直有个习惯:每次发版前必须做一次 review。原本以为项目已经挺干净了,结果还是挖出一堆历史遗留问题。 现在终于明白了: gpt-5.5 留下的屎山,得靠 gpt-5.6 来擦。 至于 gpt-5.6 留下的屎山…… 那就等 GPT-6.0 来擦吧。